声浪
字节Seed团队发布循环语言模型Ouro,在预训练阶段直接「思考」,Bengio署名
现代 LLM 通常依赖显式的文本生成过程(例如「思维链」)来进行「思考」训练。这种策略将推理任务推迟到训练后的阶段,未能充分挖掘预训练数据中的潜力。 为解决这一问题,字节 Seed 团队联合多家机构推出了Ouro,一类被称为循环语言模型(L…
22 0 0
抖音SAIL团队联合港中文MMLab推出SAIL-Embedding:打通「视、文、音」的全模态嵌入
来源丨机器之心 近日,字节跳动抖音 SAIL 团队联合香港中文大学 MMLab 提出 SAIL-Embedding——一款专为大规模推荐场景设计的全模态嵌入基础模型。 SAIL-Embedding 不仅实现了视觉、文本、音频的统一表征,更在…
19 0 0
WEST来了,一站式搞定语音理解、生成与对话
大语言模型(LLM)的爆发式发展彻底改变了人工智能的学习与应用范式。如今,这股变革力量又延伸到了语音领域,由西北工业大学、南京大学和WeNet社区研发的WEST(WE Speech Toolkit)正式开源,它以LLM为核心,打通语音识别、…
20 0 0
Soul App与西工大、上交大开源语音合成模型 SoulX-Podcast,登顶HuggingFace TTS趋势榜!
近日,Soul App AI团队(Soul AI Lab)与西北工业大学ASLP@NPU团队和上海交通大学X-LANCE Lab正式开源语音播客生成模型SoulX-Podcast。该模型是一款专为多人、多轮对话场景打造的语音生成模型,支持中…
21 0 0
