声浪
自回归量化连续语音合成,潜在扩散模型;多模态音频理解基准
语音合成与音频理解:自回归量化连续语音合成,潜在扩散模型;多模态音频理解基准 Continuous Speech Synthesis using per-token Latent Diffusion 2024-10-21|IBM Resea…
20 0 0
面壁智能 | 招聘语音合成算法工程师(北京)
面壁智能 面壁智能是一家人工智能大模型技术创新与应用落地企业,愿景为“智周万物”,致力于创造安全、普惠的通用人工智能,让AI技术惠及千万家企业。 我们将努力构建智能时代大模型基础设施,加速大模型在人工智能典型场景与领域应用与落地,成为通用智…
20 0 0
MaskGCT:登上GitHub趋势榜榜首的TTS开源大模型
近日,香港中文大学(深圳)联手趣丸科技推出了新一代大规模声音克隆TTS模型——MaskGCT。该模型在包含10万小时多语言数据的Emilia数据集上进行训练,展现出超自然的语音克隆、风格迁移以及跨语种生成能力,同时保持了较强的稳定性。Mas…
16 0 0
