微软对Azure Al语音服务的Personal Voice功能进行了升级,引入了新的零样本学习(zero-shot)的文本到语音(TTS)模型。与初始模型相比,这些新模型提高了合成语音的自然度,并更好地模仿了提示语音中的语音特征。
Microsoft Azure官网:https://azure.microsoft.com/zh-cn/products/ai-services/text-to-speech
还要给大家说的是微软Azure是免费的,自己登录注册就行,大家自行去登录部署使用即可。

更新体验:https://ai.azure.com/explore/speech
en-US-AvaMultilingualNeural
en-US-AndrewMultilingualNeural
en-US-EmmaMultilingualNeural
en-US-BrianMultilingualNeural
De-DE-FlorianMultilingualNeural
De-DE-SeraphinaMultilingualNeural
Fr-FR-RemyMultilingualNeural
Fr-FR-VivienneMultilingualNeural
zh-CN-XiaoxiaoMultilingualNeural
特 点
无论在创建基于语音的聊天机器人、语音助手还是对话代理,这些新语音都将确保交互更加逼真、栩栩如生和引人入胜。 针对对话优化的语音在阅读对话和非正式文本时听起来更加自然和引人入胜。 包括像笑声和填充停顿等感叹词,为虚拟对话增添了人性化的气息。
应用场景
使用教程
















在这里我们就可以看到不同国家的各种声音模型,之后Microsoft Azure上新语音模型也会更新到这里。
每个声音模型也都配置了不同的对话场景和情绪,甚至还有各种方言,可以说是目前市面上最全的AI语音库了。

效果虽然没法和开头展示的语音效果相媲美,但是已经非常接近真人声音了。
选择好想用的声音模型,点击转到有声内容创作。
把文本内容粘贴到文本框,点击播放按钮就可以进行语音合成。
右侧操作栏可以设置语言、声音模型和说话风格以及气口停顿等等功能,非常齐全。


之后再制作有声读物、小说推文或者是其他有声内容时就可以直接使用Microsoft Azure。无论是声音模型的丰富度还是功能的易用性,Microsoft Azure基本上就相当于语音合成领域的OpenAI。
