声浪
ACM MM | UniStyle: 联合说话风格描述和风格化语音生成的风格建模
说话风格(speaking style)可以通过文字形式表达,称为风格描述;也可以通过语音表达,称为风格语音(stylistic speech)。理解说话风格,例如对话中的情绪,并以适当的风格回应,是人类对话中的自然现象。然而,从技术角度来…
23 0 0
文本和上下文感知的高表现力有声书合成
语音合成(TTS)的目标是从文本生成自然流畅的语音。随着序列到序列(seq2seq)方法的广泛应用,语音合成系统在自然度和表现力方面取得了显著进展。然而一个主要挑战是,在不依赖人工标注数据或参考语音的情况下,语音合成系统难以像人类朗读者那样…
23 0 0
