arXiv語音 AI
免訓練提升語音情緒!EmoRES-TTS 透過「殘差向量分解」實現精準可控的語音合成
EmoRES-TTS: Training-Free Residual-Enhanced Vector Steering for Emotional Speech Generation
本研究提出 EmoRES-TTS,透過將情緒引導向量分解為「偏離中性」的共享成分與「特定情緒」的殘差成分,在不需重新訓練模型的情況下,大幅提升文字轉語音(TTS)的情緒表達力與自然度。
2 分鐘閱讀
#indextts-2
1 篇文章
EmoRES-TTS: Training-Free Residual-Enhanced Vector Steering for Emotional Speech Generation
本研究提出 EmoRES-TTS,透過將情緒引導向量分解為「偏離中性」的共享成分與「特定情緒」的殘差成分,在不需重新訓練模型的情況下,大幅提升文字轉語音(TTS)的情緒表達力與自然度。