#59 · 主分类: 语音合成与识别

EmotiVoice

ai deep-learning emotion emotivoice multi-speaker prompt python pytorch speech speech-synthesis style text-to-speech tts

EmotiVoice 😊:一个多语音和提示控制的TTS引擎

项目最后更新:08/13/24

GitHub Stars

8.5K

Forks数量

756

贡献者数量

13

许可证

Apache-2.0

收录理由

EmotiVoice 能从普通文本直接生成中英文语音,最打动人的是它对情绪的控制:你可以用一句提示词,让输出带上开心、兴奋、悲伤或愤怒的语气,而不是像多数 TTS 引擎那样平淡地念出来。这点让它特别适合做旁白、游戏对白,以及任何靠角色声音撑起来的音频内容。它还内置了超过两千种音色,想匹配某个角色或品牌调性,不用自己去训练模型。项目自带网页界面方便快速试听,也有脚本接口做批量生成,另外还提供了兼容 OpenAI 的 TTS 接口,能省事地接入现有流程。对做语音产品、互动媒体或本地化语音应用的团队来说,是个很实在的起点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目