#176 · 主分类: 语音合成与识别
parrots
chinese-speech-recognition
chinese-speech-synthesis
parrot
pinyin2hanzi
speech-recognition
text-to-speech-python3
tts
自动语音识别(ASR)、文本转语音(TTS)引擎。中英语音识别、多角色语音合成,支持多语言,准确率高。
项目最后更新:11/11/25
GitHub Stars
528
Forks数量
93
贡献者数量
5
许可证
Apache-2.0
收录理由
这个项目把语音识别和语音合成打包成一个Python库,省去自己拼装ASR和TTS模型的麻烦。识别部分基于distil-whisper,支持中英文,还带拼音转汉字;合成方面提供三条路线:用GPT-SoVITS训练的多角色引擎,IndexTTS2支持情感和音色解耦、可调时长,以及流式输出实现低延迟实时语音。如果你在做中英文语音功能,想用一个库同时搞定识别和合成,这个很合适。多语言TTS加上情感和语速的精细控制是最大亮点,流式通道也让实时响应有了更快路径。装起来很简单,pip安装即可,还有HuggingFace在线试听,可以先感受下效果再决定。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。