#70 · 主分类: 语音合成与识别
VieNeu-TTS
越南语TTS,支持即时语音克隆 • 设备端运行 • 实时CPU推理 • 24kHz音频质量 • 将文本转换为越南语语音 • 越南语文本转语音 • 越南语TTS
项目最后更新:08/25/26
GitHub Stars
2.4K
Forks数量
732
贡献者数量
18
许可证
Apache-2.0
收录理由
VieNeu-TTS 完全跑在本地硬件上,用 CPU 就能实时合成越南语语音,按字符计费的云服务在这里派不上用场。除了常规的文字转语音,它还能从三到八秒的录音里克隆音色,一句话里混着越南语和英语也能顺畅切换,甚至能把多人播客或对话脚本一次性批量生成。新版 v2 模型自带默认音色,省去了先找参考音频的麻烦,同时提供新闻播报、故事讲述等朗读风格,还能在文本里插入实验性的情绪标签。这套能力对延迟敏感、又注重数据隐私的交互式语音产品、离线演示终端和本地化流程来说,正好绕开了云端的限制。项目附带了网页界面和简洁的 Python SDK,覆盖 v2 以及早期预览的 v3 Turbo 主干,团队可以快速上手试跑,再决定是否投入生产。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。