#102 · 主分类: 语音合成与识别
alltalk_tts
AllTalk TTS 是一个基于 Coqui 的文本转语音引擎,具有高级功能,如模型微调、低显存支持、DeepSpeed 加速以及用于第三方应用的 JSON API 集成。
项目最后更新:01/09/26
GitHub Stars
2.4K
Forks数量
285
贡献者数量
12
许可证
AGPL-3.0
收录理由
AllTalk 面向那些已经搭建好本地文本生成环境、还希望它开口说话的用户。它可以独立运行,也能嵌入 SillyTavern、oobabooga 这类前端工具,适合需要旁白或角色配音的剧本互动与聊天演示。实用功能相当扎实:低显存模式让它在 GPU 内存被大模型占满时依然跑得动,DeepSpeed 能显著加快合成速度,批量模式可以把长篇文档一次性读成单个音频文件。你还能针对特定嗓音微调模型,或者加载自定义的 XTTSv2 音色,想要保持角色声线一致时比默认声音可靠得多。此外它提供 JSON 接口,方便你用脚本调用,内置的说明文档和设置页也让这套以本地为主的方案更易打理。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。