#103 · 主分类: 语音合成与识别
Speech-AI-Forge
🍦 Speech-AI-Forge 是一个围绕 TTS 生成模型开发的项目,实现了 API 服务器和基于 Gradio 的 WebUI。
项目最后更新:05/21/26
GitHub Stars
1.4K
Forks数量
189
贡献者数量
12
许可证
AGPL-3.0
收录理由
同时跑多个语音模型,通常意味着要在不同环境里来回切换、对接各自的接口。Speech-AI-Forge 把 CosyVoice、Fish-Speech、Index-TTS、Spark-TTS、GPT-SoVITS 等多项 TTS 引擎统一收进一个 API 服务,并配了 Gradio 网页界面,切换模型时不用重写调用逻辑。它还通过 SenseVoice 和 Whisper 提供语音识别,适合做“语音进、语音出”的交互实验,而不只是单向生成。部署方式也比较灵活,既有一键启动的 Colab 笔记本,也有 Windows 整合包和 Docker 镜像,省去折腾环境的麻烦。对正在做语音助手或音频工作流原型的团队来说,这套统一的服务端接口,能让你用一份代码驱动多种引擎,省心不少。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。