#103 · 主分类: 语音合成与识别

Speech-AI-Forge

agent asr chattts chattts-forge chinese colab cosy-voice cosyvoice english firered fireredtts fish-speech gpt llama llm ssml stt text-to-speech tts whisper

🍦 Speech-AI-Forge 是一个围绕 TTS 生成模型开发的项目,实现了 API 服务器和基于 Gradio 的 WebUI。

项目最后更新:05/21/26

GitHub Stars

1.4K

Forks数量

189

贡献者数量

12

许可证

AGPL-3.0

收录理由

同时跑多个语音模型,通常意味着要在不同环境里来回切换、对接各自的接口。Speech-AI-Forge 把 CosyVoice、Fish-Speech、Index-TTS、Spark-TTS、GPT-SoVITS 等多项 TTS 引擎统一收进一个 API 服务,并配了 Gradio 网页界面,切换模型时不用重写调用逻辑。它还通过 SenseVoice 和 Whisper 提供语音识别,适合做“语音进、语音出”的交互实验,而不只是单向生成。部署方式也比较灵活,既有一键启动的 Colab 笔记本,也有 Windows 整合包和 Docker 镜像,省去折腾环境的麻烦。对正在做语音助手或音频工作流原型的团队来说,这套统一的服务端接口,能让你用一份代码驱动多种引擎,省心不少。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目