#160 · 主分类: 语音合成与识别
chatterbox-tts-api
本地、兼容OpenAI的文本转语音(TTS)API,使用Chatterbox,使用户能够在任何使用OpenAI API的地方(如Open WebUI、AnythingLLM等)生成语音克隆语音。
项目最后更新:12/23/25
GitHub Stars
672
Forks数量
153
贡献者数量
1
许可证
AGPL-3.0
收录理由
自托管的聊天界面,比如 Open WebUI 和 AnythingLLM,本来就能调用 OpenAI 的语音接口,但那样会把音频送到第三方服务器,还得按字符付费。这个项目换成本地端点,用同样的协议说话,这些工具就能在不出本机的情况下生成语音。它用 FastAPI 把 Chatterbox 模型包成服务,支持 22 种语言,还能拿你自己的声音样本做克隆,想在多个应用里保持同一个音色时特别方便。内置的语音库和长文本自动切分,让它不只是能应付短回复,Docker 镜像从纯 CPU 主机到 Blackwell 显卡都覆盖了,部署基本就是选个 compose 文件的事。要是你注重隐私,或者不想按字符掏钱,这算是给现有工具加 TTS 的干净路子。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。