#165 · 主分类: 语音合成与识别

Orpheus-FastAPI

ai-text-to-speech ai-voice artificial-intelligence

高性能文本转语音服务器,兼容OpenAI API,支持8种声音、情感标签和现代Web界面。针对RTX GPU优化。

项目最后更新:07/05/25

GitHub Stars

718

Forks数量

150

贡献者数量

5

许可证

Apache-2.0

收录理由

Orpheus-FASTAPI 是一个可自行部署的文本转语音服务,对外提供与 OpenAI 兼容的 API,如果你已经在使用 /v1/audio/speech 接口,无需改动客户端即可直接接入。它基于 FastAPI 封装了 Orpheus 模型,并附带带波形播放的网页界面,不写代码也能生成语音。多语言支持是它最实用的部分:共 24 种音色、覆盖八种语言,每种语言都有对应的量化 GGUF 模型,通过修改一个环境变量即可切换。情感标签可以引导输出带有笑声、叹息等表现力的语气,长文本则按句子分批处理并用交叉淡化拼接,保证输出连贯。Docker Compose 同时支持 CUDA、ROCm 和纯 CPU 环境,无论是 RTX 显卡还是普通机器都能跑起来。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目