#119 · 主分类: 语音合成与识别

Verbi

一个模块化语音助手,用于通过OpenAI、Groq、Deepgram和本地选项实验最先进的转录、响应生成和文本转语音模型。

项目最后更新:11/22/25

GitHub Stars

1.1K

Forks数量

217

贡献者数量

4

许可证

MIT

收录理由

Verbi更像一个用于对比语音模型的实验台,而非开箱即用的成品助手。它的流水线被拆成转录、回复生成、语音合成三个独立模块,每个都能随意替换。你可以把同一段请求分别丢给OpenAI、Groq、ElevenLabs、Cartesia或Deepgram,需要离线工作时也能接入Ollama、MeloTTS、Piper这类本地方案。这种设计很适合在选定某个转录或语音模型之前,先针对特定语言或口音测试哪个效果更好。项目自带麦克风录音和音频播放功能,整个流程只需一个配置文件就能控制,很快就能跑通一个可用的语音循环,然后逐个换模块做对比实验。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目