#119 · 主分类: 语音合成与识别
Verbi
一个模块化语音助手,用于通过OpenAI、Groq、Deepgram和本地选项实验最先进的转录、响应生成和文本转语音模型。
项目最后更新:11/22/25
GitHub Stars
1.1K
Forks数量
217
贡献者数量
4
许可证
MIT
收录理由
Verbi更像一个用于对比语音模型的实验台,而非开箱即用的成品助手。它的流水线被拆成转录、回复生成、语音合成三个独立模块,每个都能随意替换。你可以把同一段请求分别丢给OpenAI、Groq、ElevenLabs、Cartesia或Deepgram,需要离线工作时也能接入Ollama、MeloTTS、Piper这类本地方案。这种设计很适合在选定某个转录或语音模型之前,先针对特定语言或口音测试哪个效果更好。项目自带麦克风录音和音频播放功能,整个流程只需一个配置文件就能控制,很快就能跑通一个可用的语音循环,然后逐个换模块做对比实验。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。