#149 · 主分类: 语音合成与识别
CleanS2S
ai
gpt-4o
machine-learning
python
speech-recognition
speech-synthesis
speech-to-speech
streaming
高质量流式语音到语音交互智能体,单文件实现。
项目最后更新:04/07/26
GitHub Stars
541
Forks数量
54
贡献者数量
9
许可证
Apache-2.0
收录理由
CleanS2S 把语音到语音的交互智能体压缩进一个文件里,从音频输入到语音回复的整条链路都能从头到尾读通。对想弄明白流式全双工语音交互到底怎么拼装起来的研究者和工程师来说,这是个很实在的起点,不用去翻庞大的生产代码。这个智能体在对话中还能主动发起话题,而不只是被动应答,同时接入了网页搜索和检索增强生成,回复可以引用外部信息。想快速验证 GPT-4o 风格的语音助手原型,或者只是想看看语音到语音的架构适不适合自己的产品,用这个项目先试一下想法,比直接投入更重的技术栈要省事得多。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。