#196 · 主分类: AI代理与自动化
ten-framework
ai
multi-modal
real-time
video
voice
对话式语音AI代理的开源框架
项目最后更新:08/27/26
GitHub Stars
11.1K
Forks数量
1.4K
贡献者数量
87
许可证
Other
收录理由
自己动手搭建语音智能体,通常要把语音识别、大语言模型和语音合成逐个拼起来,还得自己处理消息流转和并发。TEN 把这一层协调工作封装成了运行时,开发者可以专注于业务逻辑,不必从零搭建整个链路。它的扩展机制支持按需挂载记忆、语音活动检测、轮次判断以及 WebSocket 和 RTC 上的流式传输,后续调整某一环节不会牵动全局。仓库自带的示例覆盖了不少实际场景:低延迟语音助手、说话人分离、口型同步虚拟形象,甚至还有通过 SIP 接打电话的案例。如果你想找一个能直接用于生产的实时多模态对话底座,而不是停留在演示层面的玩具项目,TEN 是一个值得认真评估的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。