#79 · 主分类: 语音合成与识别

ElatoAI

agents ai arduino cloudflare deno elevenlabs esp32 gemini grok hardware hume llm openai realtime speech-to-speech stt supabase tts websocket

实时语音AI,在Arduino ESP32上支持100+模型,具备安全Websockets和边缘函数,适用于AI伴侣和设备。

项目最后更新:08/19/26

GitHub Stars

1.9K

Forks数量

240

贡献者数量

6

许可证

Other

收录理由

这个项目把实时语音交互的整套流程搬到了ESP32上,而不是依赖背后强大的云服务器。它通过安全WebSocket将语音识别、大语言模型和语音合成串联起来,边缘函数配合Pipecat或FastAPI后端能让会话持续超过二十分钟,不会在对话中途断线。无论你在做AI玩具、陪伴设备还是其他互动装置,这里都提供了现成的接线方案,把微控制器接入几十种云端语音模型,省去自己逐个写集成的麻烦。OpenAI的官方手册也把它作为在Arduino上运行Realtime API的示例,这算是来自API开发者的实际认可。如果你正在原型设计一个需要真正开口对话的设备,研究这个项目比自己从零搭建要省力得多。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目