GitHub Stars
701
Forks数量
208
贡献者数量
3
许可证
MIT
收录理由
这个项目把流式语音识别、本地大语言模型和语音合成打包进一个统一管理的应用里,用户拿到的是完整的对话闭环,而不是零散的组件。启动器会先检测你的硬件和内存情况,再自动推荐合适的模型组合,覆盖普通CPU、NVIDIA显卡、Apple Silicon,甚至能在Jetson Orin Nano上跑出实时对话效果,边缘设备也能流畅使用。界面直接跑在浏览器里,还支持远程客户端模式,让轻量笔记本通过网络连接另一台机器上的语音服务。整套系统在容器内运行,完全离线工作,模型选择和服务的启动这些麻烦事都交给启动器处理,用户只需按提示操作即可。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。