#118 · 主分类: 语音合成与识别

rhino

entity-resolution intent-inference natural-language-understanding nlu on-device slot-filling slu speech-recognition spoken-language-understanding voice-assistant voice-command voice-command-control voice-commands voice-control voice-recognition voice-ui voice-user-interface vui

基于深度学习的设备端语音转意图引擎

项目最后更新:08/12/26

GitHub Stars

709

Forks数量

94

贡献者数量

26

许可证

Apache-2.0

收录理由

Rhino 走了一条与多数语音助手不同的路:它不先把语音转成文字再解析,而是直接从音频里读出意图。比如你说一句“来杯小杯双份浓缩”,它就能返回结构化结果,相关取值已经替你抽好了。这种直截了当的做法在嵌入式场景里很讨喜,因为它能跑在 Arm Cortex-M、树莓派、Android、iOS 以及浏览器上,全程在设备端完成,不需要联网。你可以在 Picovoice Console 里自定义命令上下文和槽位类型,再通过 Python、Node、Flutter、React Native 等 SDK 接入。对做智能家居控制、自助终端这类命令集固定且对延迟敏感的项目来说,它体积小、响应快,这两点足以让人愿意上手一试。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目