#124 · 主分类: 语音合成与识别
cheetah
asr
automatic-speech-recognition
online-speech-recognition
speech-recognition
speech-to-text
streaming-speech-to-text
stt
transcription
voice-recognition
基于深度学习的设备端流式语音转文字引擎
项目最后更新:08/17/26
GitHub Stars
671
Forks数量
77
贡献者数量
14
许可证
Apache-2.0
收录理由
Cheetah 是一款完全在设备端运行的流式语音转文字引擎,说话时即可实时返回部分识别结果,无需等待整句说完,因此特别适合实时字幕、语音指令和交互式助手这类对延迟敏感的场景。所有音频处理都在本地完成,不依赖网络,既能离线工作,也避免了语音数据上传带来的隐私顾虑,在手机、嵌入式板卡等资源受限的硬件上也能流畅运行。它提供了覆盖 Android、iOS、Web、桌面及嵌入式平台的统一接口,一次集成即可适配多种目标设备。如果你正在开发语音产品,希望获得稳定一致的本地识别效果,又不想按分钟支付云端转写费用,Cheetah 是一个值得考虑的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。