#124 · 主分类: 语音合成与识别

cheetah

asr automatic-speech-recognition online-speech-recognition speech-recognition speech-to-text streaming-speech-to-text stt transcription voice-recognition

基于深度学习的设备端流式语音转文字引擎

项目最后更新:08/17/26

GitHub Stars

671

Forks数量

77

贡献者数量

14

许可证

Apache-2.0

收录理由

Cheetah 是一款完全在设备端运行的流式语音转文字引擎,说话时即可实时返回部分识别结果,无需等待整句说完,因此特别适合实时字幕、语音指令和交互式助手这类对延迟敏感的场景。所有音频处理都在本地完成,不依赖网络,既能离线工作,也避免了语音数据上传带来的隐私顾虑,在手机、嵌入式板卡等资源受限的硬件上也能流畅运行。它提供了覆盖 Android、iOS、Web、桌面及嵌入式平台的统一接口,一次集成即可适配多种目标设备。如果你正在开发语音产品,希望获得稳定一致的本地识别效果,又不想按分钟支付云端转写费用,Cheetah 是一个值得考虑的起点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目