#99 · 主分类: 语音合成与识别

TensorFlowASR

automatic-speech-recognition conformer contextnet ctc deepspeech2 end2end jasper rnn-transducer speech-recognition speech-to-text streaming-transducer subword-speech-recognition tensorflow tensorflow2 tflite tflite-convertion tflite-model

:zap: TensorFlowASR:在Tensorflow 2中近乎最先进的自动语音识别。支持可以使用字符或子词的语言。

项目最后更新:08/05/26

GitHub Stars

1.0K

Forks数量

238

贡献者数量

13

许可证

Apache-2.0

收录理由

对于已经在使用 TensorFlow 的团队来说,这是一个相当完整的开源方案,可以用来训练自己的语音转文字模型。它实现了多种现代架构,包括 Conformer、ContextNet、流式转导器、DeepSpeech2 和 Jasper,并且同时支持 CTC 和 RNN-Transducer 两种训练路径,方便根据延迟和准确率需求选择端到端方案。如果打算把训练好的模型部署到手机或其他设备上,TFLite 转换支持就很有价值,能显著减少内存和计算量。仓库里还带有示例配置、预训练检查点以及针对英语和越南语的教程,能大大缩短从读论文到复现结果之间的距离。整体更偏向研究用途,需要自己准备数据集并调优模型,而不是像调用云端 API 那样直接使用。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目