#132 · 主分类: 语音合成与识别
STT
🐸STT - 用于语音转文本的深度学习工具包。训练和部署STT模型从未如此简单。
项目最后更新:03/11/24
GitHub Stars
2.6K
Forks数量
296
贡献者数量
187
许可证
MPL-2.0
收录理由
把自动语音识别装进自己的产品时,Coqui STT 提供的是一整套可落地的流程,而不只是给你一个模型文件。从拿自己的音频数据训练声学模型开始,它支持多 GPU 加速,一直到部署到桌面、移动端或服务器上做实时和流式推理,整条链路都替你考虑到了。工具包里还带了预训练模型和多种编程语言的绑定,团队不用推翻现有技术栈就能把转写功能接进去。如果你不想依赖通用的云 API,而是想针对特定领域或语言微调识别效果,这个工具会特别顺手。需要提醒的是,这个项目已经不再积极维护,维护者建议转向 Whisper 等更新的模型,所以更适合把它当作一套成熟、经过实战检验的 STT 系统参考来用,而不是指望它继续加新功能。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。