#11 · 主分类: 语音合成与识别

faster-whisper

deep-learning inference openai quantization speech-recognition speech-to-text transformer whisper

基于CTranslate2的更快Whisper转录

项目最后更新:11/19/25

GitHub Stars

25.1K

Forks数量

2.0K

贡献者数量

47

许可证

MIT

收录理由

在众多 Whisper 复现项目中,faster-whisper 是生产环境里最常见的选择之一。它把 OpenAI 的模型权重跑在 CTranslate2 推理引擎上,官方基准显示,在相同准确率下,速度比原版最多快四倍,内存占用也更低。如果硬件条件有限,开启 8-bit 量化后,即使是较大的模型也能在纯 CPU 机器上流畅运行。它的 API 设计几乎照搬原版 Whisper,之前为 openai/whisper 写的代码迁移过来基本不用大改;音频解码由内置的 PyAV 处理,省去了单独安装 FFmpeg 的麻烦。对于会议转写、字幕生成或通话分析这类场景,批量推理模式能明显提升吞吐量,这也是它最实用的地方。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目