#114 · 主分类: 语音合成与识别
CrispASR
C++ ggml 运行时中心,用于多语言 ASR 和 TTS 模型:Cohere Transcribe、Parakeet TDT、Voxtral、Canary 1B v2 等,以及通用强制对齐等更多功能。
项目最后更新:08/30/26
GitHub Stars
593
Forks数量
103
贡献者数量
33
许可证
MIT
收录理由
CrispASR 是一个基于 ggml 的单一 C++ 二进制程序,同时覆盖语音转文字和文字转语音两个方向,一套工具就能处理双向的语音任务。它支持多种开源权重 ASR 模型,包括 Whisper、NVIDIA Parakeet 和 Canary、Mistral Voxtral、Cohere Transcribe,以及数十种 TTS 引擎。后端可以在命令行中指定,也可以根据 GGUF 文件自动识别,`-m auto` 参数会在首次使用时自动下载权重,省去了大部分环境配置的麻烦。项目不依赖 Python 或 PyTorch,对于想将转写功能嵌入现有服务的团队来说很有吸引力;HTTP 服务器模式、C-ABI 以及 Python、Rust、Go 等语言的绑定覆盖了这类集成路径,WebAssembly 构建还能让所有功能在浏览器端完全客户端运行。如果你希望用一套统一的接口管理多种语音模型,而不是为每个模型分别维护工具,这个项目会是很顺手的选择。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。