#69 · 主分类: 语音合成与识别
audio.cpp
一个由ggml驱动的全功能纯C++音频模型推理引擎,支持TTS、STT、VAD、语音转换、音乐生成等,性能高度优化,无Python依赖。
项目最后更新:08/29/26
GitHub Stars
2.1K
Forks数量
254
贡献者数量
54
许可证
Other
收录理由
audio.cpp 把众多音频模型装进一个纯 C++ 编译好的程序里,语音合成、语音识别、声音克隆、语音活动检测和音乐生成都能在一个二进制文件里跑起来,完全不用折腾 Python 环境。底层基于 ggml,同一套模型文件可以在 NVIDIA、AMD、Apple Silicon 和纯 CPU 设备之间直接迁移,这对笔记本和边缘硬件尤其友好——那些地方往往跑不动笨重的 Python 依赖栈。项目自带的 Arena 界面方便并排对比本地模型,HTTP 服务模式则能轻松把推理结果接进你自己的应用。相比 Python 参考实现,它在多个路径上有显著提速,同时支持 GGUF 量化加载,部署时通常能简化流程,而质量损失很小。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。