#69 · 主分类: 语音合成与识别

audio.cpp

ai amd-gpu apple-silicon asr audio audio-analysis cpp edge-ai ggml minimax-music3 music-generation speech-analysis speech-to-speech speech-to-text text-to-speech tts voice-cloning voice-conversion vulkan

一个由ggml驱动的全功能纯C++音频模型推理引擎,支持TTS、STT、VAD、语音转换、音乐生成等,性能高度优化,无Python依赖。

项目最后更新:08/29/26

GitHub Stars

2.1K

Forks数量

254

贡献者数量

54

许可证

Other

收录理由

audio.cpp 把众多音频模型装进一个纯 C++ 编译好的程序里,语音合成、语音识别、声音克隆、语音活动检测和音乐生成都能在一个二进制文件里跑起来,完全不用折腾 Python 环境。底层基于 ggml,同一套模型文件可以在 NVIDIA、AMD、Apple Silicon 和纯 CPU 设备之间直接迁移,这对笔记本和边缘硬件尤其友好——那些地方往往跑不动笨重的 Python 依赖栈。项目自带的 Arena 界面方便并排对比本地模型,HTTP 服务模式则能轻松把推理结果接进你自己的应用。相比 Python 参考实现,它在多个路径上有显著提速,同时支持 GGUF 量化加载,部署时通常能简化流程,而质量损失很小。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目