#22 · 主分类: 语音合成与识别

VoiceStudio

ai audiobook cuda dubbing elevenlabs-alternative huggingface local-first mlx omnivoice-studio speech-to-text tauri text-to-speech transcription translate tts voice-ai voice-cloning voice-generation voicestudio workflow

VoiceStudio 是一款开源、完全本地的 ElevenLabs 替代品——支持646种语言的语音克隆、语音设计、视频配音、听写、转录和有声书创作。

项目最后更新:08/28/26

GitHub Stars

12.0K

Forks数量

1.9K

贡献者数量

37

许可证

AGPL-3.0

收录理由

VoiceStudio 是一款桌面应用,把 ElevenLabs 那种声音克隆能力搬到了你自己的电脑上,而且不设订阅、没有用量计费。它支持从三秒的音频片段做零样本克隆,文本转语音覆盖 646 种语言,还能处理视频配音、听写和有声书制作,macOS、Windows、Linux 都能跑,默认本地优先。录音文件默认留在你的硬件里,除非你主动开启联网引擎,这对处理敏感音频的人来说很关键。项目还带说话人分离、人声提取、批量队列,以及一个可以从 Claude 或 Cursor 调用的 MCP 服务器。对于经常做语音内容的团队,或者想自己掌控文件和流程的人,这是一个相当扎实的开源替代方案。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目