#199 · 主分类: 语音合成与识别

lora-svc

lora singing-voice-conversion speech-to-sing uni-svc vits vits-svc voice-change voice-cloning voice-conversion whisper

基于whisper的歌声转换,以及用于歌声克隆的lora

项目最后更新:11/03/23

GitHub Stars

645

Forks数量

80

贡献者数量

6

许可证

MIT

收录理由

歌声转换的核心玩法,是把一段人声演唱重新渲染成另一个人的音色,同时保留旋律和歌词。lora-svc 将 Whisper 用于提取语言内容,说话人编码器负责音色特征,再用基于神经源滤波器的 BigVGAN 声码器完成最终合成。对个人玩家和小团队来说,实际可操作的地方在于:先做常规预处理——分离伴奏、把音频切成短片段,然后拿少量目标音色的录音,在预训练模型上做微调就能克隆声音。项目自带 GUI 脚本覆盖训练和推理流程,还提供音高移位参数,方便直接转调。需要说明的是,LoRA 风格的适配器微调在项目里只是被引用,并未完整实现,所以它更像一个能跑通的转换工具集,而不是现成的适配器框架。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目