#199 · 主分类: 语音合成与识别
lora-svc
lora
singing-voice-conversion
speech-to-sing
uni-svc
vits
vits-svc
voice-change
voice-cloning
voice-conversion
whisper
基于whisper的歌声转换,以及用于歌声克隆的lora
项目最后更新:11/03/23
GitHub Stars
645
Forks数量
80
贡献者数量
6
许可证
MIT
收录理由
歌声转换的核心玩法,是把一段人声演唱重新渲染成另一个人的音色,同时保留旋律和歌词。lora-svc 将 Whisper 用于提取语言内容,说话人编码器负责音色特征,再用基于神经源滤波器的 BigVGAN 声码器完成最终合成。对个人玩家和小团队来说,实际可操作的地方在于:先做常规预处理——分离伴奏、把音频切成短片段,然后拿少量目标音色的录音,在预训练模型上做微调就能克隆声音。项目自带 GUI 脚本覆盖训练和推理流程,还提供音高移位参数,方便直接转调。需要说明的是,LoRA 风格的适配器微调在项目里只是被引用,并未完整实现,所以它更像一个能跑通的转换工具集,而不是现成的适配器框架。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。