#13 · 主分类: AI音乐生成
open-musiclm
MusicLM的实现,一个由谷歌研究发布的文本到音乐模型,并进行了一些修改。
项目最后更新:06/03/23
GitHub Stars
559
Forks数量
65
贡献者数量
2
许可证
MIT
收录理由
这份基于PyTorch的Google MusicLM复现项目,适合那些想从文本生成音乐、并且愿意自己训练模型而非调用托管API的开发者。它遵循论文中的三阶段设计,分别建模语义、粗粒度和细粒度token,但把原始组件换成了公开可用的替代品:用CLAP替代MuLan,用Encodec替代SoundStream,用MERT替代w2v-BERT。这一替换很关键,因为你能拿到预训练权重并跑通整个流程,而不必受限于Google的专有模型。仓库详细介绍了从残差向量量化器、K-means层到三个Transformer阶段的完整训练过程,还包含一个预处理步骤,可以提前缓存token。它也与更忠实原论文的musiclm-pytorch实现做了直接对比,并坦诚记录了早期实验效果,这在你决定基于哪个代码库开发时很有参考价值。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。