#234 · 主分类: 视频与动画
MuseV
MuseV:无限长度和高保真虚拟人视频生成,基于视觉条件并行去噪
项目最后更新:06/28/24
GitHub Stars
2.8K
Forks数量
303
贡献者数量
10
许可证
Other
收录理由
对于做虚拟人和角色视频的团队来说,MuseV 解决了一个很棘手的问题:如何在长镜头里保持主体一致。它基于扩散模型,提出的视觉条件并行去噪方案打破了以往的长度限制,不再是只能生成几秒的循环短片,而是能输出连续的高保真说话或表演片段。项目兼容 Stable Diffusion 生态,你可以直接使用自己的基础模型、LoRA 权重和 ControlNet 配置,同时支持图生视频、文生图再生成视频以及视频生视频等多种输入方式。借助 IPAdapter、ReferenceNet 这类多参考图技术,角色的面部和外形在帧间能保持稳定。MuseV 还与 MuseTalk、MusePose 配合使用,从而支撑起完整的虚拟人制作流程,而非一个孤立生成器。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。