GitHub Stars
12.2K
Forks数量
1.1K
贡献者数量
41
许可证
MIT
收录理由
这是一个开源文本生成视频项目,用代码复现了OpenAI Sora背后的思路,任何人都能运行和扩展。项目提供了训练与推理的完整方案、预训练权重,以及可跨GPU扩展的架构,团队可以据此从文本提示生成高分辨率长视频,不必依赖封闭的商业API。相关代码还附有介绍模型设计与视频自编码器的arXiv论文,对研究大型视频扩散模型构建方式的人而言,是实用的参考资料。V1.5版本完全基于华为昇腾硬件训练,给使用该技术栈的团队提供了现成的起点。项目开发活跃,欢迎外部贡献。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。