GitHub Stars
9.3K
Forks数量
1.5K
贡献者数量
6
许可证
Other
收录理由
LTX-2 是 Lightricks 推出的音视频生成模型,基于 DiT 架构,在同一个模型里同时生成同步的音频与画面,省去了把视频生成器接上独立音频管线的麻烦。这个仓库提供官方 Python 推理代码和 LoRA 训练器,你可以在自己的硬件上跑,也能用自备素材做微调,不必依赖托管 API。对于做短视频原型开发的团队,可选的编译版 CUDA 内核能在本地 GPU 上加快生成速度,README 里也写清了如何从 Hugging Face 下载权重并快速产出第一个结果。模型还支持多种性能模式和可交付级输出,权重开放获取,上手评估不用先掏订阅费。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。