#28 · 主分类: 机器人仿真与具身智能模拟

lingbot-va

[RSS 2026] 用于通用机器人控制的因果视频-动作世界模型

项目最后更新:07/09/26

GitHub Stars

1.8K

Forks数量

164

贡献者数量

5

许可证

Apache-2.0

收录理由

LingBot-VA 把通用机器人控制里最棘手的一环——既要预测场景下一步会发生什么,又要决定自己该做什么——放在同一个自回归视频-动作世界模型里解决。它把视觉动态预测和动作推理交织成单一序列,让机器人在行动前先掂量后果。仓库为实际使用做了充分准备:预训练权重、后训练代码、整理成 LeRobot 格式的数据集都齐了,还直接支持在 RoboTwin-2.0 和 LIBERO 上跑评估,服务端与客户端分离的架构也让模型和仿真器解耦。做机器人研究或具身智能的工程师,想复现结果、用自己的操作数据微调,或者拿世界模型方法和纯动作策略做对比,都会觉得顺手。双流混合 Transformer 加 KV 缓存的实现,对长时程任务里推理效率有要求的人,也值得细看。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目