#10 · 主分类: 游戏AI与行为树

diamond

artificial-intelligence atari deep-learning diffusion-models machine-learning reinforcement-learning research world-models

DIAMOND(DIffusion As a Model Of eNvironment Dreams)是一个在扩散世界模型中训练的强化学习智能体。NeurIPS 2024 Spotlight。

项目最后更新:12/06/24

GitHub Stars

2.1K

Forks数量

167

贡献者数量

3

许可证

MIT

收录理由

DIAMOND 是 NeurIPS 2024 Spotlight 论文的官方代码,其核心思路是让强化学习智能体完全在基于扩散模型的世界模型中训练,而不是直接与真实环境交互。对于研究基于模型的强化学习或世界模型的开发者来说,它提供了一个少见的干净基线:代码可直接运行,还附带 Atari 预训练权重,你不仅能观看智能体表现,还能随时接管控制。论文和项目页面把设计思路讲得很清楚,因此这个仓库也适合作为学习扩散模型如何充当“可学习的模拟器”的实践教材。如果你所在团队正在考虑用生成模型替代或补充传统模拟器,这里是一个很好的起点,尽管它离成熟产品还有距离。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目