#255 · 主分类: 深度学习框架
reaver
Reaver:模块化深度强化学习框架。专注于星际争霸II。支持Gym、Atari和MuJoCo。
项目最后更新:11/01/20
GitHub Stars
560
Forks数量
86
贡献者数量
1
许可证
MIT
收录理由
Reaver 把智能体、模型和环境拆成相互独立的模块,想换哪块就换哪块,做深度强化学习实验时相当顺手,尤其是围绕《星际争霸 II》的那套任务。它同样能接 Gym、Atari 和 MuJoCo 环境,覆盖面不算窄。项目自带的命令行工具和调好的超参数,让你用一行短命令就能启动训练,然后看着结果慢慢逼近参考数值,对想亲手摸一摸 actor-critic 方法实际行为的人来说,是个很直观的练手对象。业余玩家改几个超参数就能跑出能用的智能体,研究者则能拿这份代码当底子继续往上加东西。需要提醒的是,这个项目已经停止维护,所以更适合当作学习资料和二次开发的起点,别指望它支撑长期运行的生产系统。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。