#90 · 主分类: 深度学习框架
rl-baselines3-zoo
deep-reinforcement-learning
gym
hyperparameter-optimization
hyperparameter-search
hyperparameter-tuning
lab
openai
optimization
pybullet
pybullet-environments
pytorch
reinforcement-learning
rl
robotics
sde
stable-baselines
tuning-hyperparameters
Stable Baselines3强化学习智能体的训练框架,含超参数优化和预训练智能体。
项目最后更新:08/24/26
GitHub Stars
2.9K
Forks数量
605
贡献者数量
40
许可证
MIT
收录理由
凡是认真使用 Stable Baselines3 做强化学习的人,大概率迟早会碰到这个项目。它把 RL 工作流里那些琐碎又关键的环节打包好了:训练脚本、评估、录像、画图都有现成实现,还为常见环境和算法配好了调好的超参数。这些超参数放在 YAML 文件里,直接拿来当起点复制改改就行。仓库里还带了预训练好的智能体,你可以先看看一个配置良好的策略实际跑起来是什么效果,再决定要不要在自己那边花算力从头训练。这样一来,做算法对比和结果复现就省事多了,因为默认配置和可复现的设定都集中在了一处。对想弄明白超参数选择如何影响强化学习表现的人来说,它也是个不错的学习材料。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。