#28 · 主分类: 深度学习框架

stable-baselines3

baselines gsde gym machine-learning openai python pytorch reinforcement-learning reinforcement-learning-algorithms robotics sb3 sde stable-baselines toolbox

Stable Baselines 的 PyTorch 版本,强化学习算法的可靠实现。

项目最后更新:08/17/26

GitHub Stars

13.7K

Forks数量

2.2K

贡献者数量

174

许可证

MIT

收录理由

做强化学习的人想用现成的、经过验证的PyTorch实现,不想从头写训练循环,Stable Baselines3通常是首选。PPO、DQN、SAC、TD3、A2C这些常见算法都共用一套接口,换方法、对比结果都很顺手。每个算法都对照参考实现跑过基准测试,单元测试也覆盖得比较全,自定义策略、字典格式的观测空间、回调函数、TensorBoard日志这些功能开箱即用。无论是做研究实验还是快速搭个原型,用在机器人控制、决策问题或者游戏场景里都挺合适。不过得提一句,它默认你已经懂强化学习的基础概念,并不是给零基础的人当入门教程用的。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目