#28 · 主分类: 深度学习框架
stable-baselines3
baselines
gsde
gym
machine-learning
openai
python
pytorch
reinforcement-learning
reinforcement-learning-algorithms
robotics
sb3
sde
stable-baselines
toolbox
Stable Baselines 的 PyTorch 版本,强化学习算法的可靠实现。
项目最后更新:08/17/26
GitHub Stars
13.7K
Forks数量
2.2K
贡献者数量
174
许可证
MIT
收录理由
做强化学习的人想用现成的、经过验证的PyTorch实现,不想从头写训练循环,Stable Baselines3通常是首选。PPO、DQN、SAC、TD3、A2C这些常见算法都共用一套接口,换方法、对比结果都很顺手。每个算法都对照参考实现跑过基准测试,单元测试也覆盖得比较全,自定义策略、字典格式的观测空间、回调函数、TensorBoard日志这些功能开箱即用。无论是做研究实验还是快速搭个原型,用在机器人控制、决策问题或者游戏场景里都挺合适。不过得提一句,它默认你已经懂强化学习的基础概念,并不是给零基础的人当入门教程用的。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。