#270 · 主分类: 教育与研究

reinforcement-learning-an-introduction

artificial-intelligence reinforcement-learning

强化学习导论的Python实现

项目最后更新:08/09/24

GitHub Stars

14.8K

Forks数量

5.0K

贡献者数量

33

许可证

MIT

收录理由

对于正在研读Sutton和Barto所著《强化学习导论》第二版的读者来说,这个仓库是一份非常趁手的实践伴侣。它用干净、自包含的Python代码重新实现了书中几乎所有的图表和示例,从十臂老虎机测试平台、网格世界的价值迭代,到蒙特卡洛方法、时序差分学习、Sarsa、Q学习、Dyna-Q以及函数逼近,覆盖面相当完整。每个脚本都能复现书中对应的那张图,你跑完某一章的代码,看到结果,就能拿它来对照自己的理解,相当于有了一份可运行的参考答案。想从读公式跨到真正跑算法的学生,会从这里收获最多;老师也可以直接把脚本拿去做实验课的素材。代码按章节组织,刻意保持简洁,在转向更重的框架之前,拿它当起点很合适。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目