#534 · 主分类: 教育与研究

Reinforcement-learning-with-tensorflow

a3c actor-critic asynchronous-advantage-actor-critic ddpg deep-deterministic-policy-gradient deep-q-network double-dqn dqn dueling-dqn machine-learning policy-gradient ppo prioritized-replay proximal-policy-optimization q-learning reinforcement-learning sarsa sarsa-lambda tensorflow-tutorials tutorial

简单的强化学习教程,莫烦Python 中文AI教学

项目最后更新:03/31/24

GitHub Stars

9.5K

Forks数量

5.0K

贡献者数量

10

许可证

MIT

收录理由

莫烦的这套强化学习教程,把每个算法都落到能直接跑起来的例子上。从网格世界里的Q-learning和Sarsa起步,接着进入深度Q网络及其改进版(Double DQN、优先经验回放、Dueling DQN),再过渡到策略梯度、Actor-Critic、DDPG、A3C和PPO这些基于策略的方法。每一课都配了简短的讲解、可运行的TensorFlow代码和可视化环境,运行的时候能亲眼看着智能体一点点学会任务。教程里还包含一些更吃力的控制实验,比如二维小车、机械臂、BipedalWalker和LunarLander,让读者感受方法在复杂场景下的表现。内容同时提供中英文版本,对喜欢边读代码边改代码来学习的开发者和学生来说,是个很实用的起点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目