#537 · 主分类: 教育与研究

alpha-zero-general

alpha-zero alphago alphago-zero alphazero deep-learning gobang gomoku keras mcts monte-carlo-tree-search neural-network othello pytorch reinforcement-learning self-play tensorflow tf

一个基于AlphaZero的简洁实现,适用于任何框架中的任何游戏 + 教程 + 黑白棋/五子棋/井字棋/四子棋等等

项目最后更新:01/01/25

GitHub Stars

4.5K

Forks数量

1.2K

贡献者数量

41

许可证

MIT

收录理由

这个项目把AlphaGo Zero的核心思路讲得相当透彻,代码刻意保持精简,注释也很充分,读起来能顺着神经网络、蒙特卡洛树搜索和自对弈训练循环的脉络一路理清,不必在庞大工程里翻找。游戏逻辑和网络实现分离得很干净,想接入自己的双人回合制游戏,或者从PyTorch切到Keras,只需改很少几行。它还附带一个训练好的奥赛罗模型和文字教程,可以亲手跑一跑验证效果,对想先建立直观理解再动手做大系统的开发者来说特别实用。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目