#134 · 主分类: 深度学习框架

agents

bandits contextual-bandits dqn multi-armed-bandits reinforcement-learning rl-algorithms tensorflow tf-agents

TF-Agents:一个可靠、可扩展且易于使用的TensorFlow库,用于上下文老虎机和强化学习。

项目最后更新:01/16/26

GitHub Stars

3.0K

Forks数量

752

贡献者数量

155

许可证

Apache-2.0

收录理由

如果你的项目涉及强化学习,TF-Agents 是个很实在的选择。它把通常纠缠不清的训练流程拆成可自由组合的模块:策略负责选动作,环境产生观测,学习器从经验中更新,各部分职责清晰,想换算法或环境时不用推翻重来。研究者试验新方法时,会发现每个组件都是经过测试、可扩展的类,而不是黑盒;工程师若只想快速跑通 DQN、PPO、SAC 或 bandits,直接拿现成实现放到标准 Gym 风格环境里训练就行。仓库附带的教程和 Colab 笔记本从 RL 概念入门讲到 Cartpole 环境里的完整 agent,对新手团队特别友好。如果你本来就在 TensorFlow 生态里,它直接复用 TF 的数据管道和执行模型,不必再引入另一套框架,衔接很自然。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目