#148 · 主分类: 深度学习框架
d3rlpy
deep-learning
deep-reinforcement-learning
offline-rl
pytorch
一个离线深度强化学习库
项目最后更新:09/10/25
GitHub Stars
1.7K
Forks数量
267
贡献者数量
25
许可证
MIT
收录理由
d3rlpy 很适合那些必须从历史记录数据而非实时交互中求解的强化学习问题。这个库专门做离线强化学习,从固定的过往经验数据集中学习策略,在机器人、医疗等真实试错成本高昂或危险的领域尤其有价值。同时它也通过同一套 API 保留常规在线训练,让你无需学习第二个工具就能切换模式。实现的算法涵盖 SAC、DQN 这类经典选择,CQL 这样的保守方法,以及更新的基于 Transformer 的策略,全部由配置驱动的接口封装,隐藏了 PyTorch 细节。教程和复现脚本能帮助你在信任它解决自己的问题之前,先对照已发表的结果检验实现。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。