#57 · 主分类: 深度学习框架

AReaL

agent llm llm-agent llm-reasoning machine-learning-systems mlsys reinforcement-learning rl

基于LLM的智能体应用的RL桥接。简单且灵活。

项目最后更新:08/29/26

GitHub Stars

5.7K

Forks数量

589

贡献者数量

106

许可证

Apache-2.0

收录理由

让大模型更可靠地推理,或在真实系统里像智能体一样行动,通常需要搭起强化学习回路,把奖励、轨迹和规模协调好。AReaL 正是为这件事而生的训练基础设施:它采用完全异步的强化学习范式,绕开了拖慢大型推理模型和智能体模型的同步瓶颈,还能对接黑盒智能体系统——只要换一下 base_url,就能对现有系统做在线强化学习。项目附带数学、编程和端到端软件工程任务的完整示例,还提供一个精简版,其算法优先的 API 很适合研究者快速试验新的强化学习方法。如果你的团队因为搭建成本而迟迟没有尝试智能体强化学习,这个工具就是为降低那部分成本而设计的。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目