GitHub Stars
4.6K
Forks数量
500
贡献者数量
1
许可证
Other
收录理由
这个项目把构建 LLM 智能体工作台中最耗时的一环交给机器去熬夜完成。你只需要写一个 Markdown 文件,说明你想要什么样的智能体,一个元代理就会自动修改系统提示词、工具、智能体配置和编排逻辑,跑一遍基准测试,查看得分,决定保留还是放弃这次改动,然后继续尝试下一轮。被测的工作台本体放在单个 Python 文件里,改动一目了然,不用去猜黑盒里发生了什么。它面向那些已经习惯基于基准测试开发、希望系统性地在提示词和工具组合上做爬山优化而不是手工调参的团队。只要你有 Docker,能本地运行评估任务,就能把这个具体回路扔给机器,让它替你值夜班。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。