#452 · 主分类: AI编程助手
Chronos
开源的调试优先语言模型,SWE-bench Lite 准确率80.33%,实际修复准确率67%,比GPT-4强6倍。
项目最后更新:11/12/25
GitHub Stars
4.9K
Forks数量
211
贡献者数量
1
许可证
Other
收录理由
如果你所在团队经常被手动排查问题拖慢节奏,这个项目值得仔细看看。大多数编程模型擅长写新代码,但面对已有仓库里的故障定位和修复,往往表现不佳;Chronos正是针对这个盲区设计的调试优先模型。项目公开的评测数据显示,它在SWE-bench Lite上的成功率大幅领先主流大模型,对逻辑、并发和内存类缺陷的修复也有明显优势。仓库本身更像一份研究评估资料,包含详细的基准测试和架构说明,而不是可以直接运行的软件;模型目前为专有,需通过等待名单申请访问,计划于2026年第一季度随Kodezi OS发布。你可以把它当作一份深度基准报告来阅读,了解专门为调试打造的模型能达到什么水平,也能从中看到这一细分领域未来专用工具的发展方向。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。