#452 · 主分类: AI编程助手

Chronos

artificial-intelligence autonomous-debugging benchmark benchmark-report bug-fixing chronos code code-analysis code-analysis-tool code-debugger code-understanding debugging developer-tools kodezi language-model machine-learning program-repair software-engineering

开源的调试优先语言模型,SWE-bench Lite 准确率80.33%,实际修复准确率67%,比GPT-4强6倍。

项目最后更新:11/12/25

GitHub Stars

4.9K

Forks数量

211

贡献者数量

1

许可证

Other

收录理由

如果你所在团队经常被手动排查问题拖慢节奏,这个项目值得仔细看看。大多数编程模型擅长写新代码,但面对已有仓库里的故障定位和修复,往往表现不佳;Chronos正是针对这个盲区设计的调试优先模型。项目公开的评测数据显示,它在SWE-bench Lite上的成功率大幅领先主流大模型,对逻辑、并发和内存类缺陷的修复也有明显优势。仓库本身更像一份研究评估资料,包含详细的基准测试和架构说明,而不是可以直接运行的软件;模型目前为专有,需通过等待名单申请访问,计划于2026年第一季度随Kodezi OS发布。你可以把它当作一份深度基准报告来阅读,了解专门为调试打造的模型能达到什么水平,也能从中看到这一细分领域未来专用工具的发展方向。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目