#34 · 主分类: 网络安全与解密工具

LLM4Decompile

binary decompile large-language-models reverse-engineering

逆向工程:使用大语言模型反编译二进制代码

项目最后更新:02/12/26

GitHub Stars

7.0K

Forks数量

549

贡献者数量

5

许可证

MIT

收录理由

安全分析师、恶意软件研究人员、漏洞挖掘者,以及那些丢失了源代码的维护者,都会对这个项目感兴趣:它借助大语言模型,把反汇编出的 Linux x86_64 函数还原成可读的 C 代码。使用方式有两种,一是直接端到端反编译,二是对 Ghidra 生成的伪代码做二次精炼;模型参数从 1.3B 到 33B 不等,你可以按自己的 GPU 预算挑选合适的版本。它的评测基准看重的是可重执行性,而不是语法相似度,也就是说,还原出的代码必须能真正编译并通过原始测试用例。项目由研究驱动,附有论文和训练数据,但发布好的模型权重和 Colab 笔记本,让你无需自行训练模型,就能直接在自己的二进制文件上跑起来。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目