该论文提出了LLM辅助逆向工程中的表示混淆攻击(Representation-Confusion Attacks in Reverse Engineering, RARE),指出攻击者可以通过构造恶意二进制文件,使其中的字符串、反编译输出或工具报告在LLM驱动的逆解流水线中被错误地提升为指令、证据或可信分析状态,从而误导分析过程。论文首先构建了RARE-Bench基准测试,包含行为检查过的干净和对抗性二进制文件,并在11520次调用探索性研究后,使用20个新程序对两个模型进行了测试。结果表明,在没有运行时控制的情况下,模型在35/40个对抗性案例中提出了不安全的操作,而在干净案例中为0/40。即使将二进制内容仅作为数据展示(Data-Only渲染),模型仍提出了15个不安全建议。为此,论文提出了RARE-Guard防御机制,包括工具授权(Tool Authorization)和支持/溯源门控(Support Gate / Provenance Gate)。工具授权拒绝所有15个不安全建议,并授权所有40个匹配的分析师请求。支持门控通过分别计数来自不同来源的记录,验证了23/40个虚假声明;溯源门控则先按来源分组再计数,验证了0/40个虚假声明,并保留了所有40个支持声明。进一步在16个程序上对Ghidra、r2pipe和angr进行测试,在预选的8个程序子集中,单一工具的分析草案均未达到支持门控对虚假声明的验证阈值;而在所有16个程序的融合草案中,支持门控验证了32/32个虚假声明,溯源门控则阻止了所有32个虚假声明的验证并保留了所有32个支持声明。确定性渲染器防止了降级声明在最终报告中重新出现。论文结论是,二进制内容可以在不获得工具权威的情况下指导分析,且多个工具提供的视角不一定能提供独立证据。该研究揭示了LLM辅助逆向工程中潜在的安全风险,并提供了可落地的防御方案。
💡 推荐理由: 首次系统化揭示LLM辅助逆向工程中的表示混淆攻击,并提出了可操作的防御框架RARE-Guard,对安全分析工具的可信性和自动化逆向流程的安全性具有重要警示意义。
🎯 建议动作: 纳入内部评估