推荐 10.5
Conf: 50%
本文提出一种自动化框架,用于从网络安全威胁情报(CTI)报告中提取可到达的攻击链。现有CTI提取方法主要关注指标、实体或TTP标签,但未建模每个攻击步骤的执行条件和结果状态,因此无法支持状态匹配或多阶段攻击链的可达性分析。该框架将每个攻击步骤建模为一个攻击单元,包含前置条件、攻击行为和后置条件。采用多阶段流水线,结合大语言模型(LLM)来提取攻击行为骨架、恢复前置和后置条件、归一化为预定义谓词并修复断裂依赖;最终将攻击单元编译为Datalog风格的规则,用于攻击目标可达性推理。在包含334个人工验证注释步骤的20份CTI报告数据集上,该框架在恢复攻击行为方面比代表性CTI提取系统实现了更高的注释步骤覆盖率。此外,通过显式生成前置和后置条件,它产生的攻击单元比端到端LLM基线更完整、更一致。在提取的链上,Datalog推理在20份报告中的19份中到达了指定的攻击目标,而后向搜索在生成的规则下产生了34条攻击路径。源代码和实验工件已以匿名形式提供。
💡 推荐理由: 该工作使CTI报告中的描述性文本能自动转化为可推理的攻击路径,提升安全运营中攻击链还原和威胁溯源的自动化水平。
🎯 建议动作: 研究跟进
排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)