该论文研究了利用开源权重的大语言模型(LLMs)从网联与自动驾驶汽车(CAV)相关的通用漏洞披露(CVE)中生成结构化威胁信息表达(STIX)的问题。CAV依赖互联的软件和硬件组件,漏洞通常以纯文本形式记录在CVE数据库中,但安全从业者需要受影响资产、弱点类型和攻击行为的结构化信息来有效缓解风险。为此,作者构建了CAV-STIXGen数据集,将CAV漏洞描述映射到STIX域对象(SDO)、STIX关系对象(SRO)、通用弱点枚举(CWE)和MITRE ATT&CK技术映射。使用该数据集,评估了11个开源权重LLM(4B到120B参数),采用不同提示策略和温度参数。单模型配置在SDO、SRO和CWE映射上的F1分数分别达到0.94、0.63和0.99,但完整的MITRE ATT&CK映射仍具挑战性。在多智能体设置中,Gemma-4-31B和Codestral-22B在SDO和SRO上分别达到0.91和0.43的F1分数。进一步分析了CWE和ATT&CK的共现模式,识别出CAV领域的重复威胁模式,展示了AI辅助的漏洞到STIX转换如何自动化威胁情报并优先防御运输安全。
💡 推荐理由: 该研究展示了LLMs自动将CAV漏洞转化为标准化威胁情报的可行性,有助于加速威胁建模和优先级排序,对智能网联汽车安全运营有直接参考价值。
🎯 建议动作: 研究跟进