#campaign-attribution

共收录 1 条相关安全情报。

← 返回所有主题
👥 作者: SangJin Park, Myungsub Choi, Jineok Kim, Minseung Kang

该论文针对LLM智能体(Agent)在部署中面临的安全问题,提出了一种新的攻击归因任务:跨智能体异步攻击归因(Cross-Agent Asynchronous Campaign Attribution)。传统的LLM智能体防御通常在每个会话(session)级别独立进行检测,忽略了攻击者可能将攻击步骤分布到多个独立的智能体、团队或运行环境中,导致每个本地防御只能看到零散的片段。为了解决这一问题,论文形式化了跨智能体异步攻击归因的任务定义:在缺乏共享运行时状态、测试时攻击标签、攻击者身份或acles的情况下,将来自同一潜在攻击活动的不同会话关联起来。为此,作者提出了异步归因指纹向量(Asynchronous Attribution Fingerprint Vectors, A²FV),这是一种轻量级的代理侧参考协议,通过从代理可观察的工具体用(tool-use)、时序(timing)和提示残留(prompt residue)中提取特征,来计算会话对之间的攻击活动相似度评分。同时,论文构建了首个针对该任务的基准数据集SCD-v1,包含良性流量、孤立攻击、多会话攻击活动、匹配的非oracle逃避以及泄漏审计等场景。在SCD-v1上的实验表明,A²FV在攻击活动关联的成对AUC指标上达到0.82,而传统的单会话检测器和分块LLM评估器在相同任务下表现接近随机。进一步分析显示,最强的固定信号来自结构性和文体学残留,而时序则作为诊断通道用于更丰富的代理痕迹。交叉风格控制实验表明信号部分对风格敏感,但不能简化为仅风格因素。静态和维度感知的非oracle压力测试进一步表明,成对可分离性在受控逃避下仍然存在。这些结果确立了跨智能体攻击归因作为保障野外LLM智能体安全的一个独立评估层。

💡 推荐理由: 该研究揭示了多智能体系统中存在的跨会话攻击归因盲区,提供了一种轻量级方法将分散的攻击线索关联起来,显著提升了对复杂攻击的感知能力,对于部署多个LLM智能体的组织具有重要的安全防御价值。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)