#cross-session

共收录 2 条相关安全情报。

← 返回所有主题
👥 作者: SangJin Park, Myungsub Choi, Jineok Kim, Minseung Kang

该论文针对LLM智能体(Agent)在部署中面临的安全问题,提出了一种新的攻击归因任务:跨智能体异步攻击归因(Cross-Agent Asynchronous Campaign Attribution)。传统的LLM智能体防御通常在每个会话(session)级别独立进行检测,忽略了攻击者可能将攻击步骤分布到多个独立的智能体、团队或运行环境中,导致每个本地防御只能看到零散的片段。为了解决这一问题,论文形式化了跨智能体异步攻击归因的任务定义:在缺乏共享运行时状态、测试时攻击标签、攻击者身份或acles的情况下,将来自同一潜在攻击活动的不同会话关联起来。为此,作者提出了异步归因指纹向量(Asynchronous Attribution Fingerprint Vectors, A²FV),这是一种轻量级的代理侧参考协议,通过从代理可观察的工具体用(tool-use)、时序(timing)和提示残留(prompt residue)中提取特征,来计算会话对之间的攻击活动相似度评分。同时,论文构建了首个针对该任务的基准数据集SCD-v1,包含良性流量、孤立攻击、多会话攻击活动、匹配的非oracle逃避以及泄漏审计等场景。在SCD-v1上的实验表明,A²FV在攻击活动关联的成对AUC指标上达到0.82,而传统的单会话检测器和分块LLM评估器在相同任务下表现接近随机。进一步分析显示,最强的固定信号来自结构性和文体学残留,而时序则作为诊断通道用于更丰富的代理痕迹。交叉风格控制实验表明信号部分对风格敏感,但不能简化为仅风格因素。静态和维度感知的非oracle压力测试进一步表明,成对可分离性在受控逃避下仍然存在。这些结果确立了跨智能体攻击归因作为保障野外LLM智能体安全的一个独立评估层。

💡 推荐理由: 该研究揭示了多智能体系统中存在的跨会话攻击归因盲区,提供了一种轻量级方法将分散的攻击线索关联起来,显著提升了对复杂攻击的感知能力,对于部署多个LLM智能体的组织具有重要的安全防御价值。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Yuanbo Xie, Tianyun Liu, Yingjie Zhang, Suchen Liu, Yulin Li, Liya Su, Tingwen Liu

该论文系统性地研究了新兴的跨会话存储提示注入(Cross-Session Stored Prompt Injection)威胁,这是针对现代 Agentic 系统(基于 LLM 的自主代理系统)的一种攻击范式。传统提示注入攻击通常局限于单个会话内部,攻击者通过构造恶意输入诱导 LLM 产生不安全行为。然而,Agentic 系统的核心特性在于其跨会话持久化状态——这些系统通过记忆(memory)、文件系统(filesystem)、工具(tools)以及其他长期存在的上下文工件(contextual artifacts)来维护和演化共享的世界状态。这种设计极大地扩展了提示注入的攻击面,使得一次成功的注入能够持久化地嵌入系统状态中,并在未来多次执行中持续产生影响,类似于 Web 安全中的存储型跨站脚本(Stored XSS)。 论文首先对存储提示注入进行了形式化定义,提出了一种分类法(taxonomy),系统梳理了对抗性内容如何通过不同持久化通道(如记忆、文件、数据库等)在 Agentic 系统中留存并影响跨会话行为。在此基础上,作者开发了一套基准测试(benchmark)和沙箱工具包,用于定量评估不同模型、攻击目标及持久化通道下的攻击成功率。实验结果表明,持久化机制将提示注入从一次性的、模型级的威胁转变为一种长期存在的、系统级的漏洞,攻击者可以远程植入恶意逻辑,在后续会话中静默操控 Agent 的行为,而无需持续交互。 这项工作适合安全研究人员、LLM 应用开发者以及 Agentic 系统架构师阅读,它揭示了持久化状态带来的新安全风险,并提供了评估框架,为后续防御研究奠定了基础。值得注意的是,该论文尚未提出具体防御措施,但深入分析了攻击机制和影响范围,属于前沿威胁分析类研究。

💡 推荐理由: Agentic 系统正快速落地,其跨会话持久化状态带来了全新的攻击面。本文首次系统性地定义并评估了存储提示注入,揭示其从瞬时威胁变为长期系统级风险的转变,对 LLM 安全架构设计具有里程碑式意义。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)