本文首次对大语言模型(LLM)智能体在多工具集成场景下的任务控制流安全性进行了系统分析。LLM 智能体利用一组工具进行推理和规划,但多工具集成带来了工具管理、兼容性、依赖关系和控制流保护等安全挑战。作者提出了一种新型威胁——跨工具收割与污染(XTHP),该威胁包含多种攻击向量,攻击者可先劫持智能体任务的正常控制流,进而收集或污染系统中的机密或私有信息。为评估该威胁的实际影响,作者开发了 Chord——一个动态扫描工具,用于自动检测真实世界中易受 XTHP 攻击的智能体工具。作者对来自 LangChain 和 Llama-Index 两大主流 LLM 智能体开发框架的 66 个真实工具进行了评估,发现其中 75% 的工具易受 XTHP 攻击,凸显了该威胁的普遍性。该研究为 LLM 智能体安全提供了新的视角,揭示了工具间交互中存在的控制流风险,并为后续的防御研究奠定了基础。适合 LLM 安全研究员、智能体框架开发者以及安全运营人员阅读。
💡 推荐理由: LLM 智能体正被广泛部署,多工具集成已成为常态,而本研究表明 75% 的真实工具存在控制流劫持与数据污染风险,直接威胁企业级智能体应用的机密性与完整性,安全团队需关注此类新型攻击面。
🎯 建议动作: 研究跟进