本文提出了一种针对AI智能体的侦察驱动渗透测试方法。传统渗透测试在每一步都使用侦察来发现隐藏的弱点、构建更强的攻击并推进目标,而作者认为AI智能体需要同样的处理。作者通过建模智能体侦察过程,识别其试图提取的知识资产:包括它们是什么、如何使用以及利用哪些智能体弱点来为攻击者在间接提示注入攻击中提供杠杆。基于这些洞察,作者实现了Know Your Agent (KYA)框架,该框架通过探测智能体、构建目标档案并利用这些档案来制定更强攻击,从而自动化黑盒侦察驱动渗透测试。在智能体安全基准测试和一个真实编码智能体上的评估表明,KYA能够有效生成更有效的攻击。作者开源了KYA、其基准测试和基线实现以供可重复性研究。本文适合AI安全研究人员、渗透测试人员以及LLM应用开发者阅读。
💡 推荐理由: AI智能体正被广泛应用于敏感任务,但其安全性评估缺乏系统化的侦察方法。本文填补了这一空白,提出了第一个面向智能体的侦察驱动渗透测试框架。
🎯 建议动作: 研究跟进