#physical-prompt-injection

共收录 1 条相关安全情报。

← 返回所有主题
👥 作者: Yaxin Li, Hao Wang, Yanda Shao, Shuhao Zhang, Yan Long

该论文首次系统性地研究了针对可穿戴设备(如智能眼镜)上视觉-语言模型(VLM)的物理提示注入攻击。作者指出,随着VLM被部署在人脸朝向的可穿戴设备上,物理环境中的恶意文本(如广告牌、海报上的敌意文字)可以作为间接提示注入的视觉通道,劫持VLM的行为。这类攻击不仅能中断设备的正常任务(如视觉问答、场景描述),还能引导模型生成粗俗、偏见甚至虚假的输出。研究团队在超过200个真实环境中使用AI眼镜拍摄照片,识别出6种代表性的物理注入提示威胁向量,并在12个VLM模型上评估。结果显示,攻击在模拟和真实环境中分别达到高达96%和60%的成功率,模型表现出对环境中文本的过度信任,忽略实际视觉上下文并产生完全相反的摘要或指令。为应对这一威胁,作者提出了两种针对性的防御策略:基于掩码的外部过滤器和基于语义向量的内部检测器,有效降低了攻击成功率和安全影响。

💡 推荐理由: 该研究揭示了VLM在可穿戴设备上面临的真实世界物理空间攻击风险,攻击者可利用环境文本进行间接提示注入,安全从业人员需关注这种新的攻击面。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)