#credential-leak

共收录 1 条相关安全情报。

← 返回所有主题
👥 作者: Zixiao Chen, Mariko Wakabayashi, Charlotte Siska

该论文提出了一个名为 Secret Scanner Agent (SSA) 的多智能体大语言模型系统,旨在从非结构化的暴露文档(如电子邮件、聊天记录、工单、事件笔记)中提取泄漏的凭据及其关联的访问上下文(即“门”)。传统的秘密扫描器依赖正则表达式或训练分类器,在格式化代码上表现良好,但当凭据被碎片化、重新格式化或远离其解锁的资源时,难以有效工作,且仅报告秘密字符串而不指明其开启的资源。SSA 采用两个智能体协作:一个检测智能体优先保证高召回率,一个审查智能体负责过滤误报并恢复缺失的上下文。由于真实凭据数据敏感,研究团队在生成的合成基准上评估 SSA,涵盖 23 种秘密类型和多种文档格式,并通过程序匹配、LLM 裁判和人工审核的三步流水线评分。实验表明,跨六个模型,多智能体 SSA 相比单智能体变体提高了提取精度,尤其在门提取上提升了最多 16 个百分点。与正则表达式扫描器相比,SSA 的召回率提高了三倍以上,同时保持相当的精度;与十三名安全分析师相比,SSA 更精确,恢复的秘密-门对数量接近两倍,且速度快 5 至 17 倍。SSA 最终输出秘密、其对应的门以及支持证据,将凭据检测转化为可操作的发现,便于分类和修复。该工作为安全运营中的凭据泄漏检测提供了新的自动化方法,尤其适用于事件响应场景。

💡 推荐理由: 凭据泄漏是安全事件的高频诱因,传统工具难以从非结构化文本中同时提取秘密及其上下文。SSA 将多智能体 LLM 用于凭据提取,显著提升召回率和可操作性,可大幅减少安全分析师的手动排查工作量。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)