推荐 10.5
Conf: 50%
本文提出了一种面向大型语言模型(LLM)交互的开源、面向用户的防火墙架构,旨在保护敏感数据的隐私。研究背景是LLM在成为高效生产力工具的同时,其集成到工作流中可能带来数据泄露等重大风险。核心问题是:如何在不影响可用性的前提下,对基于Web和应用程序编程接口(API)的LLM交互进行全面的流量监控和敏感数据拦截。为此,作者设计了一种结合浏览器扩展和代理的双重架构,实现对HTTP(S)和WebSocket通信的完全流量拦截。关键创新在于一个灵活的多智能体(Multi-Agent)管道,该管道采用混合方法:一方面使用确定性检测器(如正则表达式、模式匹配)快速识别已知敏感数据(如信用卡号、API密钥),另一方面利用LLM驱动的语义分析来检测上下文中的复杂泄露风险(如机密对话、专有代码)。该框架还具备专有代码泄露预防和可扩展组件,未来可集成提示注入防御等安全增强功能。分层架构支持在不同环境(云端、本地、边缘)部署,允许组织根据计算成本、检测深度和延迟需求进行权衡。实验评估显示,在最优配置下,该框架的F1分数最高达94.93%,表明其在敏感数据检测方面具有高准确性。适合AI安全研究人员、企业安全架构师和希望安全使用LLM的开发者阅读。
💡 推荐理由: LLM的广泛使用导致敏感数据泄露风险激增,本文提出了首个开源的多智能体防火墙方案,实现了高精度检测与灵活部署的平衡,对提升企业级LLM应用安全性具有重要参考价值。
🎯 建议动作: 研究跟进
排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)