#sparsity

共收录 3 条相关安全情报。

← 返回所有主题
👥 作者: Yongwan Jo, Jinyoung Park, Euihyun Lee, Dokyung Song

该论文提出了一种名为 SparSEEty 的新型令牌提取攻击,针对利用激活稀疏性优化推理性能的大语言模型(LLM)服务系统。现代 LLM 在推理时仅激活部分神经元,这一特性被许多服务系统用于跳过非激活神经元的权重访问和计算,从而提升效率。然而,这种优化导致权重访问模式依赖于输入令牌,进而可能通过侧信道泄露敏感信息。SparSEEty 利用这一漏洞,构建了一个端到端的令牌提取攻击框架。其核心方法分为三步:首先,通过神经元权重访问侧信道构造神经元激活预言机(neuron-activation oracle);其次,在推理过程中高效地监控神经元激活状态,以降低被检测的风险;最后,将部分二进制的激活轨迹逆向映射为原始输入令牌。作者在 Intel TDX 机密虚拟机(CVM)保护的 LLM 服务系统中实例化了该攻击,并解决了三个关键挑战:利用 CVM 暴露的侧信道组合构建激活预言机、减少推理时监控开销以增强隐蔽性、以及准确地将不完整的激活轨迹反转为令牌。实验表明,SparSEEty 能在多种模型和数据集上以高 BLEU 分数(>0.95)重建提示词和响应令牌,同时仅引入 3.7% 至 7.2% 的监控开销。该研究揭示了稀疏性优化与机密计算结合时的新安全风险,强调 LLM 服务系统即使运行在可信执行环境中,仍可能面临侧信道泄露。

💡 推荐理由: 该攻击首次证明,即使 LLM 服务部署在 Intel TDX 等机密虚拟机内,利用稀疏性优化仍可通过神经元激活侧信道完整重建输入输出令牌,打破了机密计算提供安全边界的假设。对使用稀疏性加速的 LLM 服务商和依赖 TEE 保护数据的企业具有重要警示意义。

🎯 建议动作: 研究跟进:深入了解攻击细节,评估自身 LLM 服务是否采用稀疏性优化及 TEE 防护,并开展内部威胁建模与漏洞验证

排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Syamantak Kumar, Shourya Pandey, Purnamrita Sarkar, Kevin Tian

本文研究高维差分隐私(DP)下的协方差矩阵估计和主成分分析(PCA)问题,重点关注协方差矩阵的k-行-列稀疏性(k-RCS)假设。在非私有设置中,已知仅需poly(k, log d)个样本即可解决这两个问题。然而,在DP设置下,现有的最好结果(Wang等人,2021)在标准参数化下需要Ω(d)个样本,这产生了维度灾难。本文探究了DP下稀疏协方差估计中这种维度灾难的内在性。在上界方面,作者证明:若额外假设前导特征向量是稀疏的,则PCA可以在poly(k, log d)个样本下实现DP。在下界方面,作者为DP下的稀疏协方差估计和PCA分别建立了poly(d)的下界,从而揭示了当k = polylog(d)时,这两个问题的私有与非私有版本之间存在指数级差距——这是首个在私有高维统计中展示此类分离的结果。此外,该技术足够灵活,能够推导出标准DP PCA(无稀疏假设)的更强下界。本文的理论贡献为理解DP在稀疏高维问题中的样本复杂度提供了重要见解。

💡 推荐理由: 本文首次揭示了差分隐私下稀疏协方差估计和PCA中存在指数级样本复杂度差距,对设计高效DP高维算法具有重要指导意义。

🎯 建议动作: 研究跟进

排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Jianwen Tian, Wei Kong, Debin Gao, Tong Wang, Taotao Gu, Kefan Qiu, Zhi Wang 0014, Xiaohui Kuang

本文针对AI驱动的恶意软件检测器面临的多种挑战(包括投毒攻击、逃避攻击和概念漂移)提出了一种统一的解决方案。作者指出这些挑战的一个根本原因是数据稀疏性,即某些特征值在数据集中出现的频率极低。为解决稀疏性问题,论文设计了新的压缩技术来缓解稀疏性,并提出了一种密度提升训练方法来持续填充稀疏区域。该方法被应用于PE、Android和PDF恶意软件数据集(如EMBER、SOREL-20M、DREBIN和Contagio)进行实验。结果表明,该方法不仅增强了模型对抗各种攻击的鲁棒性,还提升了检测性能和时间可持续性。例如,在EMBER数据集上,后门攻击成功率从99.99%降至23.71%,F1分数从99.301%升至99.488%;在SOREL-20M数据集上,可持续性指标AUT从92.850%提升至95.135%。该方法与现有防御技术互补,并在多个数据集上验证了其一致性。

💡 推荐理由: 本文提供了一种同时提升恶意软件检测器性能、鲁棒性和可持续性的统一策略,解决了当前防御方案孤立处理问题的局限,对提升实际安全系统的防御能力有重要参考价值。

🎯 建议动作: 研究跟进

排序因子: 来自网络安全顶级会议 (+8) | Community 数据源 (+1) | LLM 评分加成 (+0.5)