本文针对深度学习编译器生成的DNN可执行文件缺乏安全保护的问题,提出了OBSan,一种用于检测DNN可执行文件中越界(Out-of-Bound, OOB)行为的快速消毒器。DNN涉及双向计算:前向传播(预测输出)和后向传播(梯度计算)。神经元激活值和梯度都应落在有效范围内,偏离则视为OOB。OOB主要由异常输入引发,可能导致误预测甚至被对抗样本利用。OBSan包含两个变体:FOBSAN检测前向传播中的OOB,BOBSAN检测后向传播中的OOB。两者作为DL编译器的额外pass集成到大规模DNN模型中,并设计了多种优化方案降低开销。在多种异常输入下的评估表明,OBSan具有良好的OOB检测能力且开销低。此外,论文展示了两个下游应用:阻止在线对抗样本生成和促进面向DNN可执行文件的反馈驱动模糊测试。该研究适合编译器开发、DNN安全研究人员及AI系统防御者阅读。
💡 推荐理由: 首次针对DL编译器生成的DNN可执行文件提出安全消毒方案,填补了该领域空白,可有效检测由异常输入引发的越界行为,提升DNN模型的鲁棒性和安全性。
🎯 建议动作: 研究跟进