该论文提出了一种名为CORELOCKER的神经元级使用控制方法,用于保护深度学习模型的知识产权。核心思想是从训练好的神经网络中提取一小部分显著权重作为“访问密钥”,拥有密钥的用户可以获得模型的全部能力,而未授权用户只能获得部分能力。该方法通过形式化分析给出了保护前后网络效用差异的理论上下界,并基于Fashion-MNIST、CIFAR-10和CIFAR-100数据集以及VGGNet、ResNet和DenseNet等真实模型进行了实验验证。实验结果表明CORELOCKER能有效控制模型使用权限,并对基于微调和剪枝的高级模型恢复攻击具有鲁棒性。该工作为模型所有者提供了一种细粒度的访问控制机制,有助于防止模型被滥用或盗用。
💡 推荐理由: 随着深度学习模型商业价值提升,模型使用权保护成为关键。CORELOCKER提供了一种新颖的、基于权重子集的细粒度访问控制方法,有助于维护模型开发者的知识产权。
🎯 建议动作: 研究跟进