Leveraging Imperfect Restoration for Data Availability Attack
针对在线数据被用于训练深度学习模型的风险,本文提出一种名为不完美恢复投毒(IRP)的新型方法。现有基于卷积的不可学习数据集(CUDA)虽在监督学习和自监督学习中表现稳健,但对抗自监督学习时效果不佳且存在图像质量与投毒效果的严重权衡。本研究通过理论分析揭示了 CUDA 引入次优梯度及诱导类别偏差的策略,并据此提出 IRP 以在保持高图像质量的同时实现强投毒效果。实验对比了 IRP 与八个基线方法在监督学习和自监督学习中的表现,并结合五种代表性防御方法进行验证,展示了 IRP 的优越性。