Paper: 2604.19724 Authors: Jiaming Zhang, Meng Ding, Shaopeng Fu, Jingfeng Zhang, Di Wang Categories: cs.LG, cs.CV, cs.AI
Problem
Despite Vision Transformers’ success, they remain vulnerable to adversarial examples like CNNs. Theoretical underpinnings of adversarial training’s robustness in ViTs remain largely unexplored.
Key Contribution
First theoretical analysis of adversarial training under simplified ViT architectures, showing that:
- When trained under a signal-to-noise ratio satisfying certain conditions
- Within a moderate perturbation budget
- ViTs can achieve nearly zero robust training loss and robust generalization error under certain regimes
Key Result: Benign Overfitting in ViTs
This leads to strong generalization even in the presence of overfitting - a phenomenon known as benign overfitting, previously only observed in CNNs with adversarial training.
Conditions for Benign Overfitting
- Signal-to-noise ratio condition: Specific threshold for stability
- Perturbation budget: Moderate epsilon within which theory holds
- Architecture constraints: Simplified ViT structure assumptions
Experiments
Experiments on both synthetic and real-world datasets validate theoretical findings.
Takeaways
- ViTs share the benign overfitting property with CNNs under adversarial training
- Theoretical understanding enables principled design of adversarial training for ViTs
- Overfitting ≠ poor generalization in adversarial settings
论文: 2604.19724 作者: 张家铭、丁孟、傅少鹏、张景凤、王迪 分类: cs.LG, cs.CV, cs.AI
问题
尽管视觉Transformer取得成功,但它们仍然像CNN一样容易受到对抗样本攻击。对ViT对抗训练鲁棒性的理论理解仍然很不充分。
关键贡献
首次在简化的ViT架构下对对抗训练进行理论分析,表明:
- 当在满足特定条件的信噪比下训练时
- 在适度的扰动预算内
- ViT可以在某些条件下实现近乎零的鲁棒训练损失和鲁棒泛化误差
关键结果:ViT中的良性过拟合
这导致即使存在过拟合也能实现强泛化——这是一种称为良性过拟合的现象,此前仅在CNN的对抗训练中观察到。
良性过拟合的条件
- 信噪比条件:稳定性的特定阈值
- 扰动预算:理论成立范围内的适度epsilon
- 架构约束:简化的ViT结构假设
实验
在合成和真实数据集上的实验验证了理论发现。
要点总结
- ViT与CNN在对抗训练下共享良性过拟合特性
- 理论理解为ViT对抗训练的原则性设计提供依据
- 在对抗设置中,过拟合≠泛化差