arrow
返回

Boosting Adversarial Training With Mitigating Hard Sample Interference

delete2026-01-06
delete0
PRE
AI
B
Bin Hu
K
Kehua Guo
T
Tian Qiu
S
Shaojun Guo
DOI:10.1109/tnnls.2025.3648421delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
对抗训练(AT)在保持准确性和增强对抗样本的鲁棒性方面显示出显著优势。然而,大多数现有的AT技术将干净样本准确率和对抗样本鲁棒性作为双重目标联合优化。这种设置引入了一个常被忽视的问题:在优化决策边界附近的困难样本时,模型可能会以牺牲准确率为代价来增强鲁棒性,或为了保持准确率而损害鲁棒性。为缓解困难样本引起的准确率-鲁棒性牺牲,我们从样本干预的角度提出了缓解困难样本干扰(MHSI)方法。MHSI旨在减少AT过程中困难样本引起的不稳定性。具体而言,我们引入一种加权自适应(WA)机制,强化模型对干净样本的学习,从而减少困难样本对准确率的负面影响。此外,基于梯度范数和Hessian矩阵的分析,我们设计了动态校准(DC)策略,动态校准困难样本的概率输出,以减轻其对鲁棒性的损害。通过这两个模块,我们的方法在不牺牲准确率的情况下显著提高了鲁棒性。在CIFAR-10、CIFAR-100、Tiny ImageNet和SVHN上的大量实验表明,MHSI有效提升了准确率和鲁棒性,并在玻璃盒攻击下优于现有最优方法。值得注意的是,在$l_{\infty}$攻击下,MHSI相较于AT基准方法获得了高达6.22%的鲁棒性提升。我们的代码可在https://github.com/hubin111/MHSI获取。
Keyword:
Accuracy
adversarial training (AT)
robustness

期刊

IEEE Transactions on Neural Networks and Learning Systems 封面图
IEEE Transactions on Neural Networks and Learning Systems
IF:
8.9
论文数:
7.5K
被引数:
7.2W

机构

C
central south university
学者数:
2.2W
论文数: 6.3K
被引数: 3
C
changsha university of science and technology
学者数:
3.2K
论文数: 1.2K
被引数: 0
A
Academy of Military Sciences PLA China
学者数:
11
论文数: 5
被引数: 0
学者 查看更多机构
引用论文

引用论文

err
IF0
err
err0
errOAAI
err
err分享
err收藏
Multi-Source Adversarial Sample Attack on Autonomous Vehicles
err2021-03-01
err50
PREAI
errXiong, Zuobin; Xu, Honghui; Li, Wei; Cai, Zhipeng
err分享
err收藏
Boosting Adversarial Attacks with Momentum用动量增强对抗性攻击
err2018-06-01
err0
errOAAI
errYinpeng Dong; Fangzhou Liao; Tianyu Pang; Hang Su; Jun Zhu; Xiaolin Hu; Jianguo Li
err分享
err收藏
err分享
err收藏
学者 查看更多内容