arrow
返回

Variance-Based Defense Against Blended Backdoor Attacks

delete2026-01-01
delete0
PRE
AI
S
Sujeevan Aseervatham *
A
Achraf Kerzazi
Y
Younès Bennani
DOI:10.1007/978-3-032-06096-9_13delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
后门攻击代表了一种针对AI模型的隐蔽且有效的网络攻击类别,主要因其隐蔽性。模型在干净数据上表现正常,但仅在攻击者将特定触发器嵌入输入时才表现出恶意行为。这种攻击在训练阶段执行,攻击者通过嵌入模式并修改标签至选定目标来污染训练数据的一个小子集。目标是使模型将模式与目标标签关联,同时保持未修改数据上的正常性能。已提出多种防御机制来净化训练数据集。然而,这些方法通常依赖干净数据集来检测统计异常,这在现实场景中可能不可行,因为数据集可能缺失或被篡改。为解决此限制,我们提出一种新颖的防御方法:在给定数据集上训练模型,检测被污染的类别,并在识别被污染实例之前提取攻击触发器的关键部分。该方法通过明确揭示触发器的有害部分增强了可解释性。我们的方法的有效性通过在知名图像数据集上的实验评估以及与三种最新算法(SCAn、ABL和AGPD)的比较分析得到验证。
Keyword:
Machine Learning
Data Poisoning
Backdoor Mitigation

期刊

M
MACHINE LEARNING AND KNOWLEDGE DISCOVERY IN DATABASES. RESEARCH TRACK, ECML PKDD 2025, PT V
IF:
0
论文数:
26
被引数:
0

机构

C
centre national de la recherche scientifique (cnrs)
学者数:
24.5W
论文数: 18.2W
被引数: 279
引用论文

引用论文

STRIP
err2019-12-09
err0
PREAI
errYansong Gao; Change Xu; Derui Wang; Shiping Chen; Damith C. Ranasinghe; Surya Nepal
err分享
err收藏
A taxonomy and survey of attacks against machine learning
err2019-11-01
err167
errOAAI
errPitropakis, Nikolaos; Panaousis, Emmanouil; Giannetsos, Thanassis; Anastasiadis, Eleftherios; Loukas, George
err分享
err收藏
err分享
err收藏
err分享
err收藏
Grad-CAM: Visual Explanations from Deep Networks via Gradient-Based LocalizationGrad-cam: 通过基于梯度的定位从深度网络进行视觉解释
err2019-10-11
err8.0K
errOAAI
errSelvaraju, Ramprasaath R.; Cogswell, Michael; Das, Abhishek; Vedantam, Ramakrishna; Parikh, Devi; Batra, Dhruv
err分享
err收藏
Identity Mappings in Deep Residual Networks
err2016-09-17
err0
PREAI
errKaiming He; Xiangyu Zhang; Shaoqing Ren; Jian Sun
err分享
err收藏
没有更多内容