arrow
返回

Multi-view self-supervised learning for label-flipping robustness in tabular data: a comparative study

delete2026-10-01
delete0
delete
OA
AI
J
Jinhyeok Jang *
S
Sohee Park
S
Seung-Soo Nam
D
Daeseon Choi *
DOI:10.1007/s10489-026-07452-2delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
表格机器学习模型广泛应用于金融、医疗和网络入侵检测等高风险领域,其可靠性高度依赖于准确的训练标签。然而,恶意或意外的标签翻转会破坏训练数据并降低下游模型性能。近期攻击进一步针对决策边界或脆弱局部区域,而非随机翻转标签。本文提出了一种基于BYOL的多视图KNN净化方法,用于识别表格数据中可疑的标签翻转样本。该方法学习标签无关的表示,并检查原始和扰动SSL嵌入视图中的KNN标签分歧模式。我们在六个跨领域表格基准上评估了该方法,在大型和小型标签翻转攻击下,并与现有的净化基线和基于SCARF的表示基线进行了比较。结果表明,多视图邻域探测提高了可疑标签检测效果,并提供了一种实用的F1导向权衡,而下游恢复仍取决于攻击和目标模型。这些发现为提高表格机器学习系统在标签翻转攻击下的鲁棒性和标签完整性提供了可操作的见解。
Keyword:
Label flipping attack
Data poisoning
Self-supervised learning
Data sanitization
Tabular learning

期刊

Applied Intelligence 封面图
Applied Intelligence
IF:
3.5
论文数:
7.6K
被引数:
1.7W

机构

A
ai safety center
学者数:
4
论文数: 1
被引数: 0
引用论文

引用论文

Defending Support Vector Machines Against Data Poisoning Attacks
err2021-01-01
err26
PREAI
errWeerasinghe, Sandamal; Alpcan, Tansu; Erfani, Sarah M.; Leckie, Christopher
err分享
err收藏
Support vector machines under adversarial label contamination
err2015-07-01
err170
errOAAI
errXiao, Huang; Biggio, Battista; Nelson, Blaine; Xiao, Han; Eckert, Claudia; Roli, Fabio
err分享
err收藏
err分享
err收藏
err分享
err收藏
没有更多内容