arrow
返回

Generating transferable attacks across large vision-language models using adversarial deformation learning

delete2026-01-29
delete0
PRE
AI
D
Daizong Liu
W
Wangqin Liu
X
Xiaowen Cai
P
Pan Zhou
R
Runwei Guan
X
Xiaoye Qu
B
Bo Du
DOI:10.1016/j.patcog.2026.113194delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
• This paper develops a novel cross-model attack method against LVLMs via adversarial deformation learning. • Novel cross-modal consistent perturbations are developed through adversarial learning to improve the transferability. • Prompt purification and adversarial transformation networks are introduced to simulate potential deformations within unseen LVLMs. • Extensive experiments are conducted on various LVLM models and datasets to illustrate both the effectiveness and transferability of our method.

期刊

Pattern Recognition 封面图
Pattern Recognition
IF:
7.6
论文数:
1.3W
被引数:
4.5W

机构

H
hong kong university of science and technology
学者数:
925
论文数: 517
被引数: 1
H
Huazhong University of Science and Technology
学者数:
4.5K
论文数: 1.4K
被引数: 65
J
jiangnan university
学者数:
8.8K
论文数: 2.4K
被引数: 0
H
huazhong university of science and technology
学者数:
2.7W
论文数: 8.1K
被引数: 5
W
wuhan university
学者数:
8.1W
论文数: 5.8W
被引数: 70
学者 查看更多机构
引用论文

引用论文

err
IF0
err
err0
PREAI
err
err分享
err收藏
A focal quotient gradient system method for deep neural network training一种用于深度神经网络训练的聚焦商梯度系统方法
err2025-08-06
err0
PREAI
errCaili Lv; Xian-long Lv; Zhiyuan Wang; Tianqi Zhao; Wei Tian; Qingqing Zhou; Lin Zeng; Min Wan; Chenghu Liu
err分享
err收藏
LVLM-EHub: A Comprehensive Evaluation Benchmark for Large Vision-Language Models
err
IF0
err2025-03-01
err0
PREAI
errPeng Xu; Wenqi Shao; Kaipeng Zhang; Peng Gao; Shuo Liu; Meng Lei; Fanqing Meng; Siyuan Huang; Yu Qiao; Ping Luo
err分享
err收藏
Adversarial Spatio-Temporal Learning for Video Deblurring用于视频去模糊的对抗性时空学习
err2019-01-01
err128
errOAAI
errZhang, Kaihao; Luo, Wenhan; Zhong, Yiran; Ma, Lin; Liu, Wei; Li, Hongdong
err分享
err收藏
Motion and Appearance Decoupling Representation for Event Cameras运动与外观解耦表示方法研究:面向事件相机
err2025-01-01
err0
errOAAI
errNuo Chen; Boyang Li; Yingqian Wang; Xinyi Ying; Longguang Wang; Chushu Zhang; Yulan Guo; Miao Li; Wei An
err分享
err收藏
A survey on multimodal large language models多模态大语言模型研究综述
err2024-11-12
err0
errOAAI
errYin, Shukang; Fu, Chaoyou; Zhao, Sirui; Li, Ke; Sun, Xing; Xu, Tong; Chen, Enhong
err分享
err收藏
学者 查看更多内容