arrow
返回

Toward Generalizable Forgery Detection and Reasoning

delete2026-03-26
delete0
PRE
AI
Y
Yueying Gao
D
Dongliang Chang
B
Bingyao Yu
H
Haotian Qin
M
Muxi Diao
陈磊 (Lei Chen)
K
Kongming Liang
马占宇 (Zhanyu Ma)
DOI:10.1109/TIP.2026.3673967delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
准确且可解释的AI生成图像检测对于缓解与AI滥用相关的风险至关重要。然而,生成模型之间的显著领域差异使得开发通用的伪造检测模型具有挑战性。此外,由于AI生成图像中的每个像素都是合成的,传统的基于显著性的伪造解释方法并不适用于此任务。为解决这些挑战,我们将检测和解释表述为一个统一的“伪造检测与推理任务”(FDR-Task),利用多模态大语言模型(MLLMs)通过在伪造属性上的可靠推理实现准确检测。为促进此任务,我们引入了“多模态伪造推理数据集”(MMFR-Dataset),这是一个包含10种生成模型、12万张图像的大型数据集,并附有37.8万条关于伪造属性的推理标注,以支持FDR-Task的全面评估。此外,我们提出了FakeReasoning框架,该伪造检测与推理框架包含三个关键组件:1)一个集成CLIP和DINO的双分支视觉编码器,用于捕捉高阶语义和低阶伪影;2)一个“伪造感知特征融合模块”,利用DINO的注意力图和交叉注意力机制引导MLLMs关注与伪造相关的线索;3)一个“分类概率映射器”,耦合语言建模与伪造检测,以提升整体性能。跨多个生成模型的实验表明,FakeReasoning不仅实现了稳健的泛化能力,还在检测和推理任务上均超越了当前最优方法。代码可在以下地址获取:https://github.com/PRIS-CV/FakeReasoning
Keyword:
Forgery detection
multi-modal large language model
visual reasoning
attention mechanism

期刊

IEEE Transactions on Image Processing 封面图
IEEE Transactions on Image Processing
IF:
13.7
论文数:
1.0W
被引数:
8.4W

机构

B
beijing university of posts and telecommunications
学者数:
2.3K
论文数: 858
被引数: 0
T
tsinghua university
学者数:
11.9W
论文数: 10.0W
被引数: 137
引用论文

引用论文

Emerging Properties in Self-Supervised Vision Transformers自监督视觉变换器中的新兴特性
err2021-10-01
err0
errOAAI
errMathilde Caron; Hugo Touvron; Ishan Misra; Herve Jegou; Julien Mairal; Piotr Bojanowski; Armand Joulin
err分享
err收藏
err分享
err收藏
ImageNet Large Scale Visual Recognition ChallengeImageNet大规模视觉识别挑战
err2015-04-11
err2.7W
PREAI
errRussakovsky, Olga; Deng, Jia; Su, Hao; Krause, Jonathan; Satheesh, Sanjeev; Ma, Sean; Huang, Zhiheng; Karpathy, Andrej; Khosla, Aditya; Bernstein, Michael; Berg, Alexander C.; Fei-Fei, Li
err分享
err收藏
学者 查看更多内容