arrow
Return

Multi-Level Collaborative Optimization for Multi-Modal Media Manipulation Detection and Grounding

delete2026-09-12
delete0
PRE
AI
W
Wenwen Su
郭治卿 cover
郭治卿 (Zhiqing Guo) *
L
Liejun Wang
G
Gaobo Yang
DOI:10.1016/j.inffus.2026.104773delete
deleteOriginal
deleteOriginal request for help
deleteShare
deleteSave
Abstract

Abstract

En 中文
• A new task-collaboration view is proposed for multimodal media forensics. • A three-level collaboration path links features, semantics, and decisions. • Shared semantic weighting guides detection and grounding to consistent evidence. • Decision-aware refinement suppresses noisy visual grounding responses.
Keywords:
Multi-modal learning
Media manipulation
Deepfake detection
Task collaboration
Semantic consistency

Journal

Information Fusion cover
Information Fusion
IF:
15.5
Papers:
4.2K
Citations:
2.7W

Organization

H
hunan university
Scholars:
4.5W
Papers: 3.3W
Citations: 70
X
xinjiang university
Scholars:
4.2K
Papers: 1.2K
Citations: 0
Cited Papers

Cited Papers

No cited papers available