返回
Multi-Level Collaborative Optimization for Multi-Modal Media Manipulation Detection and Grounding
DOI:10.1016/j.inffus.2026.104773.png)
摘要
En 中文
• 提出了一种新的任务协作视角用于多模态媒体取证。
• 三级协作路径连接特征、语义和决策。
• 共享语义加权指导检测和定位到一致证据。
• 决策感知的精炼抑制了嘈杂的视觉定位响应。
Keyword:
Multi-modal learning
Media manipulation
Deepfake detection
Task collaboration
Semantic consistency

