arrow
返回

Deception Detection Meets Vision-Language Models

delete2026-07-14
delete0
PRE
AI
D
Dongliang Zhu
胡瑞敏 封面图
胡瑞敏 (Ruimin Hu) *
M
Mei Wang
X
Xiang Guo
L
Liang Liao
M
Mang Ye
DOI:10.1007/s11263-026-02932-xdelete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
预训练的视觉-语言模型如CLIP最近在各种下游任务中表现出卓越性能,包括图像分类和视频理解。然而,在自动化欺骗检测(ADD)等高级视觉任务中,标签与视觉内容之间的语义关联较弱且缺乏明确的文本描述。因此,此类模型在自动化欺骗检测中的应用仍不确定。为解决此问题,本文将预训练的CLIP模型应用于自动化欺骗检测,并提出一种新的ADD-CLIP模型。受心理学发现启发,我们将欺骗行为领域的知识注入CLIP模型。具体而言,ADD-CLIP由视觉部分和文本部分组成。在视觉部分,我们在CLIP的图像编码器中引入两种提示学习策略:时序和微观差异提示学习。这些策略通过可学习的网络层实现,以捕捉面部的时间动态和细微运动特征。在文本部分,我们未使用传统类别标签作为文本模态输入,而是在大型语言模型(如ChatGPT)的帮助下,从面部和面部动作单元(AU)视角构建面部行为差异文本描述作为文本监督。此外,我们在面部级和AU级分别添加对应行为描述的可学习双提示。此设计使模型能够自动学习互补的语义空间,从而形成更准确的决策边界。大量实验结果表明,ADD-CLIP在DOLOS、Bag-of-Lies和MU3D数据集上表现出优异性能,验证了其有效性。代码公开可访问于https://github.com/zdl12345678/Deception-Detection-Meets-Vision-Language-Models 。
Keyword:
Automated Deception Detection
Deep Learning
Visual Language Model

期刊

International Journal of Computer Vision 封面图
International Journal of Computer Vision
IF:
9.3
论文数:
3.9K
被引数:
2.8W

机构

H
Hangzhou Institute of Technology
学者数:
41
论文数: 25
被引数: 0
S
school of computer science
学者数:
462
论文数: 187
被引数: 0
引用论文

引用论文

Temporal Segment Networks: Towards Good Practices for Deep Action Recognition
err2016-09-17
err0
PREAI
errLimin Wang; Yuanjun Xiong; Zhe Wang; Yu Qiao; Dahua Lin; Xiaoou Tang; Luc Van Gool
err分享
err收藏
err分享
err收藏
Only Time Can Tell: Discovering Temporal Data for Temporal Modeling
err2021-01-01
err0
errOAAI
errLaura Sevilla-Lara; Shengxin Zha; Zhicheng Yan; Vedanuj Goswami; Matt Feiszli; Lorenzo Torresani
err分享
err收藏
Multimodal Deception Detection Using Real-Life Trial Data
err2022-01-01
err22
PREAI
errSen, M. Umut; Perez-Rosas, Veronica; Yanikoglu, Berrin; Abouelenien, Mohamed; Burzo, Mihai; Mihalcea, Rada
err分享
err收藏
err分享
err收藏
Multimodal Deception Detection: A Survey多模态欺骗检测:综述
err2026-04-01
err0
PREAI
errZhang,Jiayu; Lin,Xun; Huang,Jiajian; Ye,Shuo; Guo,Xiaobao; Zhu,Dongliang; Hu,Ruimin; Guo,Dan; Liang,Yanyan; Yu,Zitong; Cao,Xiaochun
err分享
err收藏
Accuracy of deception judgments
err2006-08-01
err1.3K
PREAI
errBond, Charles F., Jr.; DePaulo, Bella M.
err分享
err收藏
The MUMIN coding scheme for the annotation of feedback, turn management and sequencing phenomena
err2008-01-16
err0
PREAI
errJens Allwood; Loredana Cerrato; Kristiina Jokinen; Costanza Navarretta; Patrizia Paggio
err分享
err收藏
学者 查看更多内容