arrow
返回

Text-Vision Embedding for Generalized Diffusion Generated Videos Detection

delete2026-01-01
delete0
PRE
AI
J
Jinchuan Li
J
Jinlin Guo
Y
Yun Cao *
Z
Zeyu Zhang
K
Kangwei Liu
DOI:10.1007/978-981-95-5634-2_9delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
扩散模型的快速发展和应用导致了扩散生成视频内容的激增,增加了虚假信息传播的风险。因此,开发一个通用且鲁棒的扩散生成视频检测器势在必行。然而,现有的检测方法缺乏通用和鲁棒的表征,无法泛化到由多种扩散模型创建的视频上。本文指出,基于文本-视觉对比学习的成功,文本-视觉嵌入为扩散生成视频检测提供了通用且鲁棒的表征。文本-视觉对比预训练模型的视觉嵌入固有地区分了真实视频和扩散生成视频。基于这一见解,我们提出了一种通用检测框架,利用视觉内容与文本语义之间的对比嵌入来捕获生成痕迹。在多个视频生成模型上的全面评估表明,我们的检测器具有卓越的通用能力。在未见过的扩散视频模型上,其平均准确率达到0.9229。代码可在https://github.com/1129ljc.T2VE获取。
Keyword:
Text-Vision Embedding
Diffusion Generated Videos Detection

期刊

P
PATTERN RECOGNITION AND COMPUTER VISION, PRCV 2025, PT XIII
IF:
0
论文数:
28
被引数:
0

机构

U
university of chinese academy of sciences, cas
学者数:
4.1W
论文数: 3.8W
被引数: 75
C
chinese academy of sciences
学者数:
56.7W
论文数: 44.9W
被引数: 704
引用论文

引用论文

Contrastive language and vision learning of general fashion concepts
err2022-11-08
err9
errOAAI
errChia, Patrick John; Attanasio, Giuseppe; Bianchi, Federico; Terragni, Silvia; Magalhaes, Ana Rita; Goncalves, Diogo; Greco, Ciro; Tagliabue, Jacopo
err分享
err收藏
VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
err2024-06-16
err0
PREAI
errHaoxin Chen; Yong Zhang; Xiaodong Cun; Menghan Xia; Xintao Wang; Chao Weng; Ying Shan
err分享
err收藏
LaVie: High-Quality Video Generation with Cascaded Latent Diffusion ModelsLaVie: 具有级联潜在扩散模型的高质量视频生成
err2024-12-23
err0
PREAI
errWang, Yaohui; Chen, Xinyuan; Ma, Xin; Zhou, Shangchen; Huang, Ziqi; Wang, Yi; Yang, Ceyuan; He, Yinan; Yu, Jiashuo; Yang, Peiqing; Guo, Yuwei; Wu, Tianxing; Si, Chenyang; Jiang, Yuming; Chen, Cunjian; Loy, Chen Change; Dai, Bo; Lin, Dahua; Qiao, Yu; Liu, Ziwei
err分享
err收藏
DynamiCrafter: Animating Open-Domain Images with Video Diffusion Priors
err2024-10-01
err0
PREAI
errJinbo Xing; Menghan Xia; Yong Zhang; Haoxin Chen; Wangbo Yu; Hanyuan Liu; Gongye Liu; Xintao Wang; Ying Shan; Tien-Tsin Wong
err分享
err收藏
Structure and Content-Guided Video Synthesis with Diffusion Models
err2023-10-01
err0
errOAAI
errPatrick Esser; Johnathan Chiu; Parmida Atighehchian; Jonathan Granskog; Anastasis Germanidis
err分享
err收藏
Show-1: Marrying Pixel and Latent Diffusion Models for Text-to-Video GenerationShow-1: 结合像素和潜在扩散模型以生成文本到视频
err2024-10-24
err0
PREAI
errZhang, David Junhao; Wu, Jay Zhangjie; Liu, Jia-Wei; Zhao, Rui; Ran, Lingmin; Gu, Yuchao; Gao, Difei; Shou, Mike Zheng
err分享
err收藏
学者 查看更多内容