返回
Generating Video with Conditional Control Diffusion Model
DOI:10.1007/978-981-95-4821-7_7.png)
摘要
En 中文
我们提出了一种条件控制扩散模型(CCDM),这是一种通过使用条件控制将文本到图像(T2I)模型转换为视频模型的神经网络,同时保持原始模型图像质量。CCDM首先在真实视频数据上进行训练,创建一个复合模型以融合多个帧并学习动作先验。然后,CCDM采用Stable Diffusion架构,并整合T2I模型,确保在视频生成过程中不改变T2I模型。最后,CCDM将生成的帧反馈给模型作为反馈,减少因内容变化引起的闪烁。我们在CivitAI上的不同风格和特征的T2I模型上测试了CCDM。使用T2I模型网站的提示,我们生成视频并表明CCDM可以生成动态信息,并处理需要8GB VRAM的生成任务。CCDM在视频生成应用方面具有优异的潜力。
Keyword:
Diffusion Model
Video Generation
Conditional Control
Computer Vision
Text-to-Image
期刊
A
IF:
0
论文数:
26
被引数:
0

