arrow
返回

DiffuVolume: Diffusion Model for Volume based Stereo Matching

delete2025-02-01
delete0
PRE
AI
D
Dian Zheng
X
Xiao-Ming Wu
Z
Zuhao Liu
J
Jingke Meng
W
Wei‐Shi Zheng *
DOI:10.1007/s11263-025-02362-1delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
立体匹配是许多计算机视觉任务和基于驾驶的应用中的重要组成部分。最近,基于代价体积的方法得益于配对图像中丰富的几何信息,取得了巨大成功。然而,代价体积的冗余性也会干扰模型训练并限制性能。为了构建更精确的代价体积,我们开创性地将扩散模型应用于立体匹配。我们的方法,称为DiffuVolume,将扩散模型视为代价体积滤波器,能够递归地从代价体积中去除冗余信息。两个主要设计使我们的方法非平凡。首先,为了使扩散模型更适应立体匹配,我们摒弃了直接向图像添加噪声的传统方式,而是将扩散模型嵌入到任务特定的模块中。通过这种方式,我们在端点误差(EPE)改进方面优于传统的扩散立体匹配方法27%,并将参数减少了7倍。其次,DiffuVolume可以轻松嵌入到任何基于体积的立体匹配网络中,仅需轻微增加参数(约2%)即可提升性能。通过将DiffuVolume添加到表现优异的方法中,我们在Scene Flow、KITTI2012、KITTI2015基准测试和零样本泛化设置中超越了所有已发表的方法。值得一提的是,所提出的模型自2023年7月15日起,在KITTI 2012排行榜上排名第一,在KITTI 2015排行榜上排名第二。
Keyword:
Stereo matching
Cost volume
Information filtering
Task-specific diffusion process

期刊

International Journal of Computer Vision 封面图
International Journal of Computer Vision
IF:
9.3
论文数:
3.9K
被引数:
2.8W

机构

M
Minist Educ
学者数:
1.4K
论文数: 566
被引数: 122
S
sun yat sen university
学者数:
1.2W
论文数: 3.9K
被引数: 1.2K
引用论文

引用论文

err分享
err收藏
A Multi-view Stereo Benchmark with High-Resolution Images and Multi-camera Videos
err2017-07-01
err0
PREAI
errThomas Schops; Johannes L. Schonberger; Silvano Galliani; Torsten Sattler; Konrad Schindler; Marc Pollefeys; Andreas Geiger
err分享
err收藏
Adaptive Unimodal Cost Volume Filtering for Deep Stereo Matching
err2020-04-03
err0
errOAAI
errYoumin Zhang; Yimin Chen; Xiao Bai; Suihanjin Yu; Kun Yu; Zhiwei Li; Kuiyuan Yang
err分享
err收藏
Group-Wise Correlation Stereo Network
err2019-06-01
err0
errOAAI
errXiaoyang Guo; Kai Yang; Wukui Yang; Xiaogang Wang; Hongsheng Li
err分享
err收藏
学者 查看更多内容