arrow
返回

Investigating Self-Supervised Methods for Label-Efficient Learning

delete2025-03-10
delete0
delete
OA
AI
S
Srinivasa Rao Nandam *
Z
Zhenhua Feng
J
Josef Kittler
M
Muhammed Awais
DOI:10.1007/s11263-025-02397-4delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
视觉变压器与自监督学习相结合,已使模型能够在大型数据集上扩展至多个下游任务,包括分类、分割和检测。然而,这些模型在多个下游任务中的低样本学习潜力仍 largely 未被探索。在本工作中,我们系统地考察了不同的自监督预文本任务,即对比学习、聚类和掩码图像建模,通过比较不同的预训练模型来评估其低样本能力。此外,我们探讨了各种崩溃避免技术,如中心化、ME-MAX 和 Sinkhorn,对下游任务的影响。基于我们的详细分析,我们提出了一种框架,将掩码图像建模和聚类作为预文本任务。该框架在所有考察的低样本下游任务中表现出更优性能,包括多类分类、多标签分类和语义分割。此外,在大型数据集上测试模型时,我们展示了各种任务上的性能提升。
Keyword:
Vision transformers
Self-supervised learning
Low-shot learning
Masked image modelling

期刊

International Journal of Computer Vision 封面图
International Journal of Computer Vision
IF:
9.3
论文数:
3.9K
被引数:
2.8W

机构

U
Univ Surrey
学者数:
405
论文数: 295
被引数: 111
引用论文

引用论文

Emerging Properties in Self-Supervised Vision Transformers自监督视觉变换器中的新兴特性
err2021-10-01
err0
errOAAI
errMathilde Caron; Hugo Touvron; Ishan Misra; Herve Jegou; Julien Mairal; Piotr Bojanowski; Armand Joulin
err分享
err收藏
Visual Genome: Connecting Language and Vision Using Crowdsourced Dense Image Annotations视觉基因组: 使用众包密集图像注释连接语言和视觉
err2017-02-06
err3.1K
errOAAI
errKrishna, Ranjay; Zhu, Yuke; Groth, Oliver; Johnson, Justin; Hata, Kenji; Kravitz, Joshua; Chen, Stephanie; Kalantidis, Yannis; Li, Li-Jia; Shamma, David A.; Bernstein, Michael S.; Li Fei-Fei
err分享
err收藏
Cats and dogs猫和狗
err2012-06-01
err0
PREAI
errO. M. Parkhi; A. Vedaldi; A. Zisserman; C. V. Jawahar
err分享
err收藏
学者 查看更多内容