arrow
返回

A layered self-supervised knowledge distillation framework for efficient image representation learning

delete2026-05-18
delete0
PRE
AI
T
Tarique Dahri
Z
Zulfiqar Ali Memon
Z
Zhenyu Yu
S
Sheheryar Khan *
S
Sadiq Ahmad
M
Muhammad Asim
S
Saddam Aziz
M
M. Rizwan Jameel Qureshi
DOI:10.1007/s00607-026-01671-8delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
在资源受限环境中部署深度学习模型需要训练策略在不增加推理时间成本的前提下提升紧凑模型性能。本研究通过高效的自我蒸馏框架应对这一挑战。我们提出分层自监督知识蒸馏(LSSKD),一种无需依赖大型预训练教师模型的训练框架,用以增强紧凑型深度神经网络。该方法在网络中间阶段引入辅助分类器以生成自监督知识,并实现跨层级的知识转移。在CIFAR-100、Tiny-ImageNet和ImageNet上的实验表明,LSSKD持续提升了紧凑模型的性能。该方法在CIFAR-100上相较于PS-KD平均提升4.54%,相较于SSKD提升1.14%,而在ImageNet上相较于HASSKD提升0.32%。在少样本设置下的额外评估进一步验证了所提LSSKD框架的有效性。这些发现表明,所提LSSKD框架在不依赖大型过参数化教师网络的情况下,有效提升了紧凑模型的泛化能力和性能。值得注意的是,辅助分类器仅在训练期间使用,可在推理时移除,不引入额外计算成本。这种设计使该方法特别适用于提升面向资源受限部署场景的紧凑型视觉模型。
Keyword:
Self-supervised learning
Knowledge distillation
Edge computing
Multi-modal learning
Lightweight deep models

期刊

C
Computing
IF:
2.8
论文数:
2.3K
被引数:
3.5K

机构

C
computer science
学者数:
1.5K
论文数: 737
被引数: 0
F
fast
学者数:
15
论文数: 7
被引数: 0
U
university of malaya
学者数:
470
论文数: 256
被引数: 0
学者 查看更多机构
引用论文

引用论文

Knowledge Distillation: A Survey知识蒸馏: 一项调查
err2021-03-22
err1.5K
PREAI
errGou, Jianping; Yu, Baosheng; Maybank, Stephen J.; Tao, Dacheng
err分享
err收藏
err分享
err收藏
Dynamic Contrastive Distillation for Image-Text Retrieval
err2023-01-01
err13
errOAAI
errRao, Jun; Ding, Liang; Qi, Shuhan; Fang, Meng; Liu, Yang; Shen, Li; Tao, Dacheng
err分享
err收藏
A survey on deep learning techniques for image and video semantic segmentation用于图像和视频语义分割的深度学习技术综述
err2018-09-01
err659
PREAI
errGarcia-Garcia, Alberto; Orts-Escolano, Sergio; Oprea, Sergiu; Villena-Martinez, Victor; Martinez-Gonzalez, Pablo; Garcia-Rodriguez, Jose
err分享
err收藏
学者 查看更多内容