arrow
返回

A Dual-Channel Collaborative Transformer for continual learning

delete2025-03-01
delete2
PRE
AI
C
Cai, Haonan
王一喆 封面图
王一喆 (Yizhe Wang)
Y
Yong Luo
K
Keming Mao *
DOI:10.1016/j.asoc.2025.112792delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
深度神经网络在许多静态任务中取得了成功,但在增量场景下常常遭受灾难性遗忘。近期趋势表明,动态结构方法(使用独立分支处理每个任务)能够有效缓解持续学习中的这一问题。然而,这些方法通常需要大量内存,且过度强调防止任务干扰,或仅允许在有限程度上共享任务知识(通常限于浅层中的任务通用知识)。此外,在使用蒸馏损失引导新任务学习时,其通常仅限于对齐新旧模型的最后一层输出。本文提出了一种基于编码器/解码器框架的新型双通道协作Transformer(DCCT)。该框架包含一个稳定通道和一个累积通道,稳定通道保留旧任务知识,累积通道学习新任务知识。此外,我们引入提示技术,设计了一种新颖的任务特定注意力块(TSAB),其为每个任务训练任务特定token,以小参数实现任务特定注意力。TSAB能够提取任务特定知识并促进它们之间的主动协作。进一步地,我们引入了多层空间注意力图蒸馏损失(MSAD),利用中间层中更通用的知识,增强模型对各类任务的适应性。我们在两个基准数据集CIFAR100和ImageNet100以及真实世界的食物图像分类数据集Food101上进行了大量实验。结果表明,所提出的DCCT模型取得了良好的效果。
Keyword:
Incremental learning
TAsk-Specific Attention
Prompt driven
Spatial Attention Map Distillation

期刊

Applied Soft Computing 封面图
Applied Soft Computing
IF:
6.6
论文数:
1.4W
被引数:
4.8W

机构

D
Dalian Univ Technol
学者数:
4.8K
论文数: 2.1K
被引数: 696
N
Northeastern Univ
学者数:
2.9K
论文数: 1.3K
被引数: 362
引用论文

引用论文

Learning to Prompt for Continual Learning
err2022-06-01
err0
errOAAI
errZifeng Wang; Zizhao Zhang; Chen-Yu Lee; Han Zhang; Ruoxi Sun; Xiaoqi Ren; Guolong Su; Vincent Perot; Jennifer Dy; Tomas Pfister
err分享
err收藏
Class-incremental Learning via Deep Model Consolidation
err2020-03-01
err0
errOAAI
errJunting Zhang; Jie Zhang; Shalini Ghosh; Dawei Li; Serafettin Tasci; Larry Heck; Heming Zhang; C.-C. Jay Kuo
err分享
err收藏
An Appraisal of Incremental Learning Methods增量学习方法的评价
err2020-10-22
err0
errOAAI
errYong Luo; Liancheng Yin; Wenchao Bai; Keming Mao
err分享
err收藏
Memory Recall: A Simple Neural Network Training Framework Against Catastrophic Forgetting
err2022-05-01
err16
PREAI
errZhang, Baosheng; Guo, Yuchen; Li, Yipeng; He, Yuwei; Wang, Haoqian; Dai, Qionghai
err分享
err收藏
Riemannian Walk for Incremental Learning: Understanding Forgetting and Intransigence
err2018-10-06
err0
PREAI
errArslan Chaudhry; Puneet K. Dokania; Thalaiyasingam Ajanthan; Philip H. S. Torr
err分享
err收藏
Human-level control through deep reinforcement learning通过深度强化学习实现人类层面的控制
err2015-02-25
err0
PREAI
errVolodymyr Mnih; Koray Kavukcuoglu; David Silver; Andrei A. Rusu; Joel Veness; Marc G. Bellemare; Alex Graves; Martin Riedmiller; Andreas K. Fidjeland; Georg Ostrovski; Stig Petersen; Charles Beattie; Amir Sadik; Ioannis Antonoglou; Helen King; Dharshan Kumaran; Daan Wierstra; Shane Legg; Demis Hassabis
err分享
err收藏
err分享
err收藏
Conditional Channel Gated Networks for Task-Aware Continual Learning
err2020-06-01
err0
errOAAI
errDavide Abati; Jakub Tomczak; Tijmen Blankevoort; Simone Calderara; Rita Cucchiara; Babak Ehteshami Bejnordi
err分享
err收藏
学者 查看更多内容