arrow
返回

Rejuvenating efficient convolutional neural networks

delete2025-05-23
delete0
PRE
AI
W
Wei Xu *
Y
Yi Wan
K
Kaiyuan Wang
DOI:10.1007/s11554-025-01696-wdelete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
近年来,高效的卷积神经网络(CNN)模型由于与其他流行的高效模型相比性能相对较差,受到的关注有限。在本文中,我们提出了一种新型的基于CNN的高效模型,命名为MoConv,该模型保留了CNN的许多优势。我们的方法始于对Transformer编码器结构的分析,进而提出了综合卷积注意力(CCA)机制。通过将CCA与倒置残差块(IRB)结合使用,我们设计了类似于Transformer编码器的基本MoConv模块,并构建了适用于各类计算机视觉任务的MoConv模型。MoConv的有效性通过ImageNet、MS COCO和ADE20K等基准测试得到验证。例如,在ImageNet上使用1至2张RTX4090 GPU训练的MoConv-S/T/N模型,在ImageNet-1k上分别实现了78.6%、75.7%和72.2%的top-1准确率,计算开销仅为5.6M/1.4GFLOPs、2.3M/0.5GFLOPs和1.2M/0.3GFLOPs。这显著超越了同类别中最出色的SwiftFormer、ConvMLP、EMO、MobileViG和EfficientFormer等模型的性能。因此,我们的模型在主流轻量级模型中脱颖而出,成为优秀的选择。
Keyword:
Convolutional neural networks
Efficient
attention mechanism
Transformer encoder
Inverted residual block

期刊

Journal of Real-Time Image Processing 封面图
Journal of Real-Time Image Processing
IF:
3
论文数:
401
被引数:
2.0K

机构

Q
Qinghai Normal University
学者数:
967
论文数: 337
被引数: 1.4K
引用论文

引用论文

A ConvNet for the 2020s21世纪20年代的ConvNet
err2022-06-01
err0
PREAI
errZhuang Liu; Hanzi Mao; Chao-Yuan Wu; Christoph Feichtenhofer; Trevor Darrell; Saining Xie
err分享
err收藏
CBAM: Convolutional Block Attention ModuleCBAM: 卷积块注意力模块
err2018-10-06
err0
PREAI
errSanghyun Woo; Jongchan Park; Joon-Young Lee; In So Kweon
err分享
err收藏
InternImage: Exploring Large-Scale Vision Foundation Models with Deformable ConvolutionsInternImage: 使用可变形卷积探索大型视觉基础模型
err2023-06-01
err0
errOAAI
errWenhai Wang; Jifeng Dai; Zhe Chen; Zhenhang Huang; Zhiqi Li; Xizhou Zhu; Xiaowei Hu; Tong Lu; Lewei Lu; Hongsheng Li; Xiaogang Wang; Yu Qiao
err分享
err收藏
err分享
err收藏
ResMLP: Feedforward Networks for Image Classification With Data-Efficient Training
err2023-04-01
err0
errOAAI
errHugo Touvron; Piotr Bojanowski; Mathilde Caron; Matthieu Cord; Alaaeldin El-Nouby; Edouard Grave; Gautier Izacard; Armand Joulin; Gabriel Synnaeve; Jakob Verbeek; Hervé Jégou
err分享
err收藏
学者 查看更多内容