arrow
返回

Enhancing object detection with large kernel convolution and cross convolution

delete2025-06-25
delete0
PRE
AI
Y
Yaqian Li
G
Guoping Liu
H
Haibin Li
W
Wenming Zhang
X
Xiaoyang Shen
DOI:10.1016/j.dsp.2025.105433delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
现有目标检测模型由于捕获足够上下文信息的能力有限,通常难以检测小目标。本文介绍了一种轻量级目标检测模型,利用大核卷积与注意力(LKA)以及分层特征融合组(HFFG)来解决该问题。LKA模块采用大核卷积捕获长距离依赖和上下文信息,并结合深度可分离卷积以维持轻量化设计。引入的注意力机制进一步使模型能够自适应地聚焦于关键区域,从而提升对小目标的检测性能。HFFG模块整合了交叉卷积块,探索并保留了跨不同尺度的结构信息。通过有效提取结构细节,本模型在各类尺寸目标上展现出增强的性能。在VisDrone2019和PASACAL VOC数据集上的大量实验表明,本模型实现了23.4%的优异mAP,超越基准YOLOX-s模型1.5%。这些结果不仅验证了其有效性,也展示了其鲁棒性和泛化能力。

期刊

Signal Processing 封面图
Signal Processing
IF:
3.6
论文数:
10.0K
被引数:
1.7W

机构

暂无机构信息
引用论文

引用论文

Dehazing & Reasoning YOLO: Prior knowledge-guided network for object detection in foggy weather
err2024-12-01
err1
PREAI
errZhong, Fujin; Shen, Wenxin; Yu, Hong; Wang, Guoyin; Hu, Jun
err分享
err收藏
Edge guidance filtering for structure extraction
err2022-09-02
err3
PREAI
errSun, Beichen; Qi, Yuehan; Zhang, Guanyu; Liu, Yang
err分享
err收藏
The Pascal Visual Object Classes (VOC) ChallengePascal视觉对象课程 (VOC) 挑战
err2009-09-09
err9.0K
PREAI
errEveringham, Mark; Van Gool, Luc; Williams, Christopher K. I.; Winn, John; Zisserman, Andrew
err分享
err收藏
Going deeper with convolutions
err2015-06-01
err0
errOAAI
errChristian Szegedy; Wei Liu; Yangqing Jia; Pierre Sermanet; Scott Reed; Dragomir Anguelov; Dumitru Erhan; Vincent Vanhoucke; Andrew Rabinovich
err分享
err收藏
Visual attention network视觉注意网络
err2023-12-01
err224
errOAAI
errGuo, Meng-Hao; Lu, Cheng-Ze; Liu, Zheng-Ning; Cheng, Ming-Ming; Hu, Shi-Min
err分享
err收藏
没有更多内容