arrow
返回

Cross-modal contrastive learning-based object detection under incomplete modalities

delete2026-04-07
delete0
delete
OA
AI
H
Hongjun Ma
倪
倪欢 (Huan Ni) *
Y
Yongshi Jie
H
Haiyan Guan *
Q
Qingli Luo
DOI:10.1080/10095020.2026.2633014delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
目标检测在使用多模态遥感图像时表现出比使用单模态数据更强的性能。然而,在实际应用中,某些区域可能缺少特定模态数据,这限制了多模态目标检测方法的应用。为解决这一挑战,本文提出了一种跨模态对比学习和知识蒸馏(CCLKD)方法。CCLKD由针对易检测和难检测模态的双分支组成。在CCLKD训练过程中,它采用知识蒸馏策略,通过从易检测分支(教师网络)转移知识来增强难检测分支(学生网络)的性能。因此,当易检测模态缺失时,CCLKD仅使用难检测模态数据仍能获得良好的检测性能。为更有效地增强难检测模态的表示能力,CCLKD引入了基于自适应温度的知识蒸馏(ATKD)策略和类别约束对比学习(CCL)机制。ATKD根据教师网络提供的预测概率动态调整蒸馏温度,并提供逻辑级、特征级和关系级蒸馏。CCL在增强同类实例间相似性的同时抑制不同类别的干扰,从而提高特征空间中的类内紧致性和类间可分性。我们采用了三个标准目标检测数据集,并将CCLKD与当前先进方法进行比较以验证其性能。实验结果证明了CCLKD各组件的有效性,并通过定性和视觉比较进一步验证了其优于现有方法的优越性。
Keyword:
Feature alignment
object detection
contrastive learning
category-level information

期刊

G
Geo-Spatial Information Science
IF:
5.5
论文数:
875
被引数:
2.4K

机构

T
tianjin university
学者数:
8.0W
论文数: 5.8W
被引数: 88
N
Nanjing University of Information Science and Technology
学者数:
2.9K
论文数: 1.2K
被引数: 1.7W
学者 查看更多机构
引用论文

引用论文

ShipGeoNet: SAR Image-Based Geometric Feature Extraction of Ships Using Convolutional Neural Networks
err2024-01-01
err26
PREAI
errYasir, Muhammad; Liu, Shanwei; Mingming, Xu; Wan, Jianhua; Pirasteh, Saied; Dang, Kinh Bac
err分享
err收藏
Deep unsupervised part-whole relational visual saliency
err2024-01-01
err35
PREAI
errLiu, Yi; Dong, Xiaohui; Zhang, Dingwen; Xu, Shoukun
err分享
err收藏
学者 查看更多内容