arrow
返回

Regulating Modality Utilization within Multimodal Fusion Networks

delete2024-09-19
delete0
delete
OA
AI
S
Saurav Singh *
E
Eli Saber
P
Panos P. Markopoulos
J
Jamison Heard
DOI:10.3390/s24186054delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
Multimodal fusion networks play a pivotal role in leveraging diverse sources of information for enhanced machine learning applications in aerial imagery. However, current approaches often suffer from a bias towards certain modalities, diminishing the potential benefits of multimodal data. This paper addresses this issue by proposing a novel modality utilization-based training method for multimodal fusion networks. The method aims to guide the network's utilization on its input modalities, ensuring a balanced integration of complementary information streams, effectively mitigating the overutilization of dominant modalities. The method is validated on multimodal aerial imagery classification and image segmentation tasks, effectively maintaining modality utilization within +/- 10% of the user-defined target utilization and demonstrating the versatility and efficacy of the proposed method across various applications. Furthermore, the study explores the robustness of the fusion networks against noise in input modalities, a crucial aspect in real-world scenarios. The method showcases better noise robustness by maintaining performance amidst environmental changes affecting different aerial imagery sensing modalities. The network trained with 75.0% EO utilization achieves significantly better accuracy (81.4%) in noisy conditions (noise variance = 0.12) compared to traditional training methods with 99.59% EO utilization (73.7%). Additionally, it maintains an average accuracy of 85.0% across different noise levels, outperforming the traditional method's average accuracy of 81.9%. Overall, the proposed approach presents a significant step towards harnessing the full potential of multimodal data fusion in diverse machine learning applications such as robotics, healthcare, satellite imagery, and defense applications.
Keyword:
multimodal
data fusion
modality utilization
permutation feature importance
aerial imagery
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

Sensors 封面图
Sensors
IF:
3.5
论文数:
7.2W
被引数:
20.9W

机构

R
Rochester Institute of Technology
学者数:
3.8K
论文数: 3.3K
被引数: 45
U
university of texas system
学者数:
18.5W
论文数: 15.6W
被引数: 210
引用论文

引用论文

Inhibition of LDHA to induce eEF2 release enhances thrombocytopoiesis
err2022-05-12
err0
errOAAI
errQidi Chen; Min Xin; Lingjun Wang; Lin Li; Yingzhi Shen; Yan Geng; Haojie Jiang; Yang Wang; Lin Zhang; Yanyan Xu; Yu Hou; Junling Liu; Xuemei Fan
err分享
err收藏
A survey on machine learning for data fusion面向数据融合的机器学习研究综述
err2020-05-01
err388
PREAI
errMeng, Tong; Jing, Xuyang; Yan, Zheng; Pedrycz, Witold
err分享
err收藏
Transformers in Vision: A Survey视觉中的变形金刚: 一项调查
err2022-09-13
err1.1K
errOAAI
errKhan, Salman; Naseer, Muzammal; Hayat, Munawar; Zamir, Syed Waqas; Khan, Fahad Shahbaz; Shah, Mubarak
err分享
err收藏
Feature-level fusion approaches based on multimodal EEG data for depression recognition
err2020-07-01
err198
PREAI
errCai, Hanshu; Qu, Zhidiao; Li, Zhe; Zhang, Yi; Hu, Xiping; Hu, Bin
err分享
err收藏
Cross‐nucleation of polybutene‐1 Form II on Form I seeds with different morphology
err2020-02-05
err0
errOAAI
errWei Wang; Bao Wang; Enrico Carmeli; Zefan Wang; Zhe Ma; Dario Cavallo
err分享
err收藏
Environment Sound Classification Using a Two-Stream CNN Based on Decision-Level Fusion
errSENSORS
IF3.5
err2019-04-11
err122
errOAAI
errSu, Yu; Zhang, Ke; Wang, Jingyu; Madani, Kurosh
err分享
err收藏
Learning Modality Complementary Features with Mixed Attention Mechanism for RGB-T Tracking
errSENSORS
IF3.5
err2023-07-22
err8
errOAAI
errLuo, Yang; Guo, Xiqing; Dong, Mingtao; Yu, Jin
err分享
err收藏
Decrease of autophagy activity promotes malignant progression of tongue squamous cell carcinoma自噬活性降低促进舌鳞状细胞癌恶性进展
err2013-03-07
err0
PREAI
errYawen Wang; Cheng Wang; Haikuo Tang; Miao Wang; Junquan Weng; Xiqiang Liu; Rong Zhang; Hongzhang Huang; Jinsong Hou
err分享
err收藏
学者 查看更多内容