arrow
返回

A Simple Interactive Attention for Multimodal Named Entity Recognition

delete2026-01-01
delete0
PRE
AI
L
L Y Wang
Y
Yu Bai *
F
Fang Cai
L
Liu, Xiang
N
Na Ye
X
Xinyuan Ye
G
Guiping Zhang
DOI:10.1007/978-981-96-7008-6_8delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
多模态命名实体识别(MNER)将视觉和文本数据相结合,以对句子中的命名实体进行分类。MNER的一个挑战在于将文本实体与相关视觉区域对齐,同时最小化无关视觉区域的干扰。针对这一挑战,现有方法使用辅助模型提取视觉信息。然而,这些模型提取的视觉信息通常仍包含对实体识别无关的数据,同时增加了模型的计算复杂度。为解决这些问题,我们提出了一个用于MNER的简单交互式注意力机制(SIAM NER),避免了使用额外的辅助模型。具体而言,我们开发了一种交互式注意力机制,利用文本和视觉模态之间的双向交互,精确地将实体词与图像区域对齐,从而最小化无关视觉信息的干扰。此外,我们集成了一个门控机制来调整模态权重,在对应视觉数据缺失时有效减少视觉干扰。综合实验表明,我们的方法在有效性和效率方面均优于现有的基线方法。代码可在SIAMNER获取。
Keyword:
Multimodal Named Entity Recognition
Interaction Attention
Information Extraction

期刊

N
NEURAL INFORMATION PROCESSING, ICONIP 2024, PT XIII
IF:
0
论文数:
24
被引数:
0

机构

A
australian national university
学者数:
2.3K
论文数: 1.2K
被引数: 0
S
shenyang aerospace university
学者数:
1.4K
论文数: 464
被引数: 0
引用论文

引用论文

err
IF0
err
err0
PREAI
err
err分享
err收藏
Query Prior Matters
err2022-10-10
err0
PREAI
errMeihuizi Jia; Xin Shen; Lei Shen; Jinhui Pang; Lejian Liao; Yang Song; Meng Chen; Xiaodong He
err分享
err收藏
Twitter100k: A Real-World Dataset for Weakly Supervised Cross-Media Retrieval
err2018-04-01
err47
errOAAI
errHu, Yuting; Zheng, Liang; Yang, Yi; Huang, Yongfeng
err分享
err收藏
err分享
err收藏
Mask R-CNN面具r-cnn
err2017-10-01
err0
PREAI
errKaiming He; Georgia Gkioxari; Piotr Dollar; Ross Girshick
err分享
err收藏
Visual Description Augmented Integration Network for Multimodal Entity and Relation Extraction
err2023-05-18
err0
errOAAI
errMin Zuo; Yingjun Wang; Wei Dong; Qingchuan Zhang; Yuanyuan Cai; Jianlei Kong
err分享
err收藏
学者 查看更多内容