arrow
返回

Named entity recognition and coreference resolution using prompt-based generative multimodal

delete2025-11-08
delete0
delete
OA
AI
Q
Qingchuan Zhang
Z
Zexi Song *
D
Delong Wang
Y
Yuanyuan Cai
M
Mingwen Bi *
左敏 封面图
左敏 (Min Zuo) *
DOI:10.1007/s40747-025-02122-1delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
命名实体识别(NER)和共指消解(CR)在自然语言处理领域均具有关键意义。代词和名词短语的准确检测已被证明对跨句子乃至跨模态的语义理解有直接影响。然而,现有方法在多模态场景中常因语义融合不足而引发文本-图像错配及指代消解错误等问题。本文提出一种结合目标检测与提示策略的多模态生成框架。首先,采用提示机制将实体类型嵌入视觉通道,利用目标检测结果及视觉Transformer提取的层次特征实现设计,以增强多模态NER。随后构建PGMCR模型,基于提示信息将NER识别的代词和名词短语与图像区域对齐,以实现生成式多模态共指消解。在公开CIN数据集上的实验结果表明,PGMNER在NER任务中达到96.55%的F1分数,显著高于代表性多模态模型;PGMCR在CR任务中取得62.53%的CoNLL F1分数,超越现有最优方法。这些结果验证了所提框架在跨模态命名实体识别与共指消解中的有效性,为复杂场景下的多模态语义理解提供了新见解。
Keyword:
Named entity recognition
Coreference resolution
Generative
Bert
Object detection
Multimodal
Visual grounding
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

Complex and Intelligent Systems 封面图
Complex and Intelligent Systems
IF:
4.6
论文数:
2.1K
被引数:
6.6K

机构

B
Beijing Wuzi University
学者数:
498
论文数: 473
被引数: 374
引用论文

引用论文

Multi-view semantic understanding for visual dialog视觉对话的多视图语义理解
err2023-05-01
err1
PREAI
errJiang, Tianling; Zhang, Zefan; Li, Xin; Ji, Yi; Liu, Chunping
err分享
err收藏
Improved relation span detection in question answering systems over extracted knowledge bases
err2023-08-01
err5
PREAI
errBehmanesh, Somayyeh; Talebpour, Alireza; Shamsfard, Mehrnoush; Jafari, Mohammad Mahdi
err分享
err收藏
Enriched entity representation of knowledge graph for text generation
err2022-11-04
err2
errOAAI
errShi, Kaile; Cai, Xiaoyan; Yang, Libin; Zhao, Jintao
err分享
err收藏
学者 查看更多内容