arrow
返回

Citation Context Extraction Using a Transformer-Based Model with a Question-Answering Task

delete2026-01-01
delete0
PRE
AI
M
Masana Khanyi
M
Milandre van Lill
M
Marcel Dunaiski *
DOI:10.1007/978-3-031-96262-2_19delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
准确提取引文上下文对于理解引文文献的影响和相关性至关重要,能够增强引文分析、文献综述自动化和知识图谱构建等科学计量任务。本文利用大型语言模型(RoBERTa)并在问答框架下对其进行微调,以有效提取科学文本中的引文上下文。传统的引文上下文提取方法采用固定窗口长度,往往难以捕捉引文上下文的细微特征和可变长度。我们利用RoBERTa等上下文感知Transformer模型的能力来克服这些限制,提高引文上下文提取的有效性。我们提出了一种新颖的方法,将下游任务视为类似问答任务的跨度提取问题,对RoBERTa模型进行微调。这种方法使模型能够根据特定的文本内引文动态识别和提取相关引文上下文,从而捕获更精确且上下文相关的文本片段。我们在两个基准数据集上,将我们的模型与使用固定窗口方法的四种基线方法进行了比较评估。我们的模型优于所有基线方法,在两个数据集上分别实现了95%和92%的F1分数。其对引文上下文可变性质的适应性带来了更准确的提取结果,证明了问答框架内跨度提取方法的有效性。这些结果表明,基于Transformer的模型有望显著提升从科学文献中提取引文上下文的能力。
Keyword:
Citation context extraction
Natural language processing
Transformers

期刊

S
SOUTH AFRICAN COMPUTER SCIENCE AND INFORMATION SYSTEMS RESEARCH TRENDS, SAICSIT 2025
IF:
0
论文数:
18
被引数:
0

机构

S
stellenbosch university
学者数:
1.4W
论文数: 1.2W
被引数: 17
引用论文

引用论文

err分享
err收藏
Cited text span identification for scientific summarisation using pre-trained encoders
err2020-05-07
err17
errOAAI
errZerva, Chrysoula; Minh-Quoc Nghiem; Nguyen, Nhung T. H.; Ananiadou, Sophia
err分享
err收藏
RefSeer: A citation recommendation system
err2014-09-01
err0
PREAI
errWenyi Huang; Zhaohui Wu; Prasenjit Mitra; C. Lee Giles
err分享
err收藏
Overview of the Transformer-based Models for NLP Tasks
err2020-09-26
err0
errOAAI
errAnthony Gillioz; Jacky Casas; Elena Mugellini; Omar Abou Khaled
err分享
err收藏
学者 查看更多内容