arrow
返回

LeHSE: Large language model enhanced hierarchical script extraction from multiple documents

delete2026-02-26
delete0
PRE
AI
Z
Zenghua Liao
J
Jinzhi Liao
S
Shengze Hu
P
Peixin Huang
X
Xiang Zhao
DOI:10.1016/j.knosys.2026.115608delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
• 据我们所知,我们是首批通过识别其关键挑战并提出非平凡解决方案来探索多文档脚本提取任务的学者之一。 • 我们开创性地整合了LLMs,并基于提取-组装(extract-assemble)概念提出了一种名为LEHSE的新框架。此外,我们还提供了一种计算效率更高的替代方案LEHSE-FT。 • 我们进一步开发了一个新的基准数据集MDScript,该数据集提供了多个文档来源以及针对每个目标的手动标注分层脚本。 • 大量实验通过自动评估和人工评估均证明了LEHSE的优越性,此外,使用MDScript数据微调的小型专用模型也能达到与LLMs相当的能力。
Keyword:
hierarchical script extraction
multi-document processing
large language models
extract-assemble framework
benchmark dataset

期刊

K
Knowledge-Based Systems
IF:
7.6
论文数:
1.3W
被引数:
4.5W

机构

N
national university of defense technology
学者数:
5.0K
论文数: 1.5K
被引数: 0
P
People's Armed Police Force Logistics University
学者数:
3
论文数: 3
被引数: 0
引用论文

引用论文

暂无论文信息