返回
LeHSE: Large language model enhanced hierarchical script extraction from multiple documents
DOI:10.1016/j.knosys.2026.115608.png)
摘要
En 中文
• 据我们所知,我们是首批通过识别其关键挑战并提出非平凡解决方案来探索多文档脚本提取任务的学者之一。
• 我们开创性地整合了LLMs,并基于提取-组装(extract-assemble)概念提出了一种名为LEHSE的新框架。此外,我们还提供了一种计算效率更高的替代方案LEHSE-FT。
• 我们进一步开发了一个新的基准数据集MDScript,该数据集提供了多个文档来源以及针对每个目标的手动标注分层脚本。
• 大量实验通过自动评估和人工评估均证明了LEHSE的优越性,此外,使用MDScript数据微调的小型专用模型也能达到与LLMs相当的能力。
Keyword:
hierarchical script extraction
multi-document processing
large language models
extract-assemble framework
benchmark dataset
期刊
K
IF:
7.6
论文数:
1.3W
被引数:
4.5W
机构
引用论文
暂无论文信息

