arrow
返回

The MERIT dataset: Modelling and efficiently rendering interpretable transcripts

delete2025-09-29
delete0
PRE
AI
I
Ignacio de Rodrigo *
A
Alberto Sanchez-Cuadrado
J
Jaime Boal
Á
Álvaro J. López-López
DOI:10.1016/j.patcog.2025.112502delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
本文介绍了MERIT数据集,这是一个包含学校成绩单的多模态、全标注数据集。该数据集包含超过400个标签和33k个样本,是训练在视觉丰富文档理解任务中的模型的重要资源。它包含多模态特征,这些特征将文本、视觉和布局领域中的模式联系起来。MERIT数据集还以受控方式包含偏差,使其成为评估语言模型中引入偏差的宝贵工具。本文概述了该数据集的生成流程,并强调了其在不同领域中的主要特征和模式。我们针对该数据集进行了标记分类基准测试,表明即使是SOTA模型也面临着重大挑战。

期刊

Pattern Recognition 封面图
Pattern Recognition
IF:
7.6
论文数:
1.3W
被引数:
4.5W

机构

暂无机构信息
引用论文

引用论文

暂无论文信息