arrow
返回

Advancing Medical Representation Learning Through High-Quality Data

delete2026-01-01
delete0
PRE
AI
N
Negin Baghbanzadeh *
A
Adibvafa Fallahpour
Y
Yasaman Parhizkar
F
Franklin Ogidi
S
Shuvendu Roy
S
Sajad Ashkezari
V
Vahid Reza Khazaie
M
Michael Colacci
A
Ali Etemad
A
Arash Afkanpour
E
Elham Dolatabadi
DOI:10.1007/978-3-032-05169-1_3delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
尽管医学视觉-语言数据集的规模日益增长,但数据集质量对模型性能的影响仍需进一步探索。我们介绍Open-PMC,一个来自PubMed Central的高质量医学数据集,包含220万图像-文本对,并补充了图像模态标注、子图以及文本内摘要引用。值得注意的是,文本内引用提供了更丰富的医学上下文,超越了通常出现在标题中的摘要信息。通过大量实验,我们在检索和零样本分类任务中,将Open-PMC与更大规模的数据集进行了基准对比。结果显示,数据集质量(而不仅仅是规模)是驱动性能显著提升的关键因素。我们通过深入分析特征表示来补充这一基准。我们的发现强调了数据整理质量在推动多模态医学人工智能发展中的关键作用。我们发布了Open-PMC数据集,以及预训练模型和代码库。
Keyword:
Multimodal Learning
Representation Learning
Contrastive Learning
Image Decomposition

期刊

M
MEDICAL IMAGE COMPUTING AND COMPUTER ASSISTED INTERVENTION - MICCAI 2025, PT XIII
IF:
0
论文数:
53
被引数:
0

机构

Q
queens university - canada
学者数:
1.8W
论文数: 1.7W
被引数: 29
V
Vector Institute for Artificial Intelligence
学者数:
217
论文数: 164
被引数: 4
Y
york university - canada
学者数:
8.3K
论文数: 9.0K
被引数: 10
U
university of toronto
学者数:
14.8W
论文数: 12.0W
被引数: 165
学者 查看更多机构
引用论文

引用论文

PMC-CLIP: Contrastive Language-Image Pre-training Using Biomedical Documents
err2023-10-01
err0
PREAI
errWeixiong Lin; Ziheng Zhao; Xiaoman Zhang; Chaoyi Wu; Ya Zhang; Yanfeng Wang; Weidi Xie
err分享
err收藏
End-to-End Object Detection with Transformers使用Transformers进行端到端对象检测
err2020-11-03
err0
PREAI
errNicolas Carion; Francisco Massa; Gabriel Synnaeve; Nicolas Usunier; Alexander Kirillov; Sergey Zagoruyko
err分享
err收藏
Radiology Objects in COntext (ROCO): A Multimodal Image Dataset
err2018-10-17
err0
PREAI
errObioma Pelka; Sven Koitka; Johannes Rückert; Felix Nensa; Christoph M. Friedrich
err分享
err收藏
ImageBind One Embedding Space to Bind Them All
err2023-06-01
err0
errOAAI
errRohit Girdhar; Alaaeldin El-Nouby; Zhuang Liu; Mannat Singh; Kalyan Vasudev Alwala; Armand Joulin; Ishan Misra
err分享
err收藏
BIOMEDICA: An Open Biomedical Image-Caption Archive, Dataset, and Vision-Language Models Derived from Scientific Literature
err2025-06-10
err0
PREAI
errLozano,Alejandro; Sun,Min Woo; Burgess,James; Chen,Liangyu; Nirschl,Jeffrey J.; Gu,Jeffrey; Lopez,Ivan; Aklilu,Josiah; Rau,Anita; Katzer,Austin Wolfgang; Zhang,Yuhui; Chiu,Collin; Wang,Xiaohan; Song,Alfred Seunghoon; Tibshirani,Robert; Yeung-Levy,Serena
err分享
err收藏
DeepOpht: Medical Report Generation for Retinal Images via Deep Models and Visual Explanation
err2021-01-01
err0
errOAAI
errJia-Hong Huang; C.-H. Huck Yang; Fangyu Liu; Meng Tian; Yi-Chieh Liu; Ting-Wei Wu; I-Hung Lin; Kang Wang; Hiromasa Morikawa; Hernghua Chang; Jesper Tegner; Marcel Worring
err分享
err收藏
MedICaT: A Dataset of Medical Images, Captions, and Textual References
err2020-01-01
err0
errOAAI
errSanjay Subramanian; Lucy Lu Wang; Ben Bogin; Sachin Mehta; Madeleine van Zuylen; Sravanthi Parasa; Sameer Singh; Matt Gardner; Hannaneh Hajishirzi
err分享
err收藏
Medical visual question answering: A survey医学视觉问答: 一项调查
err2023-09-01
err28
errOAAI
errLin, Zhihong; Zhang, Donghao; Tao, Qingyi; Shi, Danli; Haffari, Gholamreza; Wu, Qi; He, Mingguang; Ge, Zongyuan
err分享
err收藏
MIMIC-CXR, a de-identified publicly available database of chest radiographs with free-text reportsMimport-cxr,一个带有自由文本报告的去识别公开的胸部x光片数据库
err2019-12-12
err0
errOAAI
errAlistair E. W. Johnson; Tom J. Pollard; Seth J. Berkowitz; Nathaniel R. Greenbaum; Matthew P. Lungren; Chih-ying Deng; Roger G. Mark; Steven Horng
err分享
err收藏
没有更多内容