arrow
返回

Enhancing dermoscopic image generation via multi-modal conditional diffusion models

delete2026-08-14
delete0
PRE
AI
Y
Yun Jiang
Y
Yarong Jin *
T
Tao Sun
H
Huanting Guo
Z
Zequn Zhang *
Y
Yuhang Li
Q
Qian Niu
DOI:10.1016/j.neucom.2026.134813delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
近期扩散模型的发展在缓解皮肤镜图像生成中的数据稀缺方面显示出前景。然而,现有方法通常缺乏对关键细节(如疾病模式和病灶定位)的精确控制。这一限制阻碍了皮肤镜分析所需的精细语义生成和空间精度。为解决此问题,我们提出了一种新型多模态条件扩散模型(MMC-Diff),利用多种模态(如皮肤科特定文本和图像)来约束生成过程。首先,我们开发了一种基于预训练视觉-语言模型推导的皮肤科特定文本描述的潜在扩散模型。其次,我们提出了一种低成本的空间掩码适配器,使模型内部知识与外部控制信号对齐,从而在图像生成过程中实现精确的空间控制。实验结果表明,基于FID和IS等指标,我们的模型在生成质量上达到了与当前最佳方法相当的水平。MMC-Diff有效提升了皮肤镜数据集的质量和多样性。

期刊

Neurocomputing 封面图
Neurocomputing
IF:
6.5
论文数:
2.5W
被引数:
6.5W

机构

N
Northwest Normal University
学者数:
1.1K
论文数: 265
被引数: 5.8K
B
beijing institute of technology
学者数:
5.5W
论文数: 4.0W
被引数: 63
U
University of Science and Technology of China
学者数:
1.7W
论文数: 6.0K
被引数: 11.3W
T
The University of Tokyo
学者数:
2.9K
论文数: 1.1K
被引数: 8.1W
学者 查看更多机构
引用论文

引用论文

暂无论文信息