Nat. Biomed. Eng. | 通过大规模概念增强的视觉–语言预训练构建可解释的生物医学基础模型

研究人员提出 ConceptCLIP,一种将医学概念直接融入大规模视觉–语言预训练过程的可解释生物医学基础模型。与其在模型训练完成后再附加解释模块,不如在基础模型预训练阶段直接引入结构化医学知识,使模型从一开始就学习”影像区域 — 医学概念 — 疾病”之间的关系。总体而言,这项研究提出了一条值得关注的医学基础模型发展路线:不仅扩大训练数据和模型规模,还将标准化医学知识直接融入视觉–语言预训练,使基础模型同时学习”看见什么、意味着什么,以及为什么支持这一诊断”。

原文连接