多模态AI是医学的未来,谷歌推出三个新模型,Med-Gemini迎来大升级
将
ScienceAI
设为
星标
第一
时间
掌握
新鲜的 AI for Science 资讯
图示:Med-Gemini 概述。(来源:论文)
来自 370 万张医学图像和病例的超过 700 万个数据样本用于训练模型。使用各种视觉问答和图像字幕数据集,包括一些来自医院的私人数据集。
为了处理 3D 数据 (CT),使用了 Gemini 视频编码器,其中时间维度被视为深度维度。为了处理基因组数据,各种性状的风险评分被编码为图像中的 RGB 像素。