9月18日,阿里巴巴达摩院与浙江大学医学院附属第一医院等机构研发出通用医疗影像AI模型DAMO RADAR,登上国际顶级学术期刊《科学》(Science)。该模型面向腹部增强CT诊断,可一次性识别超过146种病症,其准确性首次达到影像科专家级水平,现已正式开源。 据介绍,达摩院采用视觉-语言学习方法(Vision-Language Learning),让模型直接学习医学影像和相对应报告文本的内在关联信息。达摩院高级算法专家张建鹏表示,由于CT数据信号稀疏,常规的视觉-语言学习效果不佳,该项研究在国际上首次采用“器官级细粒度对齐”策略,将CT构建三维数据并分解为解剖单元,在组织器官层面实现图像与报告文本的精确对齐,并通过自适应对比建模策略来动态调整,无需额外人工标注即可完成可扩展、多用途、可解释的诊断。(广角观察)
