跳至内容

pchao.org

Mr3D-VL

MR3D-VL:让多参数3D磁共振真正“开口说话”的通用视觉-语言模型

14 8 月, 2026 作者 PengChao
失败案例与直觉

Mr3D-VL是一个40亿参数的多参数3D MRI视觉-语言基础模型,通过共享3D编码器、4D旋转位置编码和多分辨率特征注入策略,在报告生成和视觉问答任务上显著超越现有通用及医学专用模型。

分类 CVPR三分钟 标签 CVPR三分钟、 DINO-v2、 MedNext、 Mr3D-VL、 人工智能、 深度学习、 计算机视觉 发表评论
© 2026 pchao.org • Built with GeneratePress