Multimodal LLM With Hierarchical Mixture-of-Experts for VQA on 3D Brain MRI
多模态大语言模型与分层混合专家用于3D脑部MRI的视觉问答
机构 * UCLA Computer Science(UCLA计算机科学系) ; UCSF Radiology(UCSF放射学) ; UCLA Medicine(UCLA医学)
AI总结 本研究提出了一种多模态大语言模型mpLLM,用于3D脑部MRI的视觉问答,通过分层混合专家架构提升肿瘤描述的临床可解释性,并在多个数据集上优于现有基线模型。
Comments 17 pages, 3 figures