Your other Left! Vision-Language Models Fail to Identify Relative Positions in Medical Images
机构 * Visual Computing Group, Institute of Media Informatics, Ulm University, Germany(媒体信息研究所视觉计算组,乌尔姆大学,德国) ; Diagnostic and Interventional Radiology, Ulm University Medical Center, Germany(乌尔姆大学医学中心诊断与介入放射学) ; Axiom Bio, USA(Axiom Bio公司,美国)
专题命中 视觉问答 :vision-language model(title,abstract);分类 cs.CV
Comments Accepted at the International Conference on Medical Image Computing and Computer Assisted Intervention (MICCAI) 2025