The Illusion of Clinical Reasoning: A Benchmark Reveals the Pervasive Gap in Vision-Language Models for Clinical Competency
临床推理的幻觉:一个基准揭示了视觉语言模型在临床能力方面的广泛差距
专题命中 医疗多模态 :medical image(abstract);diagnosis(abstract);分类 cs.CV
AI总结 本研究提出B&J基准测试,揭示了视觉语言模型在临床推理任务中存在显著的多模态整合能力不足问题,强调需在多模态整合和视觉理解上取得突破才能实现临床应用。