VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning
VOILA:对多模态大语言模型的感知理解与类比推理能力评估
机构 * Arizona State University(亚利桑那州立大学) ; University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)
AI总结 VOILA通过类比映射方法评估多模态大语言模型的感知理解和抽象推理能力,发现其在图像间关系理解上存在不足,但通过多步提示策略可提升性能。
Comments Accepted at ICLR 2025. Code and data: https://github.com/nlylmz/Voila