Language-Guided Invariance Probing of Vision-Language Models
语言引导的视觉-语言模型不变性探测
机构 * Department of Computer Science, Purdue University(普渡大学计算机科学系)
专题命中 幻觉与鲁棒性 :vision-language model(title,abstract);分类 cs.CV、cs.AI
AI总结 本文提出LGIP基准,用于评估视觉-语言模型对语言扰动的鲁棒性,发现EVA02-CLIP和OpenCLIP表现优异,而SigLIP存在显著缺陷。
Comments Pattern Recognition Letters 2026