What's Missing in Vision-Language Models? Probing Their Struggles with Causal Order Reasoning
视觉-语言模型缺少什么?探究它们在因果顺序推理中的困难
机构 * University of Southern California(南加州大学) ; University of California, Santa Barbara(加州大学圣芭芭拉分校) ; Texas A&M University(德克萨斯A&M大学)
专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL
AI总结 针对VLM在因果推理中的不足,提出VQA-Causal和VCR-Causal基准,发现模型在因果任务上仅略优于随机猜测,归因于训练数据缺乏因果表达,并通过难负例微调改善。
Comments 13 pages