DisasterVQA: A Visual Question Answering Benchmark Dataset for Disaster Scenes
DisasterVQA: 一个用于灾难场景的视觉问答基准数据集
机构 * Qatar Computing Research Institute(卡塔尔计算研究所) ; Hamad Bin Khalifa University(哈马德·本·卡伊夫大学) ; College of Science & Engineering(科学与工程学院) ; Qatar University(卡塔尔大学)
专题命中 视觉问答 :visual question answering(title,abstract);vision-language model(abstract);分类 cs.CV
AI总结 本文提出DisasterVQA数据集,用于灾难场景中的感知与推理任务,通过1395张真实图像和4405对专家 curated 的问答对,评估了七种最先进的视觉-语言模型在灾难响应中的性能,发现模型在细粒度定量推理、物体计数和上下文敏感解释方面存在不足。
Comments Accepted at ICWSM 2026