ChromouVQA: Benchmarking Vision-Language Models under Chromatic Camouflaged Images
ChromouVQA:在色度伪装图像下评估视觉-语言模型的基准测试
机构 * Amazon(亚马逊公司) ; Google(谷歌公司) ; MurcuryMind(MurcuryMind公司) ; University of Southern California(南加州大学) ; Nanyang Technological University(南洋理工大学) ; Lehigh University(莱斯大学) ; Stony Brook University(石溪大学)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
AI总结 ChromouVQA通过色度伪装图像评估视觉-语言模型在复杂背景下的表现,提出对比度配方提升形状恢复能力。