Analyzing the Sensitivity of Vision Language Models in Visual Question Answering
机构 * University of Memphis, TN, USA(密苏里大学) ; Adobe Research, San Jose, CA, USA(Adobe研究院) ; University of Maryland Baltimore County, USA(马里兰大学巴尔的摩县分校)
专题命中 视觉问答 :vision language model(title,abstract);visual question answering(title,abstract);分类 cs.CV