Have Large Vision-Language Models Mastered Art History?
机构 * KU Leuven(库勒韦恩大学) ; Leiden University(莱顿大学)
专题命中 视觉推理 :vision-language model(title,abstract);LLaVA(abstract);分类 cs.CV
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
机构 * KU Leuven(库勒韦恩大学) ; Leiden University(莱顿大学)
专题命中 视觉推理 :vision-language model(title,abstract);LLaVA(abstract);分类 cs.CV
专题命中 视觉推理 :vision-language model(title,abstract);分类 cs.AI、cs.LG
机构 * Department of Electrical and Computer Engineering, Univ. of Minnesota(电气与计算机工程系) ; Amazon Lab126(亚马逊实验室126) ; National Tsing Hua University(国立清华大学)
专题命中 视觉推理 :grounding(title,abstract)
Comments Accepted to 2025 IEEE-RAS 24th International Conference on Humanoid Robots
机构 * Sorbonne Université, CNRS, ISIR(索邦大学、国家科学研究中心、ISIR)
专题命中 视觉推理 :vision-language model(abstract);VLM(abstract);分类 cs.AI、cs.LG
专题命中 视觉推理 :grounding(abstract);分类 cs.CV
Comments 9 pages, 4 figures
专题命中 视觉推理 :grounding(abstract)