When and How Does CLIP Enable Domain and Compositional Generalization?
机构 * University of Freiburg(弗赖堡大学)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG
Comments ICML 2025 (Spotlight)
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
机构 * University of Freiburg(弗赖堡大学)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG
Comments ICML 2025 (Spotlight)
专题命中 其他VLM :MLLM(abstract);分类 cs.AI