RISE: Enhancing VLM Image Annotation with Self-Supervised Reasoning
专题命中 视觉推理 :VLM(title,abstract);vision-language model(abstract);分类 cs.CV、cs.LG
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 视觉推理 :VLM(title,abstract);vision-language model(abstract);分类 cs.CV、cs.LG
专题命中 视觉推理 :vision-language model(title,abstract);visual reasoning(abstract);分类 cs.CV
Comments EMNLP2025 Main
机构 * School of Electronic Engineering and Computer Science, Queen Mary University of London(伦敦女王学院电子工程与计算机科学学院) ; Department of Knowledge Technologies, Jožef Stefan Institute(Jožef Stefan研究所知识技术系)
专题命中 视觉推理 :multimodal large language model(title);分类 cs.CV、cs.AI、cs.LG
Comments Accepted at EMNLP 2025
机构 * Department of Civil and Environmental Engineering, University of Michigan(土木与环境工程系,密歇根大学) ; University of Michigan Transportation Research Institute(密歇根大学交通研究所)
专题命中 视觉推理 :vision-language model(abstract);VLM(abstract);分类 cs.AI