A Multi-To-One Interview Paradigm for Efficient MLLM Evaluation
机构 * Shanghai Jiao Tong University(上海交通大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Fudan University(复旦大学)
专题命中 视觉问答 :MLLM(title,abstract);分类 cs.AI
Comments 5 pages, 2 figures
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
机构 * Shanghai Jiao Tong University(上海交通大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Fudan University(复旦大学)
专题命中 视觉问答 :MLLM(title,abstract);分类 cs.AI
Comments 5 pages, 2 figures
机构 * Microsoft(微软)
专题命中 视觉问答 :grounding(abstract);分类 cs.AI
机构 * Amsterdam UMC, Department of Medical Informatics(阿姆斯特丹大学医学中心,医学信息学系) ; Center for Information and Language Processing, LMU Munich(信息与语言处理中心,慕尼黑大学) ; Munich Center for Machine Learning (MCML), Munich(慕尼黑机器学习中心(MCML)) ; Institute for Logic, Language and Computation (ILLC), University of Amsterdam(逻辑、语言与计算研究所(ILLC),阿姆斯特丹大学)
专题命中 视觉问答 :grounding(abstract)
Comments Accepted to EMNLP 2025 (Main Conference)