Kaiyuan Ji, Yixuan Gao, Lu Sun, Yushuo Zheng, Zijian Chen, Jianbo Zhang, Xiangyang Zhu, Yuan Tian, Zicheng Zhang, Guangtao Zhai
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(上海交通大学图像通信与网络工程研究所)
;
School of Information and Electronic Engineering, East China Normal University(华东师范大学信息与电子工程学院)
;
School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院)
OddGridBench: Exposing the Lack of Fine-Grained Visual Discrepancy Sensitivity in Multimodal Large Language Models
OddGridBench: 暴露多模态大语言模型在细粒度视觉差异敏感性方面的不足
Tengjin Weng, Wenhao Jiang, Jingyi Wang, Ming Li, Lin Ma, Zhong Ming
机构
*
College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机与软件学院)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))
;
Shenzhen Technology University(深圳技术大学)
;
Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院)
;
Meituan(美团)
机构
*
School of Systems Science and Engineering, Sun Yat-sen University(中山大学系统科学与工程学院)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Nankai University(南开大学)
;
Defense Innovation Institute, Academy of Military Sciences(军事科学院国防创新研究院)
;
Tianjin Artificial Intelligence Innovation Center(天津人工智能创新中心)
BabyVLM-V2: Toward Developmentally Grounded Pretraining and Benchmarking of Vision Foundation Models
BabyVLM-V2:迈向基于发展基础的视觉基础模型预训练与基准测试
Shengao Wang, Wenqi Wang, Zecheng Wang, Max Whitton, Michael Wakeham, Arjun Chandra, Joey Huang, Pengyue Zhu, Helen Chen, David Li, Jeffrey Li, Shawn Li, Andrew Zagula, Amy Zhao, Andrew Zhu, Sayaka Nakamura, Yuki Yamamoto, Jerry Jun Yokono, Aaron Mueller, Bryan A. Plummer, Kate Saenko, Venkatesh Saligrama, Boqing Gong
机构
*
Boston University(波士顿大学)
;
Sony Group Corporation(索尼集团公司)