机构
*
Arizona State University(亚利桑那州立大学)
;
Clemson University(克莱姆森大学)
;
LinkedIn Corporation(领英公司)
;
Washington University in St. Louis(圣路易斯华盛顿大学)
;
Morgan Stanley(摩根大通)
VideoChat-R1: Enhancing Spatio-Temporal Perception via Reinforcement Fine-Tuning
Xinhao Li, Ziang Yan, Desen Meng, Lu Dong, Xiangyu Zeng, Yinan He, Yali Wang, Yu Qiao, Yi Wang, Limin Wang
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
Nanjing University(南京大学)
;
Zhejiang University(浙江大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
专题命中
VLM训练与架构
:grounding(abstract);multimodal large language model(abstract);MLLM(abstract);分类 cs.CV
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 Gallup 学院)
;
Department of Electrical and Computer Engineering, McGill University(麦吉尔大学电气与计算机工程系)
;
School of Statistics, Renmin University of China(中国人民大学统计学院)
;
Tencent Jarvis Lab(腾讯 Jarvis 实验室)
;
Medical Artificial Intelligence Lab, Westlake University(西湖大学医学人工智能实验室)
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
SenseTime Research(商汤科技研究院)
;
Tsinghua University(清华大学)
;
Nanjing University(南京大学)
;
Fudan University(复旦大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shanghai Jiao Tong University(上海交通大学)
专题命中
VLM训练与架构
:InternVL(abstract);multimodal large language model(abstract);MLLM(abstract);分类 cs.CV