机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
Fudan University(复旦大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
South China University of Technology(华南理工大学)
;
Nanjing University(南京大学)
;
Xiamen University(厦门大学)
;
CUHK MMLab(香港中文大学MMLab)
V-Retrver: Evidence-Driven Agentic Reasoning for Universal Multimodal Retrieval
V-Retrver: 以证据驱动的代理推理用于通用多模态检索
Dongyang Chen, Chaoyang Wang, Dezhao Su, Xi Xiao, Zeyu Zhang, Jing Xiong, Qing Li, Yuzhang Shang, Shichao Kan
机构
*
Tsinghua University(清华大学)
;
University of Central Florida(中央佛罗里达大学)
;
Fudan University(复旦大学)
;
The Australian National University(澳大利亚国立大学)
;
The University of Hong Kong(香港大学)
;
Pengcheng Laboratory(鹏城实验室)
;
Central South University(中南大学)
Med-R1: Reinforcement Learning for Generalizable Medical Reasoning in Vision-Language Models
Yuxiang Lai, Jike Zhong, Ming Li, Shitian Zhao, Yuheng Li, Konstantinos Psounis, Xiaofeng Yang
机构
*
Department of Computer Science and Informatics, Emory University(计算机科学与信息学系,埃默里大学)
;
Department of Computer Science and Department of Electrical and Computer Engineering, University of Southern California(计算机科学系和电气与计算机工程系,南加州大学)
;
Department of Computer Science, University of Tokyo(计算机科学系,东京大学)
;
Department of Computer Science, Johns Hopkins University(计算机科学系,约翰霍普金斯大学)
;
Department of Biomedical Engineering, Georgia Institute of Technology and Emory University(生物医学工程系,佐治亚理工学院和埃默里大学)
Multimodal Chain of Continuous Thought for Latent-Space Reasoning in Vision-Language Models
Tan-Hanh Pham, Chris Ngo
机构
*
Harvard Medical School, Harvard University(哈佛医学院、哈佛大学)
;
Athinoula A. Martinos Center for Biomedical Imaging, Massachusetts General Hospital(阿提尼乌拉A.马丁努斯生物医学成像中心、麻省总医院)
;
Knovel Engineering Lab, Singapore(Knovel工程实验室、新加坡)
机构
*
Hong Kong Baptist University(香港 Baptist 大学)
;
Sichuan University(四川大学)
;
Shanghai AI Lab(上海人工智能实验室)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))