Ground-R1: Incentivizing Grounded Visual Reasoning via Reinforcement Learning
Ground-R1: 通过强化学习激励基于地面的视觉推理
Meng Cao, Haoze Zhao, Can Zhang, Xiaojun Chang, Ian Reid, Xiaodan Liang
机构
*
Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学)
;
Peking University(北京大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Sun Yat-sen University(中山大学)
机构
*
School of Data Science and Engineering, East China Normal University, Shanghai, China(数据科学与工程学院,东华大学,上海,中国)
;
Alibaba Group, Hangzhou, China(阿里巴巴集团,杭州,中国)
Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
Med3D-R1: 促进3D医学视觉-语言模型的临床推理
Haoran Lai, Zihang Jiang, Kun Zhang, Qingsong Yao, Rongsheng Wang, Zhiyang He, Xiaodong Tao, Wei Wei, Shaohua Kevin Zhou
机构
*
School of Biomedical Engineering, Division of Life Sciences and Medicine, University of Science and Technology of China(生物医学工程学院,生命科学与医学系,中国科学技术大学)
;
Suzhou Institute for Advanced Research, University of Science and Technology of China(先进研究所,中国科学技术大学)
;
Stanford University(斯坦福大学)
;
Medical Business Department, iFlytek Co.Ltd(iFlytek公司医学业务部)
;
The First Affiliated Hospital of USTC, Division of Life Sciences and Medicine University of Science and Technology of China(中国科学技术大学第一附属医院,生命科学与医学系)
机构
*
Graduate School of Information Science and Technology, Hokkaido University(信息科学与技术研究生院,北海道大学)
;
Graduate School of Computer Science, George Mason University(计算机科学研究生院,乔治·梅森大学)
SNOW: Spatio-Temporal Scene Understanding with World Knowledge for Open-World Embodied Reasoning
SNOW:基于世界知识的时空场景理解用于开放世界具身推理
Tin Stribor Sohn, Maximilian Dillitzer, Jason J. Corso, Eric Sax
机构
*
Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)
;
Esslingen University of Applied Sciences(埃斯林根应用科学大学)
;
Dr. Ing. h.c. F. Porsche AG(德意志联邦汽车工业联合会)
;
University of Michigan(密歇根大学)
;
Voxel51 Inc.(Voxel51公司)
R4: Retrieval-Augmented Reasoning for Vision-Language Models in 4D Spatio-Temporal Space
R4:在4D时空空间中为视觉语言模型引入检索增强推理
Tin Stribor Sohn, Maximilian Dillitzer, Jason J. Corso, Eric Sax
机构
*
Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)
;
Esslingen University of Applied Sciences(埃斯林根应用科学大学)
;
Dr. Ing. h.c. F. Porsche AG(德意志联邦汽车工业协会)
;
University of Michigan(密歇根大学)
;
Voxel51 Inc.(Voxel51公司)
Comments6 pages, 3 figures. Code and data: https://github.com/Amiton7/Tri-Bench. Accepted to the AAAI 2026 Workshop on Trust and Control in Agentic AI (TrustAgent)