Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
在视觉语言模型中实现工具集成推理的规模化代理强化学习
Meng Lu, Ran Xu, Yi Fang, Wenxuan Zhang, Yue Yu, Gaurav Srivastava, Yuchen Zhuang, Mohamed Elhoseiny, Charles Fleming, Carl Yang, Zhengzhong Tu, Yang Xie, Guanghua Xiao, Hanrui Wang, Di Jin, Wenqi Shi, Xuan Wang
机构
*
Virginia Tech(弗吉尼亚理工大学)
;
Emory University(埃默里大学)
;
KAUST(阿联酋卡塔尔大学)
;
Georgia Tech(佐治亚理工学院)
;
Cisco(思科系统)
;
TAMU(德克萨斯大学奥斯汀分校)
;
UT Southwestern Medical Center(德克萨斯西南医学中心)
;
Eigen AI
Vision-Language Models for Automated 3D PET/CT Report Generation
用于自动化3D PET/CT报告生成的视觉-语言模型
Wenpei Jiao, Kun Shang, Hui Li, Ke Yan, Jiajin Zhang, Guangjie Yang, Lijuan Guo, Yan Wan, Xing Yang, Dakai Jin, Zhaoheng Xie
机构
*
Institute of Medical Technology and National Biomedical Imaging Center, Peking University(北京大学医学技术研究院和国家生物医学成像中心)
;
Peking University People’s Hospital(北京大学人民医院)
;
Peking University Third Hospital(北京大学第三医院)
;
DAMO Academy, Alibaba Group(阿里巴巴集团达摩院)
;
The Affiliated Hospital of Qingdao University(青岛大学附属医院)
;
The First Affiliated Hospital of Henan Medical University(河南医科大学第一附属医院)
;
Jiujiang City Key Laboratory of Cell Therapy, Jiu Jiang NO.1 People’s Hospital(九江市细胞治疗重点实验室,九江市第一人民医院)
Spatial-SSRL: Enhancing Spatial Understanding via Self-Supervised Reinforcement Learning
Spatial-SSRL: 通过自监督强化学习增强空间理解
Yuhong Liu, Beichen Zhang, Yuhang Zang, Yuhang Cao, Long Xing, Xiaoyi Dong, Haodong Duan, Dahua Lin, Jiaqi Wang
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shanghai Innovation Institute(上海创新研究院)
CommentsProject homepage: https://flageval-baai.github.io/LRM-Eval/ This work will also be presented at NeurIPS 2025 Workshop on Foundations of Reasoning in Language Models (FoRLM); update with trials on Gemini 3 Pro