VideoChat-R1.5: Visual Test-Time Scaling to Reinforce Multimodal Reasoning by Iterative Perception
Ziang Yan, Xinhao Li, Yinan He, Zhengrong Yue, Xiangyu Zeng, Yali Wang, Yu Qiao, Limin Wang, Yi Wang
机构
*
Zhejiang University(浙江大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Nanjing University(南京大学)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
OmniScene: Attention-Augmented Multimodal 4D Scene Understanding for Autonomous Driving
Pei Liu, Hongliang Lu, Haichao Liu, Haipeng Liu, Xin Liu, Ruoyu Yao, Shengbo Eben Li, Jun Ma
机构
*
The Hong Kong University of Science and Technology(香港科技大学)
;
Li Auto Inc.
;
the School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院)
Multimodal AI predicts clinical outcomes of drug combinations from preclinical data
Yepeng Huang, Xiaorui Su, Varun Ullanat, Intae Moon, Ivy Liang, Lindsay Clegg, Damilola Olabode, Ruthie Johnson, Nicholas Ho, Megan Gibbs, Megan Gibbs, Alexander Gusev, Bino John, Marinka Zitnik
机构
*
Harvard Medical School(哈佛医学院)
;
Harvard College(哈佛学院)
;
AstraZeneca(阿斯利康)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Dana-Farber Cancer Institute and Harvard Medical School(达纳-法伯癌症研究所和哈佛医学院)
;
Harvard University(哈佛大学)
;
Broad Institute of MIT and Harvard(MIT和哈佛大学 Broad研究所)
;
Harvard Data Science Initiative(哈佛数据科学计划)
Joint Flow Trajectory Optimization For Feasible Robot Motion Generation from Video Demonstrations
Xiaoxiang Dong, Matthew Johnson-Roberson, Weiming Zhi
机构
*
College of Connected Computing, Vanderbilt University(连接计算学院,范德比尔特大学)
;
Robotics Institute, Carnegie Mellon University(机器人研究所,卡内基梅隆大学)
;
School of Computer Science, The University of Sydney(计算机科学学院,悉尼大学)