Comments22 pages, 14 figures, 10 tables. https://github.com/GT-STAR-Lab/JaxRobotarium. Manuscript accepted for publication at the 9th Conference on Robot Learning (CoRL 2025), Seoul, Korea
The Path Not Taken: RLVR Provably Learns Off the Principals
Hanqing Zhu, Zhenyu Zhang, Hanxian Huang, DiJia Su, Zechun Liu, Jiawei Zhao, Igor Fedorov, Hamed Pirsiavash, Zhizhou Sha, Jinwon Lee, David Z. Pan, Zhangyang Wang, Yuandong Tian, Kai Sheng Tai
机构
*
Meta AI
;
The University of Texas at Austin(德克萨斯大学奥斯汀分校)
专题命中
AI治理与伦理
:alignment(abstract);分类 cs.AI、cs.LG
CommentsPreliminary version accepted as a spotlight in NeurIPS 2025 Workshop on Efficient Reasoning
From Semantics, Scene to Instance-awareness: Distilling Foundation Model for Grounded Open-vocabulary Situation Recognition
Chen Cai, Tianyi Liu, Jianjun Gao, Wenyang Liu, Kejun Wu, Ruoyu Wang, Yi Wang, Soo Chin Liew
机构
*
National University of Singapore(新加坡国立大学)
;
Nanyang Technological University(南洋理工大学)
;
Huazhong University of Science and Technology(华中科技大学)
;
The Hong Kong Polytechnic University(香港理工大学)
Hierarchical Structure-Property Alignment for Data-Efficient Molecular Generation and Editing
Ziyu Fan, Zhijian Huang, Yahan Li, Xiaowen Hu, Siyuan Shen, Yunliang Wang, Zeyu Zhong, Shuhong Liu, Shuning Yang, Shangqian Wu, Min Wu, Lei Deng
机构
*
School of Computer Science and Engineering(计算机科学与工程学院)
;
Central South University(中南大学)
;
Institute for Infocomm Research Agency for Science, Technology and Research (A* STAR)(信息通信研究所(A* STAR))
Misaligned by Design: Incentive Failures in Machine Learning
David Autor, Andrew Caplin, Daniel Martin, Philip Marx
机构
*
Massachusetts Institute of Technology, Google Technology and Society Fellows program, and NBER(麻省理工学院、谷歌技术与社会 fellows 程序及国家经济研究局)
;
New York University and NBER(纽约大学及国家经济研究局)
;
University of California, Santa Barbara(加州大学圣塔芭芭拉分校)
;
Louisiana State University(路易斯安那州立大学)