A Variational Framework for LLM Generator-Regulator Games
大语言模型生成器-调节器博弈的变分框架
Quanyan Zhu
机构
*
Department of Electrical and Computer Engineering, Tandon School of Engineering, New York University, Brooklyn, NY, USA(电气工程系,工程学院,纽约大学,布鲁克林,纽约,美国)
RadSEM: A Finding-by-Finding Metric for Clinical Consistency in Radiology Reports
RadSEM:放射学报告中临床一致性的逐发现指标
Zhenhong Yang, Zhuoyun Liu, Jintao Fei, Wen Tang, Shichao Quan, Jun Zhao, Jun Xu
机构
*
JDH Algo, JD Health International Inc., China
;
Department of Big Data in Health Science, The First Affiliated Hospital of Wenzhou Medical University, China
;
Zhejiang Engineering Research Center for Hospital Emergency
;
Department of Intensive Care Unit, The First Affiliated Hospital of Wenzhou Medical University, Wenzhou, Zhejiang, China
Reinforcing Dual-Path Reasoning in Spatial Vision Language Models
空间视觉语言模型中的双路径推理强化
Yatai Ji, An-Chieh Cheng, Yang Fu, Yukang Chen, Han Zhang, Zhaojing Yang, Wei Huang, Ka Chun Cheung, Song Han, Vidya Nariyambut Murali, Pavlo Molchanov, Jan Kautz, Simon See, Hongxu Yin, Ping Luo, Sifei Liu
机构
*
The University of Hong Kong(香港大学)
;
NVIDIA(英伟达)
;
University of California, San Diego(加州大学圣迭戈分校)
机构
*
Qwen Large Model Application Team, Alibaba(阿里巴巴通义千问大模型应用团队)
;
Renmin University of China(中国人民大学)
;
Peking University(北京大学)
;
ETH Zürich(苏黎世联邦理工学院)
;
University of Zurich(苏黎世大学)
;
The Chinese University of Hong Kong(香港中文大学)
Individual Control Barrier Functions-Guided Diffusion Model for Safe Offline Multi-Agent Reinforcement Learning
个体控制障碍函数引导的扩散模型用于安全离线多智能体强化学习
Qingyun Guo, Junyi Shi, Jianuo Huang, Tianyu Shi
机构
*
Department of Electrical Engineering and Automation, Aalto University(阿尔托大学电气工程与自动化系)
;
School of Computing and Data Science, Xiamen University Malaysia(厦门大学马来西亚分校计算与数据科学学院)
;
Department of Computer Science, University of Toronto(多伦多大学计算机科学系)
机构
*
Beijing Key Laboratory of Security and Privacy in Intelligent Transportation, Beijing Jiaotong University(北京交通大学智能交通信息安全与隐私保护北京市重点实验室)
;
College of Computer Science and Technology, Taiyuan University of Technology(太原理工大学计算机科学与技术学院)
;
Institute of Computing Technologies, China Academy of Railway Sciences Corporation Limited(中国铁道科学研究院集团有限公司计算技术研究所)
Teaching the Way, Not the Answer: Privileged Tutoring Distillation for Multimodal Policy Optimization
教方法而非答案:用于多模态策略优化的特权辅导蒸馏
Shizhe Xiang, Ke An, Wenlong Yu, Yue Liu, Jian Luan, Pei Fu, Qilong Wang
机构
*
Tianjin University(天津大学)
;
Beijing Institute of Technology(北京理工大学)
;
Singapore Management University(新加坡国立大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Xiaomi Inc(小米公司)