机构
*
Xidian University, Xi'an, China(西安电子科技大学)
;
Harbin Institute of Technology, Harbin, China(哈尔滨工业大学)
;
National University of Singapore,Singapore(新加坡国立大学)
How Sampling Shapes LLM Alignment: From One-Shot Optima to Iterative Dynamics
采样如何塑造大语言模型对齐:从单次最优到迭代动态
Yurong Chen, Yu He, Michael I. Jordan, Fan Yao
机构
*
Inria(法国国家信息与自动化研究所)
;
École Normale Supérieure(巴黎高等师范学校)
;
PSL Research University(巴黎综合理工研究所)
;
Northwestern University(西北大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
Mitigating Mismatch within Reference-based Preference Optimization
缓解基于参考的偏好优化中的不匹配
Suqin Yuan, Xingrui Yu, Jiyang Zheng, Lei Feng, Dadong Wang, Ivor Tsang, Tongliang Liu
机构
*
Sydney AI Centre, The University of Sydney(悉尼人工智能中心,悉尼大学)
;
CFAR, A*STAR(CFAR,A*STAR)
;
CSIRO, Data61(CSIRO,Data61)
;
Southeast University(东南大学)
;
Nanyang Technological University(南洋理工大学)
Alternating Reinforcement Learning for Rubric-Based Reward Modeling in Non-Verifiable LLM Post-Training
交替强化学习用于非可验证大语言模型后训练的评分标准建模
Ran Xu, Tianci Liu, Zihan Dong, Tony Yu, Ilgee Hong, Carl Yang, Linjun Zhang, Tao Zhao, Haoyu Wang
机构
*
Emory University(埃默里大学)
;
Purdue University(普渡大学)
;
Rutgers University(罗格斯大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
University at Albany(阿尔巴尼大学)
Mohsen Fayyaz, Ali Modarressi, Hanieh Deilamsalehy, Franck Dernoncourt, Ryan Rossi, Trung Bui, Hinrich Schütze, Nanyun Peng
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
Adobe Research(Adobe研究)
;
CIS, LMU Munich(慕尼黑大学计算机学院)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
Explaining AI Without Code: A User Study on Explainable AI
无需代码解释AI:可解释AI的用户研究
Natalia Abarca, Andrés Carvallo, Claudia López Moncada, Felipe Bravo-Marquez
机构
*
Department of Computer Science, University of Chile(智利大学计算机科学系)
;
CENIA – National Center for Artificial Intelligence(人工智能国家研究中心)
;
Universidad Técnica Federico Santa María(弗朗西斯科·桑塔玛利亚技术大学)
;
IMFD - Millennium Institute for Foundational Research on Data(数据基础研究千年研究所)