Positive Alignment: Artificial Intelligence for Human Flourishing
积极对齐:人工智能促进人类繁荣
Ruben Laukkonen, Seb Krier, Chloé Bakalar, Shamil Chandaria, Morten Kringelbach, Adam Elwood, Daniel Ford, Fernando Rosas, Maty Bohacek, Matija Franklin, Nenad Tomašev, Stephanie Chan, Verena Rieser, Roma Patel, Michael Levin, Arun Rao
机构
*
Department of Psychiatry, University of Oxford(牛津大学精神病学系)
;
Flourishing Intelligence Program, Centre for Eudaimonia and Human Flourishing, Linacre College, University of Oxford(牛津大学幸福智能计划、幸福与人类繁荣中心、林acre学院)
;
Google DeepMind(谷歌DeepMind)
;
LIFE
;
OpenAI
;
Anthropic
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Aily Labs(Aily实验室)
;
Stanford University(斯坦福大学)
;
Tufts University(塔夫茨大学)
;
Positive AI Labs(积极AI实验室)
;
Department of Informatics, University of Sussex(Sussex大学信息学系)
;
Department of Brain Sciences, Imperial College London(伦敦帝国理工学院脑科学系)
CommentsProceedings of the 39th Annual Conference on Neural Information Processing Systems, ARLET Workshop (Aligning Reinforcement Learning Experimentalists and Theorists)
Journal refTransactions on Machine Learning Research, Vol. 2026, June 2026
Task-Induced Representational Invariances Depend on Learning Objective in Deep RL
任务诱导的表征不变性依赖于深度强化学习中的学习目标
Manu Srinath Halvagal, Sebastian Lee, SueYeon Chung
机构
*
Department of Physics, Harvard University(哈佛大学物理系)
;
Kempner Institute, Harvard University(哈佛大学凯普纳研究所)
;
Center for Computational Neuroscience, Flatiron Institute(Flatiron研究所计算神经科学中心)
From Fragments to Facts: A Curriculum-Driven DPO Approach for Generating Hindi News Veracity Explanations
从碎片到事实:一种课程驱动的DPO方法用于生成印地语新闻真实性解释
Pulkit Bansal, Raghvendra Kumar, Shakti Singh, Adam Jatowt, Sriparna Saha
机构
*
TCS Research(TCS研究)
;
Department of Computer Science and Engineering, Indian Institute of Technology Patna(印度理工学院帕纳布计算机科学与工程系)
;
Indian Institute of Technology Patna(印度理工学院帕纳布)
;
University of Innsbruck(因斯布鲁克大学)
Mining or Synthesis? Rethinking Exploration Efficiency in Iterative Alignment of Mathematical Reasoning
挖掘还是合成?重新思考数学推理迭代对齐中的探索效率
Jun Rao, Zixiong Yu, Xuebo Liu, Guhan Chen, Jing Li, Hejin Wang, Jiansheng Wei, Xiaojun Meng, Min Zhang
机构
*
Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳研究院)
;
Huawei Large Model Data Technology Lab(华为大模型数据技术实验室)
;
Huawei Multimodal Model Lab(华为多模态模型实验室)
;
Department of Statistics and Data Science, Tsinghua University, Beijing, China(清华大学统计与数据科学系)
专题命中
后训练与偏好优化
:large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL
机构
*
University of Science and Technology of China(中国科学技术大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
The Chinese University of Hong Kong(香港中文大学)
;
Xiaohongshu Inc.(小红书公司)
专题命中
后训练与偏好优化
:large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
Northwestern University(西北大学)
;
University of North Carolina, Chapel Hill(北卡罗来纳大学教堂山分校)
;
University of Pittsburgh(匹兹堡大学)
专题命中
后训练与偏好优化
:large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI
Enhancing Table Reasoning with Deterministic Table-State Rewards
通过确定性表格状态奖励增强表格推理
Tung Sum Thomas Kwok, Xinyu Wang, Hengzhi He, Xiaofeng Lin, Peng Lu, Liheng Ma, Chunhe Wang, Chun Ho Mak, Yuyu Luo, Ying Nian Wu, Lei Ding, Guang Cheng
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
McGill University(麦吉尔大学)
;
Université de Montréal(蒙特利尔大学)
;
University College London(伦敦大学学院)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
University of Manitoba(曼尼托巴大学)
专题命中
后训练与偏好优化
:large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI