TPO: Aligning Large Language Models with Multi-branch & Multi-step Preference Trees
Weibin Liao, Xu Chu, Yasha Wang
机构
*
School of Computer Science, Peking University(北京大学计算机科学系)
;
Center on Frontiers of Computing Studies, Peking University(北京大学前沿计算研究中心)
;
National Research and Engineering Center of Software Engineering, Peking University(北京大学软件工程研究中心)
专题命中
后训练与偏好优化
:large language model(title,abstract);language model(title,abstract);preference optimization(abstract);分类 cs.CL、cs.AI
机构
*
Guangdong Lab of AI and Digital Economy (SZ), China(广东人工智能与数字经济实验室(深圳))
;
College of Computer Science and Software Engineering, Shenzhen University, China(深圳大学计算机科学与软件工程学院)
;
Hong Kong University of Science and Technology (Guangzhou), China(香港科技大学(广州))
;
Tencent, Shenzhen, China(腾讯(深圳))
;
School of Information Technology, Carleton University, Canada(卡尔顿大学信息技术学院)
专题命中
后训练与偏好优化
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Evaluating and Improving Cultural Awareness of Reward Models for LLM Alignment
Hongbin Zhang, Kehai Chen, Xuefeng Bai, Yang Xiang, Min Zhang
机构
*
Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(计算与智能研究所,哈尔滨工业大学,深圳,中国)
;
Peng Cheng Laboratory, Shenzhen, China(鹏城实验室,深圳,中国)
专题命中
后训练与偏好优化
:LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Scalable Valuation of Human Feedback through Provably Robust Model Alignment
Masahiro Fujisawa, Masaki Adachi, Michael A. Osborne
机构
*
The University of Osaka(大阪大学)
;
Lattice Lab, Toyota Motor Corporation(丰田公司Lattice实验室)
;
Machine Learning Research Group, University of Oxford(牛津大学机器学习研究组)
;
RIKEN AIP(理化学研究所AIP)