RePIC: Reinforced Post-Training for Personalizing Multi-Modal Language Models
专题命中 后训练与偏好优化 :language model(title,abstract);post-training(title,abstract);large language model(abstract);SFT(abstract)
Comments Accepted to NeurIPS 2025
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 后训练与偏好优化 :language model(title,abstract);post-training(title,abstract);large language model(abstract);SFT(abstract)
Comments Accepted to NeurIPS 2025
机构 * Global Technical Service (GTS) Huawei Technologies Co., Ltd(华为技术有限公司全球技术服务部)
专题命中 后训练与偏好优化 :post-training(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG
机构 * National Engineering Research Center of Speech and Language Information Processing, University of Science and Technology of China(语音与语言信息处理国家工程研究中心,中国科学技术大学) ; State Key Laboratory of Cognitive Intelligence, iFLYTEK Research(认知智能国家重点实验室,iFLYTEK研究院)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL
机构 * Snap Research ; University of Toronto(多伦多大学) ; Vector Institute(向量研究所)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);language model(abstract);post-training(abstract)
Comments NeurIPS 2025 Spotlight. Project page: https://snap-research.github.io/DenseDPO/
机构 * University of Washington(华盛顿大学) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments Preprint under review
机构 * Huazhong University of Science and Technology(华中科技大学) ; Singapore Management University(新加坡管理学院)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);分类 cs.AI、cs.LG
机构 * College of Medicine, Seoul National University, Seoul, Republic of Korea(首尔国立大学医学院) ; Department of Radiology, Seoul National University Hospital(首尔国立大学医院放射科) ; Department of Biomedical Sciences, Seoul National University(首尔国立大学生物医学科学系)
专题命中 后训练与偏好优化 :post-training(title,abstract)
Comments MICCAI 2025, Lecture Notes in Computer Science Vol. 15961
Journal ref Med Image Comput Comput Assist Interv. LNCS 15961, 282-291, Springer, 2026
专题命中 后训练与偏好优化 :LLM(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG
机构 * Meta Superintelligence Labs(Meta超智能实验室) ; New York University(纽约大学)
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);分类 cs.LG