arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4535 信号源:cs.CL, cs.AI, cs.LG

1. 后训练与偏好优化 4535 篇

2504.11002 2025-08-13 cs.SD cs.MM eess.AS 67%

Dopamine Audiobook: A Training-free MLLM Agent for Emotional and Immersive Audiobook Generation

Yan Rong, Shan Yang, Chenxing Li, Dong Yu, Li Liu

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08220 2025-08-12 cs.CV 67%

Learning User Preferences for Image Generation Model

Wenyi Mo, Ying Ba, Tianyu Zhang, Yalong Bai, Biye Li

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06924 2025-08-12 cs.CV 67%

AR-GRPO: Training Autoregressive Image Generation Models via Reinforcement Learning

Shihao Yuan, Yahui Liu, Yang Yue, Jingyuan Zhang, Wangmeng Zuo, Qi Wang, Fuzheng Zhang, Guorui Zhou

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

Comments 27 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19850 2025-06-25 cs.CV cs.RO 67%

Unified Vision-Language-Action Model

Yuqi Wang, Xinghang Li, Wenxuan Wang, Junbo Zhang, Yingyan Li, Yuntao Chen, Xinlong Wang, Zhaoxiang Zhang

机构 * CASIA(中国科学院自动化研究所) BAAI(阿里巴巴人工智能研究院) THU(清华大学) HKISI(香港理工大学)

专题命中 后训练与偏好优化 :language model(abstract);post-training(abstract)

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10044 2025-06-25 cs.CV 67%

Aligning Anime Video Generation with Human Feedback

Bingwen Zhu, Yudong Jiang, Baohan Xu, Siqian Yang, Mingyu Yin, Yidi Wu, Huyang Sun, Zuxuan Wu

机构 * Fudan University(复旦大学) Bilibili Inc(哔哩哔哩公司)

专题命中 后训练与偏好优化 :language model(abstract);preference optimization(abstract)

Comments 10 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07263 2025-06-10 cs.CV 67%

Skywork-VL Reward: An Effective Reward Model for Multimodal Understanding and Reasoning

Xiaokun Wang, Peiyu Wang, Jiangbo Pei, Wei Shen, Yi Peng, Yunzhuo Hao, Weijie Qiu, Ai Jian, Tianyidan Xie, Xuchen Song, Yang Liu, Yahui Zhou

机构 * Skywork AI(Skywork人工智能公司) Kunlun Inc.(昆仑公司)

专题命中 后训练与偏好优化 :language model(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04113 2025-06-09 cs.SD eess.AS 67%

Advancing Zero-shot Text-to-Speech Intelligibility across Diverse Domains via Preference Alignment

Xueyao Zhang, Yuancheng Wang, Chaoren Wang, Ziniu Li, Zhuo Chen, Zhizheng Wu

专题命中 后训练与偏好优化 :pretraining(abstract);preference optimization(abstract)

Comments Accepted by ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05283 2025-06-05 cs.CV 67%

Escaping Plato's Cave: Towards the Alignment of 3D and Text Latent Spaces

Souhail Hadgi, Luca Moschella, Andrea Santilli, Diego Gomez, Qixing Huang, Emanuele Rodolà, Simone Melzi, Maks Ovsjanikov

机构 * École polytechnique(巴黎政治学院) Sapienza University of Rome(罗马大学) University of Milano-Bicocca(米兰-布雷拉大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 后训练与偏好优化 :foundation model(abstract);post-training(abstract)

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13125 2025-06-03 cs.CL cs.AI cs.LG 67%

Generating Plausible Distractors for Multiple-Choice Questions via Student Choice Prediction

Yooseop Lee, Suin Kim, Yohan Jo

机构 * Graduate School of Data Science, Seoul National University(数据科学研究生院,首尔国立大学)

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This paper has been accepted for publication at ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17714 2025-05-26 cs.LG cs.AI cs.CL 67%

PPO-BR: Dual-Signal Entropy-Reward Adaptation for Trust Region Policy Optimization

Ben Rahman

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This manuscript builds upon an earlier version posted to TechRxiv. This arXiv version includes an updated comparison with GRPO (Group Relative Policy Optimization)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13487 2025-05-23 cs.CL cs.AI cs.CV cs.LG 67%

Transferring Textual Preferences to Vision-Language Understanding through Model Merging

Chen-An Li, Tzu-Han Lin, Yun-Nung Chen, Hung-yi Lee

机构 * National Taiwan University(台湾大学)

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ACL 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15522 2025-05-21 cs.CL cs.AI cs.LG 67%

M-RewardBench: Evaluating Reward Models in Multilingual Settings

Srishti Gureja, Lester James V. Miranda, Shayekh Bin Islam, Rishabh Maheshwary, Drishti Sharma, Gusti Winata, Nathan Lambert, Sebastian Ruder, Sara Hooker, Marzieh Fadaee

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 16 pages, 6 figures, 10 tables. Website: https://m-rewardbench.github.io/ , Updated results with latest models. Added more author information

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12763 2025-05-20 cs.LG cs.AI cs.CL 67%

Rethinking Reward Model Evaluation Through the Lens of Reward Overoptimization

Sunghwan Kim, Dongjin Kang, Taeyoon Kwon, Hyungjoo Chae, Dongha Lee, Jinyoung Yeo

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09577 2025-05-15 cs.RO 67%

VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation

Chaofan Zhang, Peng Hao, Xiaoge Cao, Xiaoshuai Hao, Shaowei Cui, Shuo Wang

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) Samsung R&D Institute China–Beijing(三星中国北京研发中心) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 后训练与偏好优化 :language model(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19440 2025-04-29 cs.CR 67%

JailbreaksOverTime: Detecting Jailbreak Attacks Under Distribution Shift

Julien Piet, Xiao Huang, Dennis Jacob, Annabella Chow, Maha Alrashed, Geng Zhao, Zhanhao Hu, Chawin Sitawarin, Basel Alomair, David Wagner

专题命中 后训练与偏好优化 :language model(abstract);RLHF(abstract)

Comments 18 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05818 2025-03-26 cs.CV cs.AI cs.CL cs.LG cs.MM 67%

SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation

Leigang Qu, Haochuan Li, Wenjie Wang, Xiang Liu, Juncheng Li, Liqiang Nie, Tat-Seng Chua

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG

Comments CVPR 2025 Camera-ready. Project page: https://silmm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18455 2025-03-25 cs.SE 67%

SEAlign: Alignment Training for Software Engineering Agent

Kechi Zhang, Huangzhao Zhang, Ge Li, Jinliang You, Jia Li, Yunfei Zhao, Zhi Jin

专题命中 后训练与偏好优化 :post-training(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15264 2025-03-20 cs.CV 67%

LEGION: Learning to Ground and Explain for Synthetic Image Detection

Hengrui Kang, Siwei Wen, Zichen Wen, Junyan Ye, Weijia Li, Peilin Feng, Baichuan Zhou, Bin Wang, Dahua Lin, Linfeng Zhang, Conghui He

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

Comments Project Page: https://opendatalab.github.io/LEGION

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08276 2025-03-12 cs.CV 67%

PromptLNet: Region-Adaptive Aesthetic Enhancement via Prompt Guidance in Low-Light Enhancement Net

Jun Yin, Yangfan He, Miao Zhang, Pengyu Zeng, Tianyi Wang, Shuai Lu, Xueqian Wang

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01257 2025-03-07 cs.LG cs.AI cs.CL 67%

HelpSteer2-Preference: Complementing Ratings with Preferences

Zhilin Wang, Alexander Bukharin, Olivier Delalleau, Daniel Egert, Gerald Shen, Jiaqi Zeng, Oleksii Kuchaiev, Yi Dong

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ICLR 2025; 28 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18407 2025-02-26 cs.CL cs.AI cs.LG 67%

AgentRM: Enhancing Agent Generalization with Reward Modeling

Yu Xia, Jingru Fan, Weize Chen, Siyu Yan, Xin Cong, Zhong Zhang, Yaxi Lu, Yankai Lin, Zhiyuan Liu, Maosong Sun

专题命中 后训练与偏好优化 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05584 2025-02-17 cs.LG cs.AI cs.CL 67%

Rethinking Reward Model Evaluation: Are We Barking up the Wrong Tree?

Xueru Wen, Jie Lou, Yaojie Lu, Hongyu Lin, Xing Yu, Xinyu Lu, Ben He, Xianpei Han, Debing Zhang, Le Sun

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ICLR2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07230 2024-11-11 cs.CL cs.AI cs.LG 67%

Curry-DPO: Enhancing Alignment using Curriculum Learning & Ranked Preferences

Pulkit Pattnaik, Rishabh Maheshwary, Kelechi Ogueji, Vikas Yadav, Sathwik Tejaswi Madhusudhan

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published at EMNLP 2024 as long (findings) conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23243 2024-10-31 cs.GT 67%

Carrot and Stick: Eliciting Comparison Data and Beyond

Yiling Chen, Shi Feng, Fang-Yi Yu

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

Comments 33 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06105 2024-10-21 cs.RO 67%

Text2Interaction: Establishing Safe and Preferable Human-Robot Interaction

Jakob Thumm, Christopher Agia, Marco Pavone, Matthias Althoff

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

Comments Accepted for the Conference on Robot Learning (CoRL) 2024. Available at: https://openreview.net/forum?id=s0VNSnPeoA

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08918 2024-10-14 cs.CY 67%

Wikimedia data for AI: a review of Wikimedia datasets for NLP tasks and AI-assisted editing

Isaac Johnson, Lucie-Aimée Kaffee, Miriam Redi

专题命中 后训练与偏好优化 :language model(abstract);post-training(abstract)

Comments Accepted to NLP for Wikipedia Workshop at EMNLP '24

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01729 2024-10-03 cs.LG cs.AI cs.CL 67%

Evaluating Robustness of Reward Models for Mathematical Reasoning

Sunghwan Kim, Dongjin Kang, Taeyoon Kwon, Hyungjoo Chae, Jungsoo Won, Dongha Lee, Jinyoung Yeo

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19668 2024-07-01 cs.CV 67%

PopAlign: Population-Level Alignment for Fair Text-to-Image Generation

Shufan Li, Harkanwar Singh, Aditya Grover

专题命中 后训练与偏好优化 :RLHF(abstract);preference optimization(abstract)

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11330 2024-04-24 cs.CL cs.AI cs.HC cs.LG 67%

Improving Dialogue Agents by Decomposing One Global Explicit Annotation with Local Implicit Multimodal Feedback

Dong Won Lee, Hae Won Park, Yoon Kim, Cynthia Breazeal, Louis-Philippe Morency

专题命中 后训练与偏好优化 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15028 2024-04-03 cs.CL cs.AI cs.LG 67%

Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding

Jiacheng Liu, Andrew Cohen, Ramakanth Pasunuru, Yejin Choi, Hannaneh Hajishirzi, Asli Celikyilmaz

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏