Dopamine Audiobook: A Training-free MLLM Agent for Emotional and Immersive Audiobook Generation
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)
Comments 27 pages, 15 figures
机构 * CASIA(中国科学院自动化研究所) ; BAAI(阿里巴巴人工智能研究院) ; THU(清华大学) ; HKISI(香港理工大学)
专题命中 后训练与偏好优化 :language model(abstract);post-training(abstract)
Comments technical report
机构 * Fudan University(复旦大学) ; Bilibili Inc(哔哩哔哩公司)
专题命中 后训练与偏好优化 :language model(abstract);preference optimization(abstract)
Comments 10 pages, 7 figures, 7 tables
机构 * Skywork AI(Skywork人工智能公司) ; Kunlun Inc.(昆仑公司)
专题命中 后训练与偏好优化 :language model(abstract);preference optimization(abstract)
专题命中 后训练与偏好优化 :pretraining(abstract);preference optimization(abstract)
Comments Accepted by ACL 2025
机构 * École polytechnique(巴黎政治学院) ; Sapienza University of Rome(罗马大学) ; University of Milano-Bicocca(米兰-布雷拉大学) ; The University of Texas at Austin(德克萨斯大学奥斯汀分校)
专题命中 后训练与偏好优化 :foundation model(abstract);post-training(abstract)
Comments CVPR 2025
机构 * Graduate School of Data Science, Seoul National University(数据科学研究生院,首尔国立大学)
专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG
Comments This paper has been accepted for publication at ACL 2025
专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments This manuscript builds upon an earlier version posted to TechRxiv. This arXiv version includes an updated comparison with GRPO (Group Relative Policy Optimization)
机构 * National Taiwan University(台湾大学)
专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to ACL 2025 main
专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 16 pages, 6 figures, 10 tables. Website: https://m-rewardbench.github.io/ , Updated results with latest models. Added more author information
专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to ACL 2025
机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) ; Samsung R&D Institute China–Beijing(三星中国北京研发中心) ; Beijing Academy of Artificial Intelligence(北京人工智能研究院)
专题命中 后训练与偏好优化 :language model(abstract);preference optimization(abstract)
专题命中 后训练与偏好优化 :language model(abstract);RLHF(abstract)
Comments 18 pages, 19 figures
专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG
Comments CVPR 2025 Camera-ready. Project page: https://silmm.github.io/
专题命中 后训练与偏好优化 :post-training(abstract);preference optimization(abstract)
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)
Comments Project Page: https://opendatalab.github.io/LEGION
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)
专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to ICLR 2025; 28 pages, 3 figures
专题命中 后训练与偏好优化 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted at ICLR2025 Spotlight
专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Published at EMNLP 2024 as long (findings) conference paper
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)
Comments 33 pages, 8 figures
专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)
Comments Accepted for the Conference on Robot Learning (CoRL) 2024. Available at: https://openreview.net/forum?id=s0VNSnPeoA
专题命中 后训练与偏好优化 :language model(abstract);post-training(abstract)
Comments Accepted to NLP for Wikipedia Workshop at EMNLP '24
专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Work in progress
专题命中 后训练与偏好优化 :RLHF(abstract);preference optimization(abstract)
Comments 18 pages, 10 figures
专题命中 后训练与偏好优化 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 10 pages, 3 figures, 2 tables
专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI、cs.LG