arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4541 信号源:cs.CL, cs.AI, cs.LG

1. 后训练与偏好优化 4541 篇

2405.14758 2024-11-08 cs.GT cs.AI cs.LG 62%

Axioms for AI Alignment from Human Feedback

Luise Ge, Daniel Halpern, Evi Micha, Ariel D. Procaccia, Itai Shapira, Yevgeniy Vorobeychik, Junlin Wu

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01205 2024-11-05 cs.CL cs.AI 62%

PRIMO: Progressive Induction for Multi-hop Open Rule Generation

Jianyu Liu, Sheng Bi, Guilin Qi

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.AI

Comments COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21345 2024-10-30 q-bio.GN cs.AI cs.LG 62%

Absorb & Escape: Overcoming Single Model Limitations in Generating Genomic Sequences

Zehui Li, Yuhao Ni, Guoxuan Xia, William Beardall, Akashaditya Das, Guy-Bart Stan, Yiren Zhao

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.AI、cs.LG

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16415 2024-10-23 cs.LG cs.AI 62%

On conditional diffusion models for PDE simulations

Aliaksandra Shysheya, Cristiana Diaconu, Federico Bergamin, Paris Perdikaris, José Miguel Hernández-Lobato, Richard E. Turner, Emile Mathieu

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.AI、cs.LG

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16807 2024-10-18 cs.LG cs.CL cs.CV 62%

Beyond Thumbs Up/Down: Untangling Challenges of Fine-Grained Feedback for Text-to-Image Generation

Katherine M. Collins, Najoung Kim, Yonatan Bitton, Verena Rieser, Shayegan Omidshafiei, Yushi Hu, Sherol Chen, Senjuti Dutta, Minsuk Chang, Kimin Lee, Youwei Liang, Georgina Evans, Sahil Singla, Gang Li, Adrian Weller, Junfeng He, Deepak Ramachandran, Krishnamurthy Dj Dvijotham

专题命中 后训练与偏好优化 :prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16025 2024-10-16 cs.LG cs.AI 62%

Exploring and Addressing Reward Confusion in Offline Preference Learning

Xin Chen, Sam Toyer, Florian Shkurti

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.AI、cs.LG

Comments NeurIPS2024 Workshop on Bayesian Decision-making and Uncertainty

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12421 2024-10-16 cs.LG cs.AI stat.ML 62%

A Unified Linear Programming Framework for Offline Reward Learning from Human Demonstrations and Feedback

Kihyun Kim, Jiawei Zhang, Asuman Ozdaglar, Pablo A. Parrilo

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.AI、cs.LG

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08289 2024-10-14 cs.CL cs.AI 62%

Increasing the Difficulty of Automatically Generated Questions via Reinforcement Learning with Synthetic Preference

William Thorne, Ambrose Robinson, Bohua Peng, Chenghua Lin, Diana Maynard

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI

Comments is to be published in NLP4DH 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13004 2024-10-14 cs.LG cs.AI 62%

Can Differentiable Decision Trees Enable Interpretable Reward Learning from Human Feedback?

Akansha Kalra, Daniel S. Brown

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05345 2024-10-10 cs.LG cs.AI cs.CV 62%

Trained Models Tell Us How to Make Them Robust to Spurious Correlation without Group Annotation

Mahdi Ghaznavi, Hesam Asadollahzadeh, Fahimeh Hosseini Noohdani, Soroush Vafaie Tabar, Hosein Hasani, Taha Akbari Alvanagh, Mohammad Hossein Rohban, Mahdieh Soleymani Baghshah

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04503 2024-10-08 cs.CL cs.AI 62%

LRHP: Learning Representations for Human Preferences via Preference Pairs

Chenglong Wang, Yang Gan, Yifu Huo, Yongyu Mu, Qiaozhi He, Murun Yang, Tong Xiao, Chunliang Zhang, Tongran Liu, Jingbo Zhu

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03780 2024-10-08 cs.CL cs.LG 62%

Reward-RAG: Enhancing RAG with Reward Driven Supervision

Thang Nguyen, Peter Chin, Yu-Wing Tai

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00858 2024-09-06 cs.RO cs.AI cs.HC cs.LG 62%

Trustworthy Human-AI Collaboration: Reinforcement Learning with Human Feedback and Physics Knowledge for Safe Autonomous Driving

Zilin Huang, Zihao Sheng, Sikai Chen

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.AI、cs.LG

Comments 33 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10759 2024-07-16 eess.AS cs.CL cs.LG 62%

Qwen2-Audio Technical Report

Yunfei Chu, Jin Xu, Qian Yang, Haojie Wei, Xipin Wei, Zhifang Guo, Yichong Leng, Yuanjun Lv, Jinzheng He, Junyang Lin, Chang Zhou, Jingren Zhou

专题命中 后训练与偏好优化 :language model(abstract);分类 cs.CL、cs.LG

Comments https://github.com/QwenLM/Qwen2-Audio. Checkpoints, codes and scripts will be opensoursed soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09499 2024-07-16 cs.CV cs.AI cs.LG stat.ML 62%

Self-Consuming Generative Models with Curated Data Provably Optimize Human Preferences

Damien Ferbach, Quentin Bertrand, Avishek Joey Bose, Gauthier Gidel

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02446 2024-07-03 cs.CL cs.AI 62%

Predicting vs. Acting: A Trade-off Between World Modeling & Agent Modeling

Margaret Li, Weijia Shi, Artidoro Pagnoni, Peter West, Ari Holtzman

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15508 2024-06-25 q-fin.CP cs.AI cs.LG cs.RO 62%

What Teaches Robots to Walk, Teaches Them to Trade too -- Regime Adaptive Execution using Informed Data and LLMs

Raeid Saqur

专题命中 后训练与偏好优化 :LLM(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: substantial text overlap with arXiv:2405.09747

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03997 2024-06-07 cs.AI cs.LG 62%

HackAtari: Atari Learning Environments for Robust and Continual Reinforcement Learning

Quentin Delfosse, Jannis Blüml, Bjarne Gregori, Kristian Kersting

专题命中 后训练与偏好优化 :LLM(abstract);分类 cs.AI、cs.LG

Comments 9 main pages, 4 pages references, 19 pages of appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18729 2024-05-30 cs.LG cs.AI 62%

Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning

Tianle Zhang, Jiayi Guan, Lin Zhao, Yihang Li, Dongjiang Li, Zecui Zeng, Lei Sun, Yue Chen, Xuelong Wei, Lusong Li, Xiaodong He

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13026 2024-05-24 cs.CL cs.AI 62%

Leveraging Human Revisions for Improving Text-to-Layout Models

Amber Xie, Chin-Yi Cheng, Forrest Huang, Yang Li

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08828 2024-04-16 cs.LG cs.AI cs.HC 62%

Hindsight PRIORs for Reward Learning from Human Preferences

Mudit Verma, Katherine Metcalf

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.AI、cs.LG

Comments International Conference on Learning Representations, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08714 2024-03-29 cs.LG cs.AI 62%

PRDP: Proximal Reward Difference Prediction for Large-Scale Reward Finetuning of Diffusion Models

Fei Deng, Qifei Wang, Wei Wei, Matthias Grundmann, Tingbo Hou

专题命中 后训练与偏好优化 :foundation model(abstract);分类 cs.AI、cs.LG

Comments CVPR 2024. Project page: https://fdeng18.github.io/prdp

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08265 2024-03-15 cs.LG cs.AI cs.NE 62%

Random Search as a Baseline for Sparse Neural Network Architecture Search

Rezsa Farahani

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05006 2024-03-11 cs.LG cs.AI stat.ME stat.ML 62%

Provable Multi-Party Reinforcement Learning with Diverse Human Feedback

Huiying Zhong, Zhun Deng, Weijie J. Su, Zhiwei Steven Wu, Linjun Zhang

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.08774 2024-03-11 cs.CL cs.AI 62%

GPT-4 Technical Report

OpenAI, Josh Achiam, Steven Adler, Sandhini Agarwal, Lama Ahmad, Ilge Akkaya, Florencia Leoni Aleman, Diogo Almeida, Janko Altenschmidt, Sam Altman, Shyamal Anadkat, Red Avila, Igor Babuschkin, Suchir Balaji, Valerie Balcom, Paul Baltescu, Haiming Bao, Mohammad Bavarian, Jeff Belgum, Irwan Bello, Jake Berdine, Gabriel Bernadett-Shapiro, Christopher Berner, Lenny Bogdonoff, Oleg Boiko, Madelaine Boyd, Anna-Luisa Brakman, Greg Brockman, Tim Brooks, Miles Brundage, Kevin Button, Trevor Cai, Rosie Campbell, Andrew Cann, Brittany Carey, Chelsea Carlson, Rory Carmichael, Brooke Chan, Che Chang, Fotis Chantzis, Derek Chen, Sully Chen, Ruby Chen, Jason Chen, Mark Chen, Ben Chess, Chester Cho, Casey Chu, Hyung Won Chung, Dave Cummings, Jeremiah Currier, Yunxing Dai, Cory Decareaux, Thomas Degry, Noah Deutsch, Damien Deville, Arka Dhar, David Dohan, Steve Dowling, Sheila Dunning, Adrien Ecoffet, Atty Eleti, Tyna Eloundou, David Farhi, Liam Fedus, Niko Felix, Simón Posada Fishman, Juston Forte, Isabella Fulford, Leo Gao, Elie Georges, Christian Gibson, Vik Goel, Tarun Gogineni, Gabriel Goh, Rapha Gontijo-Lopes, Jonathan Gordon, Morgan Grafstein, Scott Gray, Ryan Greene, Joshua Gross, Shixiang Shane Gu, Yufei Guo, Chris Hallacy, Jesse Han, Jeff Harris, Yuchen He, Mike Heaton, Johannes Heidecke, Chris Hesse, Alan Hickey, Wade Hickey, Peter Hoeschele, Brandon Houghton, Kenny Hsu, Shengli Hu, Xin Hu, Joost Huizinga, Shantanu Jain, Shawn Jain, Joanne Jang, Angela Jiang, Roger Jiang, Haozhun Jin, Denny Jin, Shino Jomoto, Billie Jonn, Heewoo Jun, Tomer Kaftan, Łukasz Kaiser, Ali Kamali, Ingmar Kanitscheider, Nitish Shirish Keskar, Tabarak Khan, Logan Kilpatrick, Jong Wook Kim, Christina Kim, Yongjik Kim, Jan Hendrik Kirchner, Jamie Kiros, Matt Knight, Daniel Kokotajlo, Łukasz Kondraciuk, Andrew Kondrich, Aris Konstantinidis, Kyle Kosic, Gretchen Krueger, Vishal Kuo, Michael Lampe, Ikai Lan, Teddy Lee, Jan Leike, Jade Leung, Daniel Levy, Chak Ming Li, Rachel Lim, Molly Lin, Stephanie Lin, Mateusz Litwin, Theresa Lopez, Ryan Lowe, Patricia Lue, Anna Makanju, Kim Malfacini, Sam Manning, Todor Markov, Yaniv Markovski, Bianca Martin, Katie Mayer, Andrew Mayne, Bob McGrew, Scott Mayer McKinney, Christine McLeavey, Paul McMillan, Jake McNeil, David Medina, Aalok Mehta, Jacob Menick, Luke Metz, Andrey Mishchenko, Pamela Mishkin, Vinnie Monaco, Evan Morikawa, Daniel Mossing, Tong Mu, Mira Murati, Oleg Murk, David Mély, Ashvin Nair, Reiichiro Nakano, Rajeev Nayak, Arvind Neelakantan, Richard Ngo, Hyeonwoo Noh, Long Ouyang, Cullen O'Keefe, Jakub Pachocki, Alex Paino, Joe Palermo, Ashley Pantuliano, Giambattista Parascandolo, Joel Parish, Emy Parparita, Alex Passos, Mikhail Pavlov, Andrew Peng, Adam Perelman, Filipe de Avila Belbute Peres, Michael Petrov, Henrique Ponde de Oliveira Pinto, Michael, Pokorny, Michelle Pokrass, Vitchyr H. Pong, Tolly Powell, Alethea Power, Boris Power, Elizabeth Proehl, Raul Puri, Alec Radford, Jack Rae, Aditya Ramesh, Cameron Raymond, Francis Real, Kendra Rimbach, Carl Ross, Bob Rotsted, Henri Roussez, Nick Ryder, Mario Saltarelli, Ted Sanders, Shibani Santurkar, Girish Sastry, Heather Schmidt, David Schnurr, John Schulman, Daniel Selsam, Kyla Sheppard, Toki Sherbakov, Jessica Shieh, Sarah Shoker, Pranav Shyam, Szymon Sidor, Eric Sigler, Maddie Simens, Jordan Sitkin, Katarina Slama, Ian Sohl, Benjamin Sokolowsky, Yang Song, Natalie Staudacher, Felipe Petroski Such, Natalie Summers, Ilya Sutskever, Jie Tang, Nikolas Tezak, Madeleine B. Thompson, Phil Tillet, Amin Tootoonchian, Elizabeth Tseng, Preston Tuggle, Nick Turley, Jerry Tworek, Juan Felipe Cerón Uribe, Andrea Vallone, Arun Vijayvergiya, Chelsea Voss, Carroll Wainwright, Justin Jay Wang, Alvin Wang, Ben Wang, Jonathan Ward, Jason Wei, CJ Weinmann, Akila Welihinda, Peter Welinder, Jiayi Weng, Lilian Weng, Matt Wiethoff, Dave Willner, Clemens Winter, Samuel Wolrich, Hannah Wong, Lauren Workman, Sherwin Wu, Jeff Wu, Michael Wu, Kai Xiao, Tao Xu, Sarah Yoo, Kevin Yu, Qiming Yuan, Wojciech Zaremba, Rowan Zellers, Chong Zhang, Marvin Zhang, Shengjia Zhao, Tianhao Zheng, Juntang Zhuang, William Zhuk, Barret Zoph

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.CL、cs.AI

Comments 100 pages; updated authors list; fixed author names and added citation

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06666 2024-02-13 physics.ao-ph cs.AI cs.LG 62%

Weather Prediction with Diffusion Guided by Realistic Forecast Processes

Zhanxiang Hua, Yutong He, Chengqian Ma, Alexandra Anderson-Frey

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.11270 2024-02-09 cs.LG cs.AI cs.HC math.ST stat.ML stat.TH 62%

Principled Reinforcement Learning with Human Feedback from Pairwise or $K$-wise Comparisons

Banghua Zhu, Jiantao Jiao, Michael I. Jordan

专题命中 后训练与偏好优化 :RLHF(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09438 2024-02-08 cs.LG cs.CL cs.HC cs.IR 62%

Labeled Interactive Topic Models

Kyle Seelman, Mozhi Zhang, Jordan Boyd-Graber

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01614 2024-02-05 cs.LG cs.AI cs.SI stat.ML 62%

L2G2G: a Scalable Local-to-Global Network Embedding with Graph Autoencoders

Ruikang Ouyang, Andrew Elliott, Stratis Limnios, Mihai Cucuringu, Gesine Reinert

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 4 figures, Complex Networks 2023, Volume I, SCI 1141

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17972 2024-02-01 cs.CV cs.AI cs.LG 62%

MelNet: A Real-Time Deep Learning Algorithm for Object Detection

Yashar Azadvatan, Murat Kurt

专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏