arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-28 至 2025-08-28 共收录 148 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 10 篇

2411.13868 2025-08-28 stat.ME cs.CL cs.LG math.ST stat.ML stat.TH 90%

Robust Detection of Watermarks for Large Language Models Under Human Edits

Xiang Li, Feng Ruan, Huiyuan Wang, Qi Long, Weijie J. Su

机构 * University of Pennsylvania(宾夕法尼亚大学) Northwestern University(西北大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments To appear in Journal of the Royal Statistical Society: Series B

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12551 2025-08-28 cs.CR cs.AI 89%

MEraser: An Effective Fingerprint Erasure Approach for Large Language Models

Jingxuan Zhang, Zhenhua Xu, Rui Hu, Wenpeng Xing, Xuhong Zhang, Meng Han

机构 * Zhejiang University(浙江大学) Indiana University(印第安纳大学) Hangzhou City University(杭州市大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted by ACL 2025, Main Conference, Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19428 2025-08-28 cs.CL cs.LO cs.SC 88%

Heterogeneous LLM Methods for Ontology Learning (Few-Shot Prompting, Ensemble Typing, and Attention-Based Taxonomies)

Aleksandra Beliaeva, Temurbek Rahmatullaev

机构 * Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究院) BIMAI-Lab, Biomedically Informed Artificial Intelligence Laboratory, University of Sharjah(沙迦大学生物医学引导人工智能实验室) Ivannikov Institute for System Programming of the Russian Academy of Sciences(俄罗斯科学院伊万诺夫系统编程研究所) Lomonosov Moscow State University(莫斯科罗蒙诺索夫莫斯科大学) AIRI Institute(AIRI研究所)

专题命中 预训练与数据 :LLM(title,abstract);prompting(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02089 2025-08-28 cs.LG physics.ao-ph 83%

GPTCast: a weather language model for precipitation nowcasting

Gabriele Franch, Elena Tomasi, Rishabh Wanjari, Virginia Poli, Chiara Cardinali, Pier Paolo Alberoni, Marco Cristoforetti

机构 * Fondazione Bruno Kessler(布鲁诺·凯塞勒基金会) Arpae Emilia-Romagna(艾米利亚-罗马涅阿帕斯研究所)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.LG

Comments 20 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18648 2025-08-28 cs.CL 77%

Thinking Before You Speak: A Proactive Test-time Scaling Approach

Cong Liu, Wenchang Chai, Hejun Wu, Yan Pan, Pengxu Wei, Liang Lin

机构 * Sun Yat-sen University(中山大学) Hong Kong Polytechnic University(香港理工大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Journal ref EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19570 2025-08-28 cs.LG cs.AI 73%

Generative Models for Synthetic Data: Transforming Data Mining in the GenAI Era

Dawei Li, Yue Huang, Ming Li, Tianyi Zhou, Xiangliang Zhang, Huan Liu

机构 * Arizona State University(亚利桑那州立大学) University of Notre Dame(圣母大学) University of Maryland(马里兰大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by CIKM 2025 Tutorial

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19924 2025-08-28 cs.LG 57%

FlowletFormer: Network Behavioral Semantic Aware Pre-training Model for Traffic Classification

Liming Liu, Ruoyu Li, Qing Li, Meijia Hou, Yong Jiang, Mingwei Xu

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19873 2025-08-28 cs.CL 57%

Beyond Shallow Heuristics: Leveraging Human Intuition for Curriculum Learning

Vanessa Toborek, Sebastian Müller, Tim Selbach, Tamás Horváth, Christian Bauckhage

机构 * University of Bonn(波恩大学) Lamarr Institute(拉马尔研究所) Fraunhofer IAIS(弗劳恩霍夫研究所)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL

Comments Presented at ICNLSP 2025; to appear in the ACL Anthology; received the Best Short Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19807 2025-08-28 cs.DB cs.AI 57%

Bootstrapping Learned Cost Models with Synthetic SQL Queries

Michael Nidd, Christoph Miksovic, Thomas Gschwind, Francesco Fusco, Andrea Giovannini, Ioana Giurgiu

专题命中 预训练与数据 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19596 2025-08-28 cs.AI cs.IR 57%

Reference-Aligned Retrieval-Augmented Question Answering over Heterogeneous Proprietary Documents

Nayoung Choi, Grace Byun, Andrew Chung, Ellie S. Paek, Shinsun Lee, Jinho D. Choi

机构 * Department of Computer Science Emory University Atlanta Georgia USA(计算机科学系 埃默里大学 阿拉巴马 州 美国) Emory University(埃默里大学)

专题命中 预训练与数据 :LLM(abstract);分类 cs.AI

Comments Accepted to CIKM 2025 Applied Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 17 篇

2502.11779 2025-08-28 cs.CL 90%

Efficient Response Generation Strategy Selection for Fine-Tuning Large Language Models Through Self-Aligned Perplexity

Xuan Ren, Qi Chen, Lingqiao Liu

机构 * University of Adelaide(阿德莱德大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19376 2025-08-28 cs.LG cs.AI cs.CV hep-ex 84%

Fine-Tuning Vision-Language Models for Neutrino Event Analysis in High-Energy Physics Experiments

Dikshant Sagar, Kaiwen Yu, Alejandro Yankelevich, Jianming Bian, Pierre Baldi

机构 * Department of Computer Science University of California, Irvine(计算机科学系加州大学伊文斯顿分校)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13575 2025-08-28 cs.LG cs.AI 84%

Apple Intelligence Foundation Language Models: Tech Report 2025

Ethan Li, Anders Boesen Lindbo Larsen, Chen Zhang, Xiyou Zhou, Jun Qin, Dian Ang Yap, Narendran Raghavan, Xuankai Chang, Margit Bowler, Eray Yildiz, John Peebles, Hannah Gillis Coleman, Matteo Ronchi, Peter Gray, Keen You, Anthony Spalvieri-Kruse, Ruoming Pang, Reed Li, Yuli Yang, Emad Soroush, Zhiyun Lu, Crystal Xiao, Rong Situ, Jordan Huffaker, David Griffiths, Zaid Ahmed, Peng Zhang, Daniel Parilla, Asaf Liberman, Jennifer Mallalieu, Parsa Mazaheri, Qibin Chen, Manjot Bilkhu, Aonan Zhang, Eric Wang, Dave Nelson, Michael FitzMaurice, Thomas Voice, Jeremy Liu, Josh Shaffer, Shiwen Zhao, Prasanth Yadla, Farzin Rasteh, Pengsheng Guo, Arsalan Farooq, Jeremy Snow, Stephen Murphy, Tao Lei, Minsik Cho, George Horrell, Sam Dodge, Lindsay Hislop, Sumeet Singh, Alex Dombrowski, Aiswarya Raghavan, Sasha Sirovica, Mandana Saebi, Faye Lao, Max Lam, TJ Lu, Zhaoyang Xu, Karanjeet Singh, Marc Kirchner, David Mizrahi, Rajat Arora, Haotian Zhang, Henry Mason, Lawrence Zhou, Yi Hua, Ankur Jain, Felix Bai, Joseph Astrauskas, Floris Weers, Josh Gardner, Mira Chiang, Yi Zhang, Pulkit Agrawal, Tony Sun, Quentin Keunebroek, Matthew Hopkins, Bugu Wu, Tao Jia, Chen Chen, Xingyu Zhou, Nanzhu Wang, Peng Liu, Ruixuan Hou, Rene Rauch, Yuan Gao, Afshin Dehghan, Jonathan Janke, Zirui Wang, Cha Chen, Xiaoyi Ren, Feng Nan, Josh Elman, Dong Yin, Yusuf Goren, Jeff Lai, Yiran Fei, Syd Evans, Muyang Yu, Guoli Yin, Yi Qin, Erin Feldman, Isha Garg, Aparna Rajamani, Karla Vega, Walker Cheng, TJ Collins, Hans Han, Raul Rea Menacho, Simon Yeung, Sophy Lee, Phani Mutyala, Ying-Chang Cheng, Zhe Gan, Sprite Chu, Justin Lazarow, Alessandro Pappalardo, Federico Scozzafava, Jing Lu, Erik Daxberger, Laurent Duchesne, Jen Liu, David Güera, Stefano Ligas, Mary Beth Kery, Brent Ramerth, Ciro Sannino, Marcin Eichner, Haoshuo Huang, Rui Qian, Moritz Schwarzer-Becker, David Riazati, Mingfei Gao, Bailin Wang, Jack Cackler, Yang Lu, Ransen Niu, John Dennison, Guillaume Klein, Jeffrey Bigham, Deepak Gopinath, Navid Shiee, Darren Botten, Guillaume Tartavel, Alex Guillen Garcia, Sam Xu, Victoria MönchJuan Haladjian, Zi-Yi Dou, Matthias Paulik, Adolfo Lopez Mendez, Zhen Li, Hong-You Chen, Chao Jia, Dhaval Doshi, Zhengdong Zhang, Raunak Manjani, Aaron Franklin, Zhile Ren, David Chen, Artsiom Peshko, Nandhitha Raghuram, Hans Hao, Jiulong Shan, Kavya Nerella, Ramsey Tantawi, Vivek Kumar, Saiwen Wang, Brycen Wershing, Bhuwan Dhingra, Dhruti Shah, Ob Adaranijo, Xin Zheng, Tait Madsen, Hadas Kotek, Chang Liu, Yin Xia, Hanli Li, Suma Jayaram, Yanchao Sun, Ahmed Fakhry, Vasileios Saveris, Dustin Withers, Yanghao Li, Alp Aygar, Andres Romero Mier Y Teran, Kaiwei Huang, Mark Lee, Xiujun Li, Yuhong Li, Tyler Johnson, Jay Tang, Joseph Yitan Cheng, Futang Peng, Andrew Walkingshaw, Lucas Guibert, Abhishek Sharma, Cheng Shen, Piotr Maj, Yasutaka Tanaka, You-Cyuan Jhang, Vivian Ma, Tommi Vehvilainen, Kelvin Zou, Jeff Nichols, Matthew Lei, David Qiu, Yihao Qian, Gokul Santhanam, Wentao Wu, Yena Han, Dominik Moritz, Haijing Fu, Mingze Xu, Vivek Rathod, Jian Liu, Louis D'hauwe, Qin Ba, Haitian Sun, Haoran Yan, Philipp Dufter, Anh Nguyen, Yihao Feng, Emma Wang, Keyu He, Rahul Nair, Sanskruti Shah, Jiarui Lu, Patrick Sonnenberg, Jeremy Warner, Yuanzhi Li, Bowen Pan, Ziyi Zhong, Joe Zhou, Sam Davarnia, Olli Saarikivi, Irina Belousova, Rachel Burger, Shang-Chen Wu, Di Feng, Bas Straathof, James Chou, Yuanyang Zhang, Marco Zuliani, Eduardo Jimenez, Abhishek Sundararajan, Xianzhi Du, Chang Lan, Nilesh Shahdadpuri, Peter Grasch, Sergiu Sima, Josh Newnham, Varsha Paidi, Jianyu Wang, Kaelen Haag, Alex Braunstein, Daniele Molinari, Richard Wei, Brenda Yang, Nicholas Lusskin, Joanna Arreaza-Taylor, Meng Cao, Nicholas Seidl, Simon Wang, Jiaming Hu, Yiping Ma, Mengyu Li, Kieran Liu, Hang Su, Sachin Ravi, Chong Wang, Xin Wang, Kevin Smith, Haoxuan You, Binazir Karimzadeh, Rui Li, Jinhao Lei, Wei Fang, Alec Doane, Sam Wiseman, Ismael Fernandez, Jane Li, Andrew Hansen, Javier Movellan, Christopher Neubauer, Hanzhi Zhou, Chris Chaney, Nazir Kamaldin, Valentin Wolf, Fernando Bermúdez-Medina, Joris Pelemans, Peter Fu, Howard Xing, Xiang Kong, Wayne Shan, Gabriel Jacoby-Cooper, Dongcai Shen, Tom Gunter, Guillaume Seguin, Fangping Shi, Shiyu Li, Yang Xu, Areeba Kamal, Dan Masi, Saptarshi Guha, Qi Zhu, Jenna Thibodeau, Changyuan Zhang, Rebecca Callahan, Charles Maalouf, Wilson Tsao, Boyue Li, Qingqing Cao, Naomy Sabo, Cheng Leong, Yi Wang, Anupama Mann Anupama, Colorado Reed, Kenneth Jung, Zhifeng Chen, Mohana Prasad Sathya Moorthy, Yifei He, Erik Hornberger, Devi Krishna, Senyu Tong, Michael, Lee, David Haldimann, Yang Zhao, Bowen Zhang, Chang Gao, Chris Bartels, Sushma Rao, Nathalie Tran, Simon Lehnerer, Co Giang, Patrick Dong, Junting Pan, Biyao Wang, Dongxu Li, Mehrdad Farajtabar, Dongseong Hwang, Grace Duanmu, Eshan Verma, Sujeeth Reddy, Qi Shan, Hongbin Gao, Nan Du, Pragnya Sridhar, Forrest Huang, Yingbo Wang, Nikhil Bhendawade, Diane Zhu, Sai Aitharaju, Fred Hohman, Lauren Gardiner, Chung-Cheng Chiu, Yinfei Yang, Alper Kokmen, Frank Chu, Ke Ye, Kaan Elgin, Oron Levy, John Park, Donald Zhang, Eldon Schoop, Nina Wenzel, Michael Booker, Hyunjik Kim, Chinguun Erdenebileg, Nan Dun, Eric Liang Yang, Priyal Chhatrapati, Vishaal Mahtani, Haiming Gang, Kohen Chia, Deepa Seshadri, Donghan Yu, Yan Meng, Kelsey Peterson, Zhen Yang, Yongqiang Wang, Carina Peng, Doug Kang, Anuva Agarwal, Albert Antony, Juan Lao Tebar, Albin Madappally Jose, Regan Poston, Andy De Wang, Gerard Casamayor, Elmira Amirloo, Violet Yao, Wojciech Kryscinski, Kun Duan, Lezhi L

机构 * Apple Intelligence Foundation(苹果智能基金会)

专题命中 指令微调 :language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19279 2025-08-28 cs.CL cs.AI 84%

FLAIRR-TS -- Forecasting LLM-Agents with Iterative Refinement and Retrieval for Time Series

Gunjan Jalori, Preetika Verma, Sercan Ö Arık

专题命中 指令微调 :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments EMNLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11195 2025-08-28 cs.LG cs.CR cs.CV 83%

R-TPT: Improving Adversarial Robustness of Vision-Language Models through Test-Time Prompt Tuning

Lijun Sheng, Jian Liang, Zilei Wang, Ran He

机构 * University of Science and Technology of China(中国科学技术大学) NLPR & MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :language model(title,abstract);foundation model(abstract);分类 cs.LG

Comments CVPR 2025 (Corrected the results on the Aircraft dataset)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19481 2025-08-28 cs.CL cs.AI 82%

Improving Low-Resource Translation with Dictionary-Guided Fine-Tuning and RL: A Spanish-to-Wayuunaiki Study

Manuel Mosquera, Melissa Robles, Johan Rodriguez, Ruben Manrique

机构 * Universidad de los Andes(洛斯安第斯大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19609 2025-08-28 cs.LG cs.AI q-fin.CP 81%

FinCast: A Foundation Model for Financial Time-Series Forecasting

Zhuohang Zhu, Haodong Chen, Qiang Qu, Vera Chung

机构 * School of Computer Science(计算机科学系) The University of Sydney(悉尼大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19274 2025-08-28 cs.CL 79%

Leveraging Language Models and Machine Learning in Verbal Autopsy Analysis

Yue Chu

机构 * Department of Sociology(社会学系)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL

Comments Ph.D. dissertation submitted to The Ohio State University, August 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19359 2025-08-28 cs.CL cs.AI 79%

Reflective Agreement: Combining Self-Mixture of Agents with a Sequence Tagger for Robust Event Extraction

Fatemeh Haji, Mazal Bethany, Cho-Yu Jason Chiang, Anthony Rios, Peyman Najafirad

机构 * Secure AI and Autonomy Lab, University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校安全人工智能与自主性实验室) Peraton Labs(佩拉顿实验室) University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15349 2025-08-28 cs.LG cs.AI cs.DC 79%

Scaling Decentralized Learning with FLock

Zehua Cheng, Rui Sun, Jiahao Sun, Yike Guo

机构 * Department of Computer Science, University of Oxford, Oxford, UK Newcastle University, UK Hong Kong University of Science HongKong Generative AI Research \& Development Center, Hong Kong SAR

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19746 2025-08-28 cs.CV 78%

SPLF-SAM: Self-Prompting Segment Anything Model for Light Field Salient Object Detection

Qiyao Xu, Qiming Wu, Xiaowei Li

机构 * College of Electronic Engineering and Information(电子工程与信息学院) Sichuan University(四川大学) Chengdu, China(中国成都)

专题命中 指令微调 :prompting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18634 2025-08-28 cs.CV 75%

OwlCap: Harmonizing Motion-Detail for Video Captioning via HMD-270K and Caption Set Equivalence Reward

Chunlin Zhong, Qiuxia Hou, Zhangjun Zhou, Shuang Hao, Haonan Lu, Yanhao Zhang, He Tang, Xiang Bai

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract)

Comments 9 pages, 6figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22402 2025-08-28 cs.CL 70%

Refining Czech GEC: Insights from a Multi-Experiment Approach

Petr Pechman, Milan Straka, Jana Straková, Jakub Náplava

机构 * Charles University(查尔斯大学) Faculty of Mathematics and Physics(数学与物理学院) Institute of Formal and Applied Linguistics(形式与应用语言学研究所)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to TSD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20015 2025-08-28 cs.LG cs.AI 62%

Decomposing Behavioral Phase Transitions in LLMs: Order Parameters for Emergent Misalignment

Julian Arnold, Niels Lörch

机构 * Department of Physics University of Basel(物理系 巴塞尔大学)

专题命中 指令微调 :LLM(abstract);分类 cs.AI、cs.LG

Comments 11+25 pages, 4+11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19846 2025-08-28 hep-th 50%

Selected topics in string field theory

Georg Stettinger

专题命中 指令微调 :SFT(abstract)

Comments PhD-thesis, 147 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19639 2025-08-28 cs.MM 50%

FakeSV-VLM: Taming VLM for Detecting Fake Short-Video News via Progressive Mixture-Of-Experts Adapter

Junxi Wang, Yaxiong Wang, Lechao Cheng, Zhun Zhong

专题命中 指令微调 :language model(abstract)

Comments EMNLP2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08441 2025-08-28 cs.CV 50%

Latent space configuration for improved generalization in supervised autoencoder neural networks

Nikita Gabdullin

机构 * Joint Stock "Research and production company "Kryptonite"(Research and production company Kryptonite)

专题命中 指令微调 :language model(abstract)

Comments 19 pages,18 figures, 2 tables, 15 equations

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 4 篇

2505.03233 2025-08-28 cs.RO 82%

GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data

Shengliang Deng, Mi Yan, Songlin Wei, Haixin Ma, Yuxin Yang, Jiayi Chen, Zhiqi Zhang, Taoyu Yang, Xuheng Zhang, Wenhao Zhang, Heming Cui, Zhizheng Zhang, He Wang

专题命中 后训练与偏好优化 :foundation model(title,abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19532 2025-08-28 cs.CL 77%

Alignment with Fill-In-the-Middle for Enhancing Code Generation

Houxing Ren, Zimu Lu, Weikang Shi, Haotian Hou, Yunqiao Yang, Ke Wang, Aojun Zhou, Junting Pan, Mingjie Zhan, Hongsheng Li

机构 * CUHK MMLab(CUHK语音实验室) SenseTime Research(商汤科技研究院) CPII under InnoHK(创新香港下的CPII) Shanghai AI Laboratory(上海人工智能实验室) Beihang University(北航)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 (main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19567 2025-08-28 cs.LG 70%

Counterfactual Reward Model Training for Bias Mitigation in Multimodal Reinforcement Learning

Sheryl Mathew, N Harshit

专题命中 后训练与偏好优化 :language model(abstract);RLHF(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏