arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11692 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11692 篇

2511.07628 2025-11-12 stat.OT 87%

Beyond Correctness: Evaluating and Improving LLM Feedback in Statistical Education

Niklas Ippisch, Markus Herklotz, Anna-Carolina Haensch, Carsten Schwemmer

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22531 2025-10-28 cs.CL cs.AI cs.LG 87%

Text to Trust: Evaluating Fine-Tuning and LoRA Trade-offs in Language Models for Unfair Terms of Service Detection

Noshitha Padma Pratyusha Juttu, Sahithi Singireddy, Sravani Gona, Sujal Timilsina

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 6 pages, including figures and tables. All experiments are reproducible. Code and fine-tuned models are publicly available on: GitHub: (https://github.com/Stimils02/UnfairTOSAgreementsDetection) and Hugging Face: (https://huggingface.co/Noshitha98)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17692 2025-10-17 cs.CL cs.AI cs.LG 87%

MIO: A Foundation Model on Multimodal Tokens

Zekun Wang, King Zhu, Chunpu Xu, Wangchunshu Zhou, Jiaheng Liu, Yibo Zhang, Jiashuo Wang, Ning Shi, Siyu Li, Yizhi Li, Haoran Que, Zhaoxiang Zhang, Yuanxing Zhang, Ge Zhang, Ke Xu, Jie Fu, Wenhao Huang

机构 * Beihang University(北航) M-A-P The Hong Kong Polytechnic University(香港理工大学) AIWaves University of Alberta(阿尔伯塔大学) University of Waterloo(滑铁卢大学) University of Manchester(曼彻斯特大学) Chinese Academy of Sciences(中国科学院) Peking University(北京大学) Shanghai AI Lab(上海AI实验室) Nanjing University(南京大学) Kuaishou Technology(快手科技)

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 (Oral). Codes and models are available in https://github.com/MIO-Team/MIO

Journal ref EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00032 2025-10-02 eess.SP cs.AI cs.CL cs.LG q-bio.NC 87%

WaveMind: Towards a Conversational EEG Foundation Model Aligned to Textual and Visual Modalities

Ziyi Zeng, Zhenyang Cai, Yixi Cai, Xidong Wang, Junying Chen, Rongsheng Wang, Yipeng Liu, Siqi Cai, Benyou Wang, Zhiguo Zhang, Haizhou Li

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 指令微调 :foundation model(title);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24923 2025-09-30 cs.LG cs.AI cs.CL 87%

When Greedy Wins: Emergent Exploitation Bias in Meta-Bandit LLM Training

Sanxing Chen, Xiaoyin Chen, Yukun Huang, Roy Xie, Bhuwan Dhingra

机构 * Duke University(杜克大学) Mila - Québec AI Institute(魁北克AI研究所) Université de Montréal(蒙特利尔大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07270 2025-09-25 cs.SE 87%

Automated Repair of Ambiguous Problem Descriptions for LLM-Based Code Generation

Haoxiang Jia, Robbie Morris, He Ye, Federica Sarro, Sergey Mechtaev

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12136 2025-09-16 cs.DC 87%

UniPar: A Unified LLM-Based Framework for Parallel and Accelerated Code Translation in HPC

Tomer Bitan, Tal Kadosh, Erel Kaplan, Shira Meiri, Le Chen, Peter Morales, Niranjan Hasabnis, Gal Oren

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to IEEE HPEC conference 2025. 9 pages, incl references

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10032 2025-09-09 cs.CV 87%

Osprey: Pixel Understanding with Visual Instruction Tuning

Yuqian Yuan, Wentong Li, Jian Liu, Dongqi Tang, Xinjie Luo, Chi Qin, Lei Zhang, Jianke Zhu

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Microsoft(微软) The HongKong Polytechnical University(香港理工大学)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments CVPR2024, Code and Demo link:https://github.com/CircleRadon/Osprey

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16100 2025-08-25 cs.CL cs.AI cs.LG 87%

CYCLE-INSTRUCT: Fully Seed-Free Instruction Tuning via Dual Self-Training and Cycle Consistency

Zhanming Shen, Hao Chen, Yulei Tang, Shaolin Zhu, Wentao Ye, Xiaomeng Hu, Haobo Wang, Gang Chen, Junbo Zhao

机构 * Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) Tianjin University(天津大学)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15606 2025-07-29 cs.LG cs.AI cs.CL 87%

LoX: Low-Rank Extrapolation Robustifies LLM Safety Against Fine-tuning

Gabriel J. Perin, Runjin Chen, Xuxi Chen, Nina S. T. Hirata, Zhangyang Wang, Junyuan Hong

机构 * University of São Paulo(圣保罗大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07817 2025-07-16 cs.CL cs.AI cs.LG 87%

On the Effect of Instruction Tuning Loss on Generalization

Anwoy Chatterjee, H S V N S Kowndinya Renduchintala, Sumit Bhatia, Tanmoy Chakraborty

机构 * Dept. of Electrical Engineering(电气工程系) Indian Institute of Technology Delhi(印度理工学院德里) Media and Data Science Research(媒体与数据科学研究) Adobe Inc., India(Adobe公司,印度)

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

Comments To appear in Transactions of the Association for Computational Linguistics (TACL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02579 2025-07-10 cs.CL cs.AI cs.LG 87%

EMORL: Ensemble Multi-Objective Reinforcement Learning for Efficient and Flexible LLM Fine-Tuning

Lingxiao Kong, Cong Yang, Susanne Neufang, Oya Deniz Beyan, Zeyd Boukhers

机构 * Fraunhofer Institute for Applied Information Technology(弗劳恩霍夫应用信息技术研究所) Soochow University(苏州大学) University Hospital of Cologne(科隆大学医院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, 9 figures, accepted by the SIGDIAL 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15833 2025-06-23 cs.IR 87%

Architecture is All You Need: Improving LLM Recommenders by Dropping the Text

Kevin Foley, Shaghayegh Agah, Kavya Priyanka Kakinada

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13938 2025-06-10 cs.LG cs.AI cs.CL cs.HC 87%

Never Start from Scratch: Expediting On-Device LLM Personalization via Explainable Model Selection

Haoming Wang, Boyuan Yang, Xiangyu Yin, Wei Gao

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 15 pages

Journal ref in Proceedings of the 23rd ACM International Conference on Mobile Systems, Applications, and Services (MobiSys), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21109 2025-05-28 cs.CL cs.AI cs.CE cs.IR cs.LG 87%

A Lightweight Multi-Expert Generative Language Model System for Engineering Information and Knowledge Extraction

Bogdan Bogachov, Yaoyao Fiona Zhao

机构 * McGill University, Montreal, QC, Canada(麦吉尔大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);small language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 4 Figures, 6 Tables. This paper has been accepted to be published in the proceedings of IDETC-CIE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02539 2025-05-27 cs.CV cs.AI cs.CL cs.LG 87%

Parrot: Multilingual Visual Instruction Tuning

Hai-Long Sun, Da-Wei Zhou, Yang Li, Shiyin Lu, Chao Yi, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang, De-Chuan Zhan, Han-Jia Ye

专题命中 指令微调 :instruction tuning(title);large language model(abstract);language model(abstract);SFT(abstract)

Comments Accepted to ICML 2025. Code and dataset are available at: https://github.com/AIDC-AI/Parrot

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17496 2025-05-26 cs.CL cs.AI cs.LG cs.SD eess.AS 87%

Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models

Chi-Yuan Hsiao, Ke-Han Lu, Kai-Wei Chang, Chih-Kai Yang, Wei-Chih Chen, Hung-yi Lee

机构 * National Taiwan University(国立台湾大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16410 2025-05-23 cs.CL cs.AI cs.LG 87%

Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning

Guanting Dong, Yifei Chen, Xiaoxi Li, Jiajie Jin, Hongjin Qian, Yutao Zhu, Hangyu Mao, Guorui Zhou, Zhicheng Dou, Ji-Rong Wen

机构 * Renmin University of China(中国人民大学) BAAI(北京人工智能研究院) Kuaishou Technology(快手科技)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

Comments Working in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07377 2025-05-13 cs.IR 87%

Process-Supervised LLM Recommenders via Flow-guided Tuning

Chongming Gao, Mengyao Gao, Chenxiao Fan, Shuai Yuan, Wentao Shi, Xiangnan He

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Accepted by SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16030 2025-04-23 cs.CV 87%

LiveCC: Learning Video LLM with Streaming Speech Transcription at Scale

Joya Chen, Ziyun Zeng, Yiqi Lin, Wei Li, Zejun Ma, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室) ByteDance(字节跳动)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments CVPR 2025. If any references are missing, please contact joyachen@u.nus.edu

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12879 2025-04-17 cs.CL cs.AI cs.LG 87%

Large Visual-Language Models Are Also Good Classifiers: A Study of In-Context Multimodal Fake News Detection

Ye Jiang, Yimin Wang

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Withdraw for new experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10160 2025-04-15 cs.CL cs.AI cs.LG 87%

MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning

Zhaopeng Feng, Shaosheng Cao, Jiahan Ren, Jiayuan Su, Ruizhe Chen, Yan Zhang, Zhe Xu, Yao Hu, Jian Wu, Zuozhu Liu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in progress. Our code is available at https://github.com/fzp0424/MT-R1-Zero

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24354 2025-04-10 cs.LG cs.AI cs.CL cs.CV 87%

ORAL: Prompting Your Large-Scale LoRAs via Conditional Recurrent Diffusion

Rana Muhammad Shahroz Khan, Dongwen Tang, Pingzhi Li, Kai Wang, Tianlong Chen

专题命中 指令微调 :prompting(title);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05491 2025-04-09 cs.CV 87%

REEF: Relevance-Aware and Efficient LLM Adapter for Video Understanding

Sakib Reza, Xiyun Song, Heather Yu, Zongfang Lin, Mohsen Moghaddam, Octavia Camps

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Accepted at CVPRW'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24307 2025-04-01 cs.CL cs.AI cs.IR cs.LG 87%

A Systematic Evaluation of LLM Strategies for Mental Health Text Analysis: Fine-tuning vs. Prompt Engineering vs. RAG

Arshia Kermani, Veronica Perez-Rosas, Vangelis Metsis

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09906 2025-03-04 cs.CL cs.AI cs.LG 87%

Generative Representational Instruction Tuning

Niklas Muennighoff, Hongjin Su, Liang Wang, Nan Yang, Furu Wei, Tao Yu, Amanpreet Singh, Douwe Kiela

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 67 pages (16 main), 25 figures, 34 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09369 2025-02-14 cs.LG cs.AI cs.CL cs.CY 87%

Language Agents as Digital Representatives in Collective Decision-Making

Daniel Jarrett, Miruna Pîslar, Michiel A. Bakker, Michael Henry Tessler, Raphael Köster, Jan Balaguer, Romuald Elie, Christopher Summerfield, Andrea Tacchetti

专题命中 指令微调 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04997 2025-02-10 cs.CL cs.AI cs.LG 87%

Aligning Black-box Language Models with Human Judgments

Gerrit J. J. van den Burg, Gen Suzuki, Wei Liu, Murat Sensoy

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted for publication at NAACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01116 2025-02-04 cs.AI cs.CL cs.LG 87%

Picky LLMs and Unreliable RMs: An Empirical Study on Safety Alignment after Instruction Tuning

Guanlin Li, Kangjie Chen, Shangwei Guo, Jie Zhang, Han Qiu, Chao Zhang, Guoyin Wang, Tianwei Zhang, Jiwei Li

专题命中 指令微调 :instruction tuning(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17186 2025-01-31 cs.AI cs.CL cs.LG 87%

Complete Chess Games Enable LLM Become A Chess Master

Yinqi Zhang, Xintian Han, Haolong Li, Kedi Chen, Shaohui Lin

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏