arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-02 至 2025-10-02 共收录 20 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 20 篇

2509.24866 2025-10-02 cs.CL cs.AI 90%

Metaphor identification using large language models: A comparison of RAG, prompt engineering, and fine-tuning

Matteo Fuoli, Weihang Huang, Jeannette Littlemore, Sarah Turner, Ellen Wilding

机构 * Department of Linguistics and Communication(语言学与传播学系) University of Birmingham(伯明翰大学) Centre for Arts, Memory & Communities(艺术、记忆与社区中心) Coventry University(考文垂大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00268 2025-10-02 cs.CL cs.AI 88%

Efficient Layer-wise LLM Fine-tuning for Revision Intention Prediction

Zhexiong Liu, Diane Litman

机构 * Department of Computer Science, Learning Research & Development Center University of Pittsburgh(计算机科学系、学习研究与开发中心匹兹堡大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments In The Conference on Empirical Methods in Natural Language Processing (EMNLP), November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00032 2025-10-02 eess.SP cs.AI cs.CL cs.LG q-bio.NC 87%

WaveMind: Towards a Conversational EEG Foundation Model Aligned to Textual and Visual Modalities

Ziyi Zeng, Zhenyang Cai, Yixi Cai, Xidong Wang, Junying Chen, Rongsheng Wang, Yipeng Liu, Siqi Cai, Benyou Wang, Zhiguo Zhang, Haizhou Li

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 指令微调 :foundation model(title);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00088 2025-10-02 cs.AI cs.CY 83%

Judging by Appearances? Auditing and Intervening Vision-Language Models for Bail Prediction

Sagnik Basu, Shubham Prakash, Ashish Maruti Barge, Siddharth D Jaiswal, Abhisek Dash, Saptarshi Ghosh, Animesh Mukherjee

机构 * Indian Institute of Technology Kharagpur(印度理工学院Khargapur分校) Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00967 2025-10-02 cs.AI quant-ph 81%

QUASAR: Quantum Assembly Code Generation Using Tool-Augmented LLMs via Agentic RL

Cong Yu, Valter Uotila, Shilong Deng, Qingyuan Wu, Tuo Shi, Songlin Jiang, Lei You, Bo Zhao

机构 * Aalto University(阿alto大学) University of Helsinki(赫尔辛基大学) University of Liverpool(利物浦大学) University of Southampton(南安普顿大学) Technical University of Denmark(丹麦技术大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00237 2025-10-02 cs.LG cs.AI 81%

Debunk the Myth of SFT Generalization

Xiaofeng Lin, Hejian Sang, Zhipeng Wang, Xuezhou Zhang

机构 * Boston University(波士顿大学) LinkedIn

专题命中 指令微调 :SFT(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00543 2025-10-02 cs.CE 75%

Flow of Knowledge: Federated Fine-Tuning of LLMs in Healthcare under Non-IID Conditions

Zeyu Chen, Yun Ji, Bowen Wang, Liwen Shi, Zijie Zeng, Sheng Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11402 2025-10-02 cs.LG cs.AI cs.CL 75%

LoRA Users Beware: A Few Spurious Tokens Can Manipulate Your Finetuned Model

Marcel Mateos Salles, Praney Goyal, Pradyut Sekhsaria, Hai Huang, Randall Balestriero

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 46 pages, 17 figures, 26 tables. Submitted for publication. for associated blog post, see https://pradyut3501.github.io/lora-spur-corr/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05567 2025-10-02 cs.CL cs.AI cs.LG 75%

ATLAS: Autoformalizing Theorems through Lifting, Augmentation, and Synthesis of Data

Xiaoyang Liu, Kangjie Bao, Jiashuo Zhang, Yunqi Liu, Yu Chen, Yuntian Liu, Yang Jiao, Tao Luo

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00662 2025-10-02 cs.CL cs.AI 73%

Facilitating Cognitive Accessibility with LLMs: A Multi-Task Approach to Easy-to-Read Text Generation

François Ledoyen, Gaël Dias, Jeremie Pantin, Alexis Lechervy, Fabrice Maurel, Youssef Chahir

机构 * Université Caen Normandie, ENSICAEN, CNRS, Normandie Univ, GREYC UMR 6072(法国卡恩大学、ENSICAEN、CNRS、诺曼底大学、GREYC UMR 6072) Koena SAS

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00206 2025-10-02 cs.LG cs.AI cs.DC 73%

LoRAFusion: Efficient LoRA Fine-Tuning for LLMs

Zhanda Zhu, Qidong Su, Yaoyao Ding, Kevin Song, Shang Wang, Gennady Pekhimenko

机构 * University of Toronto, Vector Institute, NVIDIA(多伦多大学、向量研究所、NVIDIA)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by EuroSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00263 2025-10-02 cs.CL 70%

Judging with Confidence: Calibrating Autoraters to Preference Distributions

Zhuohang Li, Xiaowei Li, Chengyu Huang, Guowang Li, Katayoon Goshvadi, Bo Dai, Dale Schuurmans, Paul Zhou, Hamid Palangi, Yiwen Song, Palash Goyal, Murat Kantarcioglu, Bradley A. Malin, Yuan Xue

机构 * Google(谷歌) Vanderbilt University(范德比大学) Cornell University(康奈尔大学) DeepMind(深Mind) University of Alberta(阿尔伯塔大学) Virginia Tech(弗吉尼亚理工学院) Scale AI

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10458 2025-10-02 cs.CV cs.CL cs.HC 70%

GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents

Run Luo, Lu Wang, Wanwei He, Longze Chen, Jiaming Li, Xiaobo Xia

机构 * Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) University of Chinese Academy of Sciences(中国科学院大学) National University of Singapore(新加坡国立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12142 2025-10-02 cs.LG cs.CL cs.NA math.DG math.NA 62%

LoRA meets Riemannion: Muon Optimizer for Parametrization-independent Low-Rank Adapters

Vladimir Bogachev, Vladimir Aletov, Alexander Molozhavenko, Denis Bobkov, Vera Soboleva, Aibek Alanov, Maxim Rakhuba

机构 * HSE University(俄罗斯高等经济大学)

专题命中 指令微调 :LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00386 2025-10-02 cs.LG cs.AI stat.ML 62%

Train on Validation (ToV): Fast data selection with applications to fine-tuning

Ayush Jain, Andrea Montanari, Eren Sasoglu

机构 * Granica Computing Inc. — granica.ai(Granica计算公司) Department of Statistics and Department of Mathematics, Stanford University(斯坦福大学统计系和数学系)

专题命中 指令微调 :instruction tuning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00184 2025-10-02 cs.LG cs.AI 62%

Why Can't Transformers Learn Multiplication? Reverse-Engineering Reveals Long-Range Dependency Pitfalls

Xiaoyan Bai, Itamar Pres, Yuntian Deng, Chenhao Tan, Stuart Shieber, Fernanda Viégas, Martin Wattenberg, Andrew Lee

机构 * University of Chicago(芝加哥大学) MIT(麻省理工学院) University of Waterloo(滑铁卢大学) Harvard University(哈佛大学) Google DeepMind(谷歌DeepMind)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17846 2025-10-02 cs.CV cs.LG 57%

Alternating Training-based Label Smoothing Enhances Prompt Generalization

Yang Chen, Yanbin Wei, Ke Jin, Yi Kong, James Kwok, Yu Zhang

机构 * Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) Department of Computer Science and Engineering, Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系) School of Information and Control Engineering, China University of Mining and Technology(中国矿业大学信息与控制工程学院)

专题命中 指令微调 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04979 2025-10-02 cs.LG 57%

Prompt Tuning Decision Transformers with Structured and Scalable Bandits

Finn Rietz, Oleg Smirnov, Sara Karimi, Lele Cao

机构 * Örebro University(奥雷布罗大学) King AI Labs, Microsoft Gaming(King AI实验室,微软游戏)

专题命中 指令微调 :prompting(abstract);分类 cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00406 2025-10-02 cs.RO cs.CV 50%

VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators

Hengtao Li, Pengxiang Ding, Runze Suo, Yihao Wang, Zirui Ge, Dongyuan Zang, Kexian Yu, Mingyang Sun, Hongyin Zhang, Donglin Wang, Weihua Su

机构 * Westlake University(西湖大学) Zhejiang University(浙江大学) OpenHelix Team(OpenHelix团队) Fudan University(复旦大学) Zhengzhou University(郑州大学) BUPT(北京邮电大学) Hebei University of Technology(河北工业大学)

专题命中 指令微调 :post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.04075 2025-10-02 math.DS math-ph math.MP 50%

Short-range and long-range order: a transition in block-gluing behavior in Hom shifts

Silvere Gangloff, Benjamin Hellouin de Menibus, Piotr Oprocha

专题命中 指令微调 :SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏