arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-19 至 2025-09-19 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 12 篇

2509.15155 2025-09-19 cs.LG cs.RO 90%

Self-Improving Embodied Foundation Models

Seyed Kamyar Seyed Ghasemipour, Ayzaan Wahid, Jonathan Tompson, Pannag Sanketi, Igor Mordatch

机构 * Generalist Google DeepMind(谷歌DeepMind)

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments Appearing in the Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12476 2025-09-19 cs.CL 89%

Audited Reasoning Refinement: Fine-Tuning Language Models via LLM-Guided Step-Wise Evaluation and Correction

Sumanta Bhattacharyya, Sara Riazi, Pedram Rooshenas

专题命中 指令微调 :LLM(title,abstract);language model(title);SFT(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14711 2025-09-19 eess.SP 89%

LLM4MG: Adapting Large Language Model for Multipath Generation via Synesthesia of Machines

Ziwei Huang, Shiliang Lu, Lu Bai, Xuesong Cai, Xiang Cheng

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14373 2025-09-19 cs.SE 88%

CodeLSI: Leveraging Foundation Models for Automated Code Generation with Low-Rank Optimization and Domain-Specific Instruction Tuning

Huy Le, Phong Nguyen, Hao Do, Tuan Nguyen, Thien Pham, Anh Nguyen-Duc, Tho Quan

专题命中 指令微调 :foundation model(title,abstract);instruction tuning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14943 2025-09-19 cs.CL 85%

Explicit vs. Implicit Biographies: Evaluating and Adapting LLM Information Extraction on Wikidata-Derived Texts

Alessandra Stramiglio, Andrea Schimmenti, Valentina Pasqual, Marieke van Erp, Francesco Sovrano, Fabio Vitali

机构 * DISI Departement of Computer Science and Engineering, University of Bologna(博洛尼亚大学计算机科学与工程系) Automobili Lamborghini SpA(法拉利公司) Digital Humanities Advanced Research Center(数字人文高级研究中心) KNAW Humanities Cluster, DHLab(KNAW 人文集群,DHLab) ETH Zurich, Collegium Helveticum(苏黎世联邦理工学院,瑞士学院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10943 2025-09-19 cs.LG 85%

Self-Adapting Language Models

Adam Zweiger, Jyothish Pari, Han Guo, Ekin Akyürek, Yoon Kim, Pulkit Agrawal

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14664 2025-09-19 cs.CV 78%

Attention Lattice Adapter: Visual Explanation Generation for Visual Foundation Model

Shinnosuke Hirano, Yuiga Wada, Tsumugi Iida, Komei Sugiura

机构 * Keio University(庆应大学)

专题命中 指令微调 :foundation model(title,abstract)

Comments Accepted for presentation at ICONIP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15202 2025-09-19 cs.CR 75%

Beyond Surface Alignment: Rebuilding LLMs Safety Mechanism via Probabilistically Ablating Refusal Direction

Yuanbo Xie, Yingjie Zhang, Tianyun Liu, Duohe Ma, Tingwen Liu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by EMNLP2025 Finding

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14271 2025-09-19 cs.CR cs.LG 70%

Early Approaches to Adversarial Fine-Tuning for Prompt Injection Defense: A 2022 Study of GPT-3 and Contemporary Models

Gustavo Sandoval, Denys Fenchenko, Junyao Chen

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14253 2025-09-19 cs.CL cs.AI 62%

CrossPT: Exploring Cross-Task Transferability through Multi-Task Prompt Tuning

Ahmad Pouramini, Hesham Faili

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14596 2025-09-19 cs.CV cs.AI cs.LG 62%

VLM Agents Generate Their Own Memories: Distilling Experience into Embodied Programs of Thought

Gabriel Sarch, Lawrence Jang, Michael J. Tarr, William W. Cohen, Kenneth Marino, Katerina Fragkiadaki

机构 * Carnegie Mellon University(卡内基梅隆大学) Google DeepMind(谷歌DeepMind)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

Comments Project website: https://ical-learning.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13240 2025-09-19 cs.LG 57%

Don't Forget the Nonlinearity: Unlocking Activation Functions in Efficient Fine-Tuning

Bo Yin, Xingyi Yang, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学) Hong Kong Polytechnic University(香港理工大学)

专题命中 指令微调 :instruction tuning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏