arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-01 至 2025-09-01 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 6 篇

2412.00631 2025-09-01 cs.LG cs.AI cs.CL 90%

ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning

Yang Wu, Huayi Zhang, Yizheng Jiao, Lin Ma, Xiaozhong Liu, Jinhong Yu, Dongyu Zhang, Dezhi Yu, Wei Xu

机构 * Worcester Polytechnic Institute(沃斯特理工学院) ByteDance Inc.(字节跳动公司)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(title);large language model(abstract);language model(abstract)

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21156 2025-09-01 cs.SE 89%

Automated Bug Triaging using Instruction-Tuned Large Language Models

Kiana Kiashemshaki, Arsham Khosravani, Alireza Hosseinpour, Arshia Akhavan

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21810 2025-09-01 cs.LG 88%

QR-LoRA: QR-Based Low-Rank Adaptation for Efficient Fine-Tuning of Large Language Models

Jessica Liang, Anirudh Bharadwaj

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06748 2025-09-01 cs.LG cs.CL 87%

Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models

Neel Jain, Aditya Shrivastava, Chenyang Zhu, Daben Liu, Alfy Samuel, Ashwinee Panda, Anoop Kumar, Micah Goldblum, Tom Goldstein

机构 * University of Maryland(马里兰大学) Capital One(Capital One公司) Columbia University(哥伦比亚大学)

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21732 2025-09-01 cs.CV cs.AI 79%

CAD2DMD-SET: Synthetic Generation Tool of Digital Measurement Device CAD Model Datasets for fine-tuning Large Vision-Language Models

João Valente, Atabak Dehban, Rodrigo Ventura

机构 * Institute for Systems and Robotics(系统与机器人研究所) University of Lisbon(里斯本大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00209 2025-09-01 cs.LG cs.AI 73%

Mamba State-Space Models Are Lyapunov-Stable Learners

John T. Halloran, Manbir Gulati, Paul F. Roysdon

机构 * Leidos(莱迪奥斯公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments TMLR, 27 pages, 12 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏