arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-28 至 2025-07-28 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 6 篇

2507.10616 2025-07-28 cs.LG cs.AI cs.CL 89%

Scalpel vs. Hammer: GRPO Amplifies Existing Capabilities, SFT Replaces Them

Neel Rajani, Aryo Pradipta Gema, Seraphina Goldfarb-Tarrant, Ivan Titov

机构 * Institute for Language, Cognition and Computation (ILCC), University of Edinburgh, United Kingdom(语言、认知与计算研究所(ILCC),爱丁堡大学,英国) Institute for Logic, Language and Computation (ILLC), University of Amsterdam, Netherlands(逻辑、语言与计算研究所(ILLC),阿姆斯特丹大学,荷兰)

专题命中 指令微调 :SFT(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Journal ref Actionable Interpretability Workshop ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18812 2025-07-28 cs.SE cs.AI 85%

MemoCoder: Automated Function Synthesis using LLM-Supported Agents

Yiping Jia, Zhen Ming Jiang, Shayan Noei, Ying Zou

机构 * Queen's University(女王大学) York University(约克大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05209 2025-07-28 cs.CR cs.AI 85%

Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities

Zora Che, Stephen Casper, Robert Kirk, Anirudh Satheesh, Stewart Slocum, Lev E McKinney, Rohit Gandikota, Aidan Ewart, Domenic Rosati, Zichu Wu, Zikui Cai, Bilal Chughtai, Yarin Gal, Furong Huang, Dylan Hadfield-Menell

机构 * University of Maryland(马里兰大学) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) UK AI Security Institute(英国人工智能安全研究所) University of Toronto(多伦多大学) Northeastern University(东北大学) Haize Labs(Haize实验室) Dalhousie University(达尔豪斯大学) University of Waterloo(滑铁卢大学) University of Oxford(牛津大学) MIT(麻省理工学院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18918 2025-07-28 cs.CL cs.AI 79%

Uncovering Cross-Linguistic Disparities in LLMs using Sparse Autoencoders

Richmond Sin Jing Xuan, Jalil Huseynov, Yang Zhang

机构 * National University of Singapore(新加坡国立大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19390 2025-07-28 cs.SE cs.AI 70%

ReCatcher: Towards LLMs Regression Testing for Code Generation

Altaf Allah Abbassi, Leuson Da Silva, Amin Nikanjam, Foutse Khomh

机构 * Huawei Distributed Scheduling and Data Engine Lab(华为分布式调度与数据引擎实验室) Huawei Distributed Scheduling(华为分布式调度) Data Engine Lab Montreal Canada(数据引擎实验室蒙特利尔加拿大) Data Engine Lab(数据引擎实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 24 pages, 3 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17799 2025-07-28 cs.CL 70%

Relation Extraction with Instance-Adapted Predicate Descriptions

Yuhang Jiang, Ramakanth Kavuluru

机构 * Division of Biomedical Informatics, Department of Internal Medicine University of Kentucky(生物医学信息学系,内科部,肯塔基大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments This paper has been accepted to appear in the proceedings of AMIA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏