arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-26 至 2025-08-26 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 19 篇

2508.16677 2025-08-26 cs.LG cs.AI cs.CL 91%

Recall-Extend Dynamics: Enhancing Small Language Models through Controlled Exploration and Refined Offline Integration

Zhong Guan, Likang Wu, Hongke Zhao, Jiahui Wang, Le Wu

专题命中 指令微调 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17391 2025-08-26 cs.AI cs.CL 91%

Large Language Models as Universal Predictors? An Empirical Study on Small Tabular Datasets

Nikolaos Pavlidis, Vasilis Perifanis, Symeon Symeonidis, Pavlos S. Efraimidis

机构 * Institute for Language and Speech Processing, Athena Research Center(语言与语音处理研究所,阿提卡研究中心) Department of Electrical and Computer Engineering, Democritus University of Thrace(电气与计算机工程系,德摩克利特大学) Department of Production and Management Engineering, Democritus University of Thrace(生产与管理工程系,德摩克利特大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07959 2025-08-26 cs.SE cs.AI 90%

Source Code Summarization in the Era of Large Language Models

Weisong Sun, Yun Miao, Yuekang Li, Hongyu Zhang, Chunrong Fang, Yi Liu, Gelei Deng, Yang Liu, Zhenyu Chen

机构 * College of Computing and Data Science, Nanyang Technological University Singapore(计算与数据科学学院,新加坡南洋理工大学) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Computer Science and Engineering, University of New South Wales(计算机科学与工程学院,新南威尔士大学) School of Big Data and Software Engineering, Chongqing University(大数据与软件工程学院,重庆大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to the 47th International Conference on Software Engineering (ICSE 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05945 2025-08-26 cs.CL cs.AI 89%

Head-Specific Intervention Can Induce Misaligned AI Coordination in Large Language Models

Paul Darm, Annalisa Riccardi

机构 * University of Strathclyde(斯特拉思克莱德大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Published at Transaction of Machine Learning Research 08/2025, Large Language Models (LLMs), Interference-time activation shifting, Steerability, Explainability, AI alignment, Interpretability

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16153 2025-08-26 cs.LG cs.CL 86%

Memento: Fine-tuning LLM Agents without Fine-tuning LLMs

Huichi Zhou, Yihang Chen, Siyuan Guo, Xue Yan, Kin Hei Lee, Zihan Wang, Ka Yiu Lee, Guchun Zhang, Kun Shao, Linyi Yang, Jun Wang

机构 * AI Centre, UCL(UCL人工智能中心) Huawei Noah’s Ark Lab, UK(华为诺亚实验室(英国)) Jilin University(吉林大学) Institute of Automation, CAS(中国科学院自动化研究所)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15659 2025-08-26 cs.AR cs.AI cs.CL cs.LG cs.SE 85%

VeriCoder: Enhancing LLM-Based RTL Code Generation through Functional Correctness Validation

Anjiang Wei, Huanmi Tan, Tarun Suresh, Daniel Mendoza, Thiago S. F. X. Teixeira, Ke Wang, Caroline Trippel, Alex Aiken

机构 * Stanford University(斯坦福大学) Carnegie Mellon University(卡内基梅隆大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Intel Corporation(英特尔公司) Nanjing University(南京大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17926 2025-08-26 cs.CL cs.AI 84%

AMELIA: A Family of Multi-task End-to-end Language Models for Argumentation

Henri Savigny, Bruno Yun

机构 * Universite Claude Bernard Lyon 1(里昂1大学) CNRS(国家科学研究中心) Ecole Centrale de Lyon(里昂中央理工大学) INSA Lyon(里昂国立应用科学学院) Université Lumiere Lyon 2(里昂2大学) LIRIS(图像研究所)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17158 2025-08-26 cs.LG 83%

Towards Safeguarding LLM Fine-tuning APIs against Cipher Attacks

Jack Youstra, Mohammed Mahfoud, Yang Yan, Henry Sleight, Ethan Perez, Mrinank Sharma

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17283 2025-08-26 cs.CV cs.LG 79%

Quickly Tuning Foundation Models for Image Segmentation

Breenda Das, Lennart Purucker, Timur Carstensen, Frank Hutter

机构 * University of Freiburg(弗赖堡大学) ELLIS Institute Tübingen(图宾根ELLIS研究所) Prior Labs(Prior实验室)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

Comments Accepted as a short paper at the non-archival content track of AutoML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10427 2025-08-26 cs.CL cs.AI 79%

Identifying and Manipulating Personality Traits in LLMs Through Activation Engineering

Rumi Allbert, James K. Wiles, Vlad Grankovsky

机构 * Wolfram Institute(沃尔夫拉姆研究所) Hidoba Research(希多巴研究)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17901 2025-08-26 cs.LG cs.AI 79%

Riemannian Optimization for LoRA on the Stiefel Manifold

Juneyoung Park, Minjae Kang, Seongbae Lee, Haegang Lee, Seongwan Kim, Jaeho Lee

机构 * Opt-AI Inc.(Opt-AI公司)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17586 2025-08-26 cs.LG 77%

Exploring Efficient Learning of Small BERT Networks with LoRA and DoRA

Daniel Frees, Aditri Bhagirath, Moritz Bolling

机构 * Department of Statistics Stanford University(统计学系 斯坦福大学) Department of Computer Science Stanford University(计算机科学系 斯坦福大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17417 2025-08-26 eess.AS cs.CL cs.SD 77%

Speechless: Speech Instruction Training Without Speech for Low Resource Languages

Alan Dao, Dinh Bach Vu, Huy Hoang Ha, Tuan Le Duc Anh, Shreyas Gopal, Yue Heng Yeo, Warren Keng Hoong Low, Eng Siong Chng, Jia Qi Yip

机构 * Menlo Research Nanyang Technological University(南洋理工大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments This paper was accepted by INTERSPEECH 2025

Journal ref Proc. Interspeech 2025, 3239-3243

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17337 2025-08-26 cs.CL cs.LG 73%

DropLoRA: Sparse Low-Rank Adaptation for Parameter-Efficient Fine-Tuning

Haojie Zhang

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17638 2025-08-26 cs.CV cs.CL 70%

Dynamic Embedding of Hierarchical Visual Features for Efficient Vision-Language Fine-Tuning

Xinyu Wei, Guoli Yang, Jialu Zhou, Mingyue Yang, Leqian Li, Kedi Zhang, Chunping Qiu

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12072 2025-08-26 cs.CR cs.CL 70%

Mitigating Jailbreaks with Intent-Aware LLMs

Wei Jie Yeo, Ranjan Satapathy, Erik Cambria

机构 * Nanyang Technological University(南洋理工大学) Institute of High Performance Computing(高性能计算研究所) Agency for Science, Technology and Research(科技研究局)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17062 2025-08-26 cs.CV cs.AI 57%

SSG-Dit: A Spatial Signal Guided Framework for Controllable Video Generation

Peng Hu, Yu Gu, Liang Luo, Fuji Ren

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(计算机科学与工程学院,电子科技大学)

专题命中 指令微调 :prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17556 2025-08-26 cs.DB 50%

SEFRQO: A Self-Evolving Fine-Tuned RAG-Based Query Optimizer

Hanwen Liu, Qihan Zhang, Ryan Marcus, Ibrahim Sabek

专题命中 指令微调 :LLM(abstract)

Comments To appear at SIGMOD 2026 (https://2026.sigmod.org/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15565 2025-08-26 cs.CV 50%

Baltimore Atlas: FreqWeaver Adapter for Semi-supervised Ultra-high Spatial Resolution Land Cover Classification

Junhao Wu, Aboagye-Ntow Stephen, Chuyuan Wang, Gang Chen, Xin Huang

机构 * Towson University(托逊大学) University of North Carolina at Charlotte(北卡罗来纳州夏洛特大学)

专题命中 指令微调 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏