arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-17 至 2025-10-17 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 24 篇

2509.12574 2025-10-17 cs.CR cs.CL 89%

Yet Another Watermark for Large Language Models

Siyuan Bao, Ying Shi, Zhiguang Yang, Hanzhou Wu, Xinpeng Zhang

机构 * School of Communication and Information Engineering, Shanghai University(上海大学通信与信息工程学院) School of Big Data and Computer Science, Guizhou Normal University(贵州师范大学大数据与计算机科学学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments https://scholar.google.com/citations?hl=en&user=IdiF7M0AAAAJ

Journal ref International Conference on Communications and Broadband Networking (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13848 2025-10-17 cs.CL cs.AI cs.LG 89%

On-device System of Compositional Multi-tasking in Large Language Models

Ondrej Bohdal, Konstantinos Theodosiadis, Asterios Mpatziakas, Dimitris Filippidis, Iro Spyrou, Christos Zonios, Anastasios Drosou, Dimosthenis Ioannidis, Kyeng-Hun Lee, Jijoong Moon, Hyeonmok Ko, Mete Ozay, Umberto Michieli

机构 * Samsung R&D Institute UK(三星英国研发中心) CERTH(希腊CERTH) Samsung Research(三星研究)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025 (industry track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01997 2025-10-17 cs.LG cs.AI stat.ML 88%

Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach

Jiancong Xiao, Bojian Hou, Zhanliang Wang, Ruochen Jin, Qi Long, Weijie J. Su, Li Shen

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Journal ref ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14824 2025-10-17 cs.CL cs.CV cs.IR 87%

Supervised Fine-Tuning or Contrastive Learning? Towards Better Multimodal LLM Reranking

Ziqi Dai, Xin Zhang, Mingxin Li, Yanzhao Zhang, Dingkun Long, Pengjun Xie, Meishan Zhang, Wenjie Li, Min Zhang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17692 2025-10-17 cs.CL cs.AI cs.LG 87%

MIO: A Foundation Model on Multimodal Tokens

Zekun Wang, King Zhu, Chunpu Xu, Wangchunshu Zhou, Jiaheng Liu, Yibo Zhang, Jiashuo Wang, Ning Shi, Siyu Li, Yizhi Li, Haoran Que, Zhaoxiang Zhang, Yuanxing Zhang, Ge Zhang, Ke Xu, Jie Fu, Wenhao Huang

机构 * Beihang University(北航) M-A-P The Hong Kong Polytechnic University(香港理工大学) AIWaves University of Alberta(阿尔伯塔大学) University of Waterloo(滑铁卢大学) University of Manchester(曼彻斯特大学) Chinese Academy of Sciences(中国科学院) Peking University(北京大学) Shanghai AI Lab(上海AI实验室) Nanjing University(南京大学) Kuaishou Technology(快手科技)

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 (Oral). Codes and models are available in https://github.com/MIO-Team/MIO

Journal ref EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14200 2025-10-17 cs.CL 85%

RLSR: Reinforcement Learning with Supervised Reward Outperforms SFT in Instruction Following

Zhichao Wang, Andy Wong, Ruslan Belkin

机构 * Inflection AI

专题命中 指令微调 :SFT(title,abstract);pretraining(abstract);RLHF(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13709 2025-10-17 cs.AI cs.LG 84%

Training LLM Agents to Empower Humans

Evan Ellis, Vivek Myers, Jens Tuyls, Sergey Levine, Anca Dragan, Benjamin Eysenbach

专题命中 指令微调 :LLM(title);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14470 2025-10-17 cs.CR cs.AI 83%

Stealthy Dual-Trigger Backdoors: Attacking Prompt Tuning in LM-Empowered Graph Foundation Models

Xiaoyu Xue, Yuni Lai, Chenxi Huang, Yulin Zhu, Gaolei Li, Xiaoge Zhang, Kai Zhou

机构 * HKPolyU(香港PolyU) Hong Kong Chu Hai College(香港 Chu Hai 学院) Shanghai Jiao Tong University(上海交通大学)

专题命中 指令微调 :foundation model(title,abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14453 2025-10-17 cs.CL 83%

Natural Language Tools: A Natural Language Approach to Tool Calling In Large Language Agents

Reid T. Johnson, Michelle D. Pain, Jordan D. West

专题命中 指令微调 :language agent(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments 31 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11070 2025-10-17 cs.CV 82%

Falcon: A Remote Sensing Vision-Language Foundation Model (Technical Report)

Kelu Yao, Nuo Xu, Rong Yang, Yingying Xu, Zhuoyan Gao, Titinunt Kitrungrotsakul, Yi Ren, Pu Zhang, Jin Wang, Ning Wei, Chao Li

机构 * Research Center for Space Computing System, ZhejiangLab, Hangzhou, China(空间计算系统研究中心,浙江实验室,杭州,中国)

专题命中 指令微调 :foundation model(title,abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13892 2025-10-17 cs.CL 81%

The Harder The Better: Maintaining Supervised Fine-tuning Generalization with Less but Harder Data

Zhaoyang Shang, Sibo Wei, Jianbin Guo, Rui Zhou, Lifeng Dong, Yin Luo

机构 * Beijing Wenge Technology Co.,Ltd(北京文格科技有限公司) College of Intelligence and Computing(智能与计算学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14635 2025-10-17 cs.SE 80%

ATGen: Adversarial Reinforcement Learning for Test Case Generation

Qingyao Li, Xinyi Dai, Weiwen Liu, Xiangyang Li, Yasheng Wang, Ruiming Tang, Yong Yu, Weinan Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13387 2025-10-17 cs.CL cs.GT 77%

Make an Offer They Can't Refuse: Grounding Bayesian Persuasion in Real-World Dialogues without Pre-Commitment

Buwei He, Yang Liu, Zhaowei Zhang, Zixia Jia, Huijia Wu, Zhaofeng He, Zilong Zheng, Yipeng Kang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Institute for General Artificial Intelligence(北京通用人工智能研究院) Peking University(北京大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04101 2025-10-17 cs.CR cs.AI cs.NI 77%

LLMs' Suitability for Network Security: A Case Study of STRIDE Threat Modeling

AbdulAziz AbdulGhaffar, Ashraf Matrawy

机构 * Dept. of Syst. \& Comp. Engineering Carleton University School of Information Technology Carleton University

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments Conference paper, 6 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15738 2025-10-17 cs.CR cs.AI cs.CL cs.LG 75%

Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses

Xiaoxue Yang, Bozhidar Stevanoski, Matthieu Meeus, Yves-Alexandre de Montjoye

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13891 2025-10-17 cs.LG cs.AI 73%

K-frames: Scene-Driven Any-k Keyframe Selection for long video understanding

Yifeng Yao, Yike Yun, Jing Wang, Huishuai Zhang, Dongyan Zhao, Ke Tian, Zhihao Wang, Minghui Qiu, Tao Wang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) Bytedance(字节跳动)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22358 2025-10-17 cs.LG cs.AI 73%

Adaptive Budget Allocation for Orthogonal-Subspace Adapter Tuning in LLMs Continual Learning

Zhiyi Wan, Wanrou Du, Liang Li, Miao Pan, Xiaoqi Qin

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Pengcheng Laboratory(鹏城实验室) University of Houston(休斯顿大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12491 2025-10-17 cs.CL 70%

Can Pre-training Indicators Reliably Predict Fine-tuning Outcomes of LLMs?

Hansi Zeng, Kai Hui, Honglei Zhuang, Zhen Qin, Zhenrui Yue, Hamed Zamani, Dana Alon

机构 * Google DeepMind(谷歌DeepMind) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 指令微调 :LLM(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14163 2025-10-17 cs.LG cs.AI cs.CL cs.CV 67%

Towards Reversible Model Merging For Low-rank Weights

Mohammadsajad Alipour, Mohammad Mohammadi Amiri

机构 * Department of Computer Science Rensselaer Polytechnic Institute(计算机科学系罗切斯特理工学院)

专题命中 指令微调 :post-training(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13410 2025-10-17 cs.CL cs.AI 62%

Causal Language Control in Multilingual Transformers via Sparse Feature Steering

Cheng-Ting Chou, George Liu, Jessica Sun, Cole Blondin, Kevin Zhu, Vasu Sharma, Sean O'Brien

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Maryland, College Park(马里兰大学学院公园分校) Barnard College(巴纳德学院) Algoverse AI Research(Algoverse人工智能研究) Meta FAIR Lab(Meta FAIR实验室)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14845 2025-10-17 cs.LG cs.CV 57%

Backdoor Unlearning by Linear Task Decomposition

Amel Abdelraheem, Alessandro Favero, Gerome Bovet, Pascal Frossard

机构 * EPFL(苏黎世联邦理工学院) Cyber-Defence Campus, armasuisse(网络安全校园,armasuisse)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14842 2025-10-17 cs.AI 57%

Boosting Instruction Following at Scale

Ben Elder, Evelyn Duesterwald, Vinod Muthusamy

机构 * IBM T.J. Watson Research(IBM TJ Watson 研究院)

专题命中 指令微调 :LLM(abstract);分类 cs.AI

Comments 6+4 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10623 2025-10-17 cs.LG cs.CV 57%

Flows and Diffusions on the Neural Manifold

Daniel Saragih, Deyu Cao, Tejas Balaji

机构 * Queen’s University and Vector Institute(女王大学和向量研究所) University of Tokyo(东京大学) University of Toronto(多伦多大学)

专题命中 指令微调 :language model(abstract);分类 cs.LG

Comments 43 pages, 11 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02724 2025-10-17 cs.LG math.OC 57%

WeightLoRA: Keep Only Necessary Adapters

Andrey Veprikov, Vladimir Solodkin, Alexander Zyl, Andrey Savchenko, Aleksandr Beznosikov

专题命中 指令微调 :language model(abstract);分类 cs.LG

Comments 13 pages, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏