arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-18 至 2025-11-18 共收录 31 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 31 篇

2511.12497 2025-11-18 cs.CL cs.AI cs.CR 91%

SGuard-v1: Safety Guardrail for Large Language Models

JoonHo Lee, HyeonMin Cho, Jaewoong Yun, Hyunjae Lee, JunKyu Lee, Juree Seok

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17053 2025-11-18 cs.LG cs.AI cs.CR 91%

DR-Encoder: Encode Low-rank Gradients with Random Prior for Large Language Models Differentially Privately

Huiwen Wu, Deyi Zhang, Xiaohan Li, Xiaogang Xu, Jiafei Wu, Zhe Liu

机构 * Zhejiang Laboratory(浙江实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09415 2025-11-18 cs.CV 89%

FaceShield: Explainable Face Anti-Spoofing with Multimodal Large Language Models

Hongyang Wang, Yichen Shi, Zhuofu Tao, Yuhao Gao, Liepiao Zhang, Xun Lin, Jun Feng, Xiaochen Yuan, Zitong Yu, Xiaochun Cao

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

Comments Accepted by AAAI 2025. Hongyang Wang and Yichen Shi contribute equally. Corresponding author: Zitong Yu

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11677 2025-11-18 cs.LG q-fin.GN 88%

Instruction Tuning Chronologically Consistent Language Models

Songrun He, Linying Lv, Asaf Manela, Jimmy Wu

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)

专题命中 指令微调 :language model(title,abstract);instruction tuning(title);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12414 2025-11-18 cs.LG cs.CR 88%

The 'Sure' Trap: Multi-Scale Poisoning Analysis of Stealthy Compliance-Only Backdoors in Fine-Tuned Large Language Models

Yuting Tan, Yi Huang, Zhuo Li

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02360 2025-11-18 cs.CL 88%

Understanding and Mitigating Political Stance Cross-topic Generalization in Large Language Models

Jiayi Zhang, Shu Yang, Junchao Wu, Derek F. Wong, Di Wang

机构 * Provable Responsible AI and Data Analytics (PRADA) Lab(可证明负责任的人工智能和数据分析实验室) King Abdullah University of Science and Technology (KAUST)(卡布斯科学技术大学) University of Copenhagen(哥本哈根大学) University of Macau(澳门大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12385 2025-11-18 cs.CR cs.SE 88%

GenSIaC: Toward Security-Aware Infrastructure-as-Code Generation with Large Language Models

Yikun Li, Matteo Grella, Daniel Nahmias, Gal Engelberg, Dan Klein, Giancarlo Guizzardi, Thijs van Ede, Andrea Continella

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04604 2025-11-18 cs.SE 88%

Contrastive Learning-Enhanced Large Language Models for Monolith-to-Microservice Decomposition

Khaled Sellami, Mohamed Aymen Saied

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19838 2025-11-18 cs.HC 85%

LLM-Powered GUI Agents in Phone Automation: Surveying Progress and Prospects

Guangyi Liu, Pengxiang Zhao, Yaozhen Liang, Liang Liu, Yaxuan Guo, Han Xiao, Weifeng Lin, Yuxiang Chai, Yue Han, Shuai Ren, Hao Wang, Xiaoyu Liang, WenHao Wang, Tianze Wu, Zhengxi Lu, Siheng Chen, LiLinghao, Hao Wang, Guanjing Xiong, Yong Liu, Hongsheng Li

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Paper accepted to TMLR 2025, Project Homepage: https://github.com/PhoneLLM/Awesome-LLM-Powered-Phone-GUI-Agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13052 2025-11-18 cs.LG cs.AI 84%

Learning from the Undesirable: Robust Adaptation of Language Models without Forgetting

Yunhun Nam, Jaehyung Kim, Jongheon Jeong

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.AI、cs.LG

Comments 17 pages; AAAI 2026; Code is available at https://github.com/yunpal/LfU

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14031 2025-11-18 cs.CL cs.AI cs.LG 83%

Unintended Misalignment from Agentic Fine-Tuning: Risks and Mitigation

Dongyoon Hahm, Taywon Min, Woogyeol Jin, Kimin Lee

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at AAAI 2026 AI Alignment Track, Source code: https://github.com/HahmDY/agentic-ft-safety

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11690 2025-11-18 cs.LG cs.AI cs.CV 81%

Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models

Fei Song, Yi Li, Rui Wang, Jiahuan Zhou, Changwen Zheng, Jiangmeng Li

专题命中 指令微调 :language model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22564 2025-11-18 cs.CL cs.AI cs.LG 80%

Exploiting Synergistic Cognitive Biases to Bypass Safety in LLMs

Xikang Yang, Biyu Zhou, Xuehai Tang, Jizhong Han, Songlin Hu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12823 2025-11-18 cs.SE cs.LG cs.PL 79%

Enhancing LLM Code Generation Capabilities through Test-Driven Development and Code Interpreter

Sajed Jalil, Shuvo Saha, Hossain Mohammad Seym

机构 * Apollo Applications Group Reston, VA, USA(Apollo Applications Group) University of Dhaka(达卡大学) Islamic University of Technology(伊斯兰科技大学)

专题命中 指令微调 :LLM(title,abstract);分类 cs.LG

Comments AACL-IJCNLP 2025 Workshop BLP Shared Task 2, 6 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12563 2025-11-18 cs.AI 79%

LOBERT: Generative AI Foundation Model for Limit Order Book Messages

Eljas Linna, Kestutis Baltakys, Alexandros Iosifidis, Juho Kanniainen

机构 * Data Science Research Centre(数据科学研究中心) Tampere University(塔尔库大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI

Comments Submission for NeurIPS 2025 GenAI in Finance Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09292 2025-11-18 cs.CL cs.AI 79%

C$^3$TG: Conflict-aware, Composite, and Collaborative Controlled Text Generation

Yu Li, Zhe Yang, Yi Huang, Xin Liu, Guilin Qi

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments This paper has been accepted as a poster presentation at AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21788 2025-11-18 cs.LG cs.AI 79%

Online Mixture of Experts: No-Regret Learning for Optimal Collective Decision-Making

Larkin Liu, Jalal Etesami

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06965 2025-11-18 cs.CL cs.AI 79%

Uncovering Factor Level Preferences to Improve Human-Model Alignment

Juhyun Oh, Eunsu Kim, Jiseon Kim, Wenda Xu, Inha Cha, William Yang Wang, Alice Oh

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01623 2025-11-18 cs.LG cs.AI 79%

Fira: Can We Achieve Full-rank Training of LLMs Under Low-rank Constraint?

Xi Chen, Kaituo Feng, Changsheng Li, Xunhao Lai, Xiangyu Yue, Ye Yuan, Guoren Wang

机构 * Beijing Institute of Technology(北京理工大学) School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab) Hebei Province Key Laboratory of Big Data Science and Intelligent Technology(河北省大数据科学与智能技术重点实验室)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2025, Project page: https://github.com/xichen-fy/Fira

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11770 2025-11-18 cs.AI cs.LG 79%

Learning to Refine: An Agentic RL Approach for Iterative SPARQL Query Construction

Floris Vossebeld, Shenghui Wang

机构 * Faculty of Electrical Engineering, Mathematics and Computer Science(电气工程、数学与计算机科学学院) University of Twente(特文特大学) Microsoft Netherlands(微软荷兰)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12588 2025-11-18 cs.CV 78%

Rank-Aware Agglomeration of Foundation Models for Immunohistochemistry Image Cell Counting

Zuqi Huang, Mengxin Tian, Huan Liu, Wentao Li, Baobao Liang, Jie Wu, Fang Yan, Zhaoqing Tang, Zhongyu Li

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Department of Gastrointestinal Surgery and the Gastric Cancer Center, Zhongshan Hospital, Fudan University(复旦大学中山医院胃肠外科及胃癌中心) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) The Comprehensive Breast Care Center, The Second Affiliated Hospital of Xi'an Jiaotong University(西安交通大学第二附属医院综合乳腺护理中心) Department of Pathology, The Second Affiliated Hospital of Xi’an Jiaotong University(西安交通大学第二附属医院病理科) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of General Surgery, Zhongshan Hospital (Xiamen), Fudan University(复旦大学中山医院(厦门)外科科)

专题命中 指令微调 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12331 2025-11-18 cs.CV 78%

SpaceVLM: Sub-Space Modeling of Negation in Vision-Language Models

Sepehr Kazemi Ranjbar, Kumail Alhamoud, Marzyeh Ghassemi

机构 * MIT(麻省理工学院)

专题命中 指令微调 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03138 2025-11-18 cs.AI 77%

DeepKnown-Guard: A Proprietary Model-Based Safety Response Framework for AI Agents

Qi Li, Jianjun Xu, Pingtao Wei, Jiu Li, Peiqiang Zhao, Jiwei Shi, Xuan Zhang, Yanhui Yang, Xiaodong Hui, Peng Xu, Wenqin Shao

机构 * Beijing Caizhi Tech(北京彩智科技)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12639 2025-11-18 cs.CV 75%

Medical Knowledge Intervention Prompt Tuning for Medical Image Classification

Ye Du, Nanxi Yu, Shujun Wang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract)

Comments IEEE Transactions on Medical Imaging (Early Access) July 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00829 2025-11-18 cs.CL 74%

Exposing the Cracks: Vulnerabilities of Retrieval-Augmented LLM-based Machine Translation

Yanming Sun, Runzhe Zhan, Chi Seng Cheang, Han Wu, Xuebo Liu, Yuyao Niu, Fengying Ye, Kaixin Lan, Lidia S. Chao, Derek F. Wong

专题命中 指令微调 :LLM(title);分类 cs.CL

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12520 2025-11-18 cs.CL 70%

TAdaRAG: Task Adaptive Retrieval-Augmented Generation via On-the-Fly Knowledge Graph Construction

Jie Zhang, Bo Tang, Wanzi Shao, Wenqiang Wei, Jihao Zhao, Jianqing Zhu, Zhiyu li, Wen Xi, Zehao Lin, Feiyu Xiong, Yanchao Tan

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12828 2025-11-18 cs.LG cs.AI 62%

Catastrophic Forgetting in Kolmogorov-Arnold Networks

Mohammad Marufur Rahman, Guanchu Wang, Kaixiong Zhou, Minghan Chen, Fan Yang

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

Comments 14 pages, 5 figures, accepted in the main technical track of AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13005 2025-11-18 cs.CV cs.AI 57%

SAGE: Spuriousness-Aware Guided Prompt Exploration for Mitigating Multimodal Bias

Wenqian Ye, Di Wang, Guangtao Zheng, Bohan Liu, Aidong Zhang

专题命中 指令微调 :language model(abstract);分类 cs.AI

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13063 2025-11-18 cs.CV cs.IR 50%

FGNet: Leveraging Feature-Guided Attention to Refine SAM2 for 3D EM Neuron Segmentation

Zhenghua Li, Hang Chen, Zihao Sun, Kai Li, Xiaolin Hu

专题命中 指令微调 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12267 2025-11-18 cs.CV 50%

ZoomEarth: Active Perception for Ultra-High-Resolution Geospatial Vision-Language Tasks

Ruixun Liu, Bowen Fu, Jiayi Song, Kaiyu Li, Wanchen Li, Lanxuan Xue, Hui Qiao, Weizhan Zhang, Deyu Meng, Xiangyong Cao

机构 * Xi’an Jiaotong University(西安交通大学) China Telecom Shaanxi Branch(中国电信陕西分公司)

专题命中 指令微调 :SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏