arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11653 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11653 篇

2602.19403 2026-02-24 cs.CL stat.AP 89%

Personalized Prediction of Perceived Message Effectiveness Using Large Language Model Based Digital Twins

基于大型语言模型的数字孪生个性化预测感知信息有效性

Jasmin Han, Janardan Devkota, Joseph Waring, Amanda Luken, Felix Naughton, Roger Vilardaga, Jonathan Bricker, Carl Latkin, Meghan Moran, Yiqun Chen, Johannes Thrul

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本研究利用LLM基于数字孪生方法提升戒烟信息个性化预测效果,实现更精准的mHealth干预内容定制。

Comments 31 pages, 5 figures, submitted to Journal of the American Medical Informatics Association (JAMIA). Drs. Chen and Thrul share last authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18721 2026-02-24 cs.CL eess.AS 89%

ReHear: Iterative Pseudo-Label Refinement for Semi-Supervised Speech Recognition via Audio Large Language Models

ReHear:基于音频大语言模型的迭代伪标签细化方法用于半监督语音识别

Zefang Liu, Chenyang Zhu, Sangwoo Cho, Shi-Xiong Zhang

机构 * Capital One, USA(Capital One公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 ReHear通过整合音频感知大语言模型实现伪标签迭代细化,有效缓解半监督语音识别中的误差传播问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10815 2026-02-12 cs.CV cs.LG 89%

Why Does RL Generalize Better Than SFT? A Data-Centric Perspective on VLM Post-Training

为什么强化学习比监督微调在泛化能力上更优?一种以数据为中心的视觉语言模型后训练视角

Aojun Lu, Tao Feng, Hangjie Yuan, Wei Li, Yanan Sun

机构 * College of Computer Science, Sichuan University(四川大学计算机科学学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

专题命中 指令微调 :post-training(title,abstract);SFT(title,abstract);language model(abstract);分类 cs.LG

AI总结 本文通过数据视角揭示了RL在VLM后训练中泛化能力优于SFT的原因,提出DC-SFT方法提升OOD性能并提高稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15922 2026-02-12 cs.CL 89%

Aligning Dialogue Agents with Global Feedback via Large Language Model Multimodal Reward Decomposition

通过大语言模型多模态奖励分解对齐对话代理

Dong Won Lee, Hae Won Park, Cynthia Breazeal, Louis-Philippe Morency

机构 * MIT(麻省理工学院) CMU(卡内基梅隆大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出了一种基于大语言模型的多模态奖励分解方法,通过分解会话级反馈来提升对话生成质量,无需人工反馈。

Comments 9 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07376 2026-02-10 cs.CL 89%

Do Large Language Models Reflect Demographic Pluralism in Safety?

大语言模型在安全领域是否反映了人口多样性?

Usman Naseem, Gautam Siddharth Kashyap, Sushant Kumar Ray, Rafiq Ali, Ebad Shabbir, Abdullah Mohammad

机构 * Macquarie University(麦考瑞大学) University of Delhi(德里大学) DSEU-Okhla

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 Demo-SafetyBench通过在提示级别建模人口多样性,实现了在安全评估中兼顾可扩展性和人口鲁棒性。

Comments Accepted at EACL Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06384 2026-02-09 cs.CL 89%

FMBench: Adaptive Large Language Model Output Formatting

FMBench: 自适应大语言模型输出格式化

Yaoting Wang, Yun Zhou, Henghui Ding

机构 * Fudan University(复旦大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.CL

AI总结 FMBench通过结合监督微调和强化学习微调,提升大语言模型在Markdown格式化任务中的语义和结构准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12300 2026-02-06 cs.CL 89%

HBO: Hierarchical Balancing Optimization for Fine-Tuning Large Language Models

HBO:用于微调大语言模型的分层平衡优化

Weixuan Wang, Minghao Wu, Barry Haddow, Alexandra Birch

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院) Tongyi Lab, Alibaba Group(阿里集团通义实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 HBO通过分层平衡优化方法,在LLM微调中解决数据不平衡和异质性问题,提升跨数据集和单数据集的训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21437 2026-02-03 cs.LG 89%

Accurate Network Traffic Matrix Prediction via LEAD: a Large Language Model-Enhanced Adapter-Based Conditional Diffusion Model

通过LEAD实现网络流量矩阵的准确预测:一种基于大语言模型的适配器条件扩散模型

Yu Sun, Yaqiong Liu, Nan Cheng, Jiayuan Li, Zihan Jia, Xialin Du, Mugen Peng

机构 * School of Information and Communication Engineering, Beijing University of Posts and Telecommunications(信息与通信工程学院,北京邮电大学) China Mobile Group Design Institute(中国移动集团设计院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 LEAD通过结合大语言模型与适配器条件扩散模型,有效提升网络流量矩阵预测的准确性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01137 2026-02-03 cs.LG 89%

Self-Generative Adversarial Fine-Tuning for Large Language Models

自生成对抗微调用于大语言模型

Shiguang Wu, Yaqing Wang, Quanming Yao

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Beijing Institute of Mathematical Sciences and Applications(北京数学科学研究院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出SGALM,通过生成对抗游戏实现大语言模型的对齐微调,无需外部奖励模型,达到最先进的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01128 2026-02-03 cs.LG 89%

Tangent Space Fine-Tuning for Directional Preference Alignment in Large Language Models

切线空间微调用于大语言模型中的方向偏好对齐

Mete Erdogan

机构 * Stanford University(斯坦福大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);preference optimization(abstract);分类 cs.LG

AI总结 TS-DPO通过切线空间微调实现多偏好维度的可控对齐,提升模型在帮助性与冗余性之间的平衡能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00952 2026-02-03 cs.LG 89%

Optimal Budgeted Adaptation of Large Language Models

大语言模型的最优预算适应

Jing Wang, Jie Shen, Dean Foster, Zohar Karnin, Jeremy C Weiss

机构 * Amazon(亚马逊公司) Technology Innovation Institute(技术创新研究所) Stevens Institute of Technology(史蒂文斯技术学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出了一种基于预算意识的监督微调框架,通过上下文Stackelberg博弈模型提升大语言模型的微调效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00082 2026-02-03 q-fin.ST cs.AI q-fin.TR 89%

Design and Empirical Study of a Large Language Model-Based Multi-Agent Investment System for Chinese Public REITs

基于大语言模型的多智能体投资系统设计与实证研究:中国公共REITs市场

Zheng Li

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本研究设计并实证了一种基于大语言模型的多智能体投资系统,用于中国公共REITs市场,通过多智能体协作提升交易的风险调整收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06777 2026-02-02 cs.CV cs.AI 89%

MolX: Enhancing Large Language Models for Molecular Understanding With A Multi-Modal Extension

MolX: 通过多模态扩展增强大型语言模型的分子理解能力

Khiem Le, Zhichun Guo, Kaiwen Dong, Xiaobao Huang, Bozhao Nan, Roshni Iyer, Xiangliang Zhang, Olaf Wiest, Wei Wang, Ting Hua, Nitesh V. Chawla

机构 * University of Notre Dame, IN, USA(诺丁汉大学) University of California, Los Angeles, CA, USA(加州大学洛杉矶分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 MolX通过多模态扩展提升LLM对分子的理解能力,利用SMILES和分子图提取细粒度特征,并结合分子指纹提升性能,有效提升分子相关任务表现。

Comments MLoG-GenAI@KDD'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12344 2026-01-28 cs.CL 89%

Propaganda AI: An Analysis of Semantic Divergence in Large Language Models

宣传AI:大型语言模型中语义分歧的分析

Nay Myat Min, Long H. Pham, Yige Li, Jun Sun

机构 * Singapore Management University(新加坡国立管理学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出RAVEN方法,用于检测大型语言模型中因概念提示引发的语义分歧,通过结合语义熵与跨模型分歧,揭示模型在特定主题上的异常响应,以提高对宣传影响的防范能力。

Comments Accepted at ICLR 2026, 22 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11109 2026-01-28 quant-ph cs.AI 89%

Agent-Q: Fine-Tuning Large Language Models for Quantum Circuit Generation and Optimization

Agent-Q: 为量子电路生成和优化微调大型语言模型

Linus Jern, Valter Uotila, Cong Yu, Bo Zhao

机构 * Aalto University Aalto University \& University of Helsinki

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 Agent-Q通过微调LLMs生成和优化量子电路,提供14,000个电路用于多种优化问题。

Comments 12 pages, 8 figures, 3 tables, presented at IEEE International Conference on Quantum Computing and Engineering (QCE) 2025

Journal ref 2025 IEEE International Conference on Quantum Computing and Engineering (QCE), Albuquerque, NM, USA, 2025, pp. 1621-1632

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24196 2026-01-28 physics.optics cs.AI 89%

Chat to Chip: Large Language Model Based Design of Arbitrarily Shaped Metasurfaces

Chat to Chip: 基于大规模语言模型的任意形状超材料设计

Huanshu Zhang, Lei Kang, Sawyer D. Campbell, Douglas H. Werner

机构 * Department of Electrical Engineering(电气工程系) The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出利用大规模语言模型设计任意形状超材料,通过自然语言交互实现快速设计,展示了LLM在纳米光子学中的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18468 2026-01-27 cs.CL 89%

Latent Knowledge as a Predictor of Fact Acquisition in Fine-Tuned Large Language Models

潜在知识作为微调大语言模型事实获取的预测因子

Daniel B. Hier, Tayo Obafemi-Ajayi

机构 * Department of Neurology and Rehabilitation, University of Illinois at Chicago(神经学与康复医学系,伊利诺伊大学芝加哥分校) Engineering Program, Missouri State University(工程学院,密苏里州立大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

AI总结 研究通过微调大语言模型,发现潜在知识是预测事实获取速度和泛化能力的关键因素,同时揭示了训练强化对事实退化的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17921 2026-01-27 cs.CL 89%

ShapLoRA: Allocation of Low-rank Adaption on Large Language Models via Shapley Value Inspired Importance Estimation

ShapLoRA: 通过受Shapley值启发的重要性估计在大型语言模型上分配低秩适应

Yi Zhao, Qinghua Yao, Xinyuan song, Wei Zhu

机构 * Singapore Management University(新加坡国立管理学院) University of Pennsylvania(宾夕法尼亚大学) Emory University(埃默里大学) University of Hong Kong(香港大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 ShapLoRA通过受Shapley值启发的重要性估计方法,改进大型语言模型的低秩适应分配,提升模型性能。

Comments accepted by CPAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15236 2026-01-22 cs.CL 89%

Metadata Conditioned Large Language Models for Localization

具有元数据条件的大型语言模型用于本地化

Anjishnu Mukherjee, Ziwei Zhu, Antonios Anastasopoulos

机构 * Department of Computer Science, George Mason University(计算机科学系,乔治·马歇尔大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.CL

AI总结 本文提出通过元数据条件来提升大型语言模型的本地化能力,通过预训练和实验验证了其在不同区域表现的提升效果和效率优势。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08223 2026-01-22 cs.CR cs.AI 89%

DNF: Dual-Layer Nested Fingerprinting for Large Language Model Intellectual Property Protection

DNF:用于大语言模型知识产权保护的双层嵌套指纹

Zhenhua Xu, Yiran Zhao, Mengting Zhong, Dezhang Kong, Changting Lin, Tong Qiao, Meng Han

机构 * Zhejiang University(浙江大学) Binjiang Institute of Zhejiang University(浙江大学滨江学院) Hangzhou Dianzi University(杭州电子科技大学) Hefei University of Technology(合肥工业大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 DNF通过结合领域特定风格线索和隐含语义触发器,实现大语言模型的隐蔽知识产权保护。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11113 2026-01-19 cs.LG cs.CR 89%

Differentially Private Subspace Fine-Tuning for Large Language Models

针对大语言模型的差分隐私子空间微调

Lele Zheng, Xiang Wang, Tao Zhang, Yang Cao, Ke Cheng, Yulong Shen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.LG

AI总结 DP-SFT通过子空间微调方法在保持差分隐私保障的同时,有效降低噪声影响,提升大语言模型在下游任务中的准确性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11806 2026-01-16 cs.CL 89%

Exploring the Translation Mechanism of Large Language Models

探索大型语言模型的翻译机制

Hongbin Zhang, Kehai Chen, Xuefeng Bai, Xiucheng Li, Yang Xiang, Min Zhang

机构 * Institute of Computing and Intelligence(计算与智能研究所) Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本研究提出子空间干预路径修补法,揭示大型语言模型翻译机制,发现稀疏组件子集主导翻译,通过微调提升性能并推广至复杂任务。

Comments Accepted in NeurIPS 2025 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03725 2026-01-08 cs.LG 89%

EDCO: Dynamic Curriculum Orchestration for Domain-specific Large Language Model Fine-tuning

EDCO:面向领域特定大语言模型微调的动态课程编排

Jing-Cheng Pang, Liu Sun, Chang Zhou, Xian Tang, Haichuan Ma, Kun Jiang, Jianlong Wang, Kai Zhang, Sijie Wu, Haoran Cai, Chenwei Wu, Xubin Li, Xin Chen

机构 * Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 EDCO通过动态课程编排和熵估计提升领域特定大语言模型微调效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18076 2026-01-06 cs.CL 89%

Hybrid and Unitary PEFT for Resource-Efficient Large Language Models

混合与单位元PEFT用于资源高效的大型语言模型

Haomin Qi, Zihan Dai, Chengbo Huang

机构 * Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong(信息工程系,香港中文大学) Department of Electrical and Computer Engineering, University of California San Diego, USA(电气与计算机工程系,加州大学圣地亚哥分校) Department of Computer Science, University of Copenhagen, Denmark(计算机科学系,哥本哈根大学) Department of Electrical Engineering, Columbia University, USA(电气工程系,哥伦比亚大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出混合与单位元PEFT方法,通过结合BOFT和LoRA-GA的优势,提升LLM微调效率,减少训练时间和内存使用,适用于资源受限场景。

Comments 11 pages, 2 figures and 7 table

Journal ref American Journal of Computer Science and Technology (Volume 8, Issue 4, 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20061 2025-12-24 cs.AI 89%

Scaling Reinforcement Learning for Content Moderation with Large Language Models

利用大语言模型扩展强化学习用于内容审核

Hamed Firooz, Rui Liu, Yuchen Lu, Zhenyu Hou, Fangzhou Xiong, Xiaoyang Zhang, Changshu Jian, Zhicheng Zhu, Jiayuan Ma, Jacob Tao, Chaitali Gupta, Xiaochang Peng, Shike Mei, Hang Cui, Yang Qin, Shuo Tang, Jason Gaedtke, Arpit Mittal

机构 * Meta AI

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出利用强化学习扩展大语言模型,以提升内容审核的准确性和效率,特别是在标签稀疏和政策复杂的情况下。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16743 2025-12-16 cs.CL 89%

Safety Alignment of Large Language Models via Contrasting Safe and Harmful Distributions

通过对比安全与有害分布实现大语言模型的安全对齐

Xiaoyun Zhang, Zhengyue Zhao, Wenxuan Shi, Kaidi Xu, Di Huang, Xing Hu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);RLHF(abstract);分类 cs.CL

AI总结 本文提出ACD方法,通过生成安全与对抗性提示,实现大语言模型的安全对齐,提升安全性的同时保持生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26898 2025-12-15 cs.LG 89%

Integrating Ontologies with Large Language Models for Enhanced Control Systems in Chemical Engineering

将本体与大语言模型结合以增强化工工程中的控制系统

Crystal Su, Kuai Yu, Jingrui Zhang, Mingyuan Shao, Daniel Bauer

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出结合本体的LLM框架,用于增强化工工程控制系统,通过结构化知识与生成推理结合,提升过程控制和安全分析的可解释性和可靠性。

Comments This paper is withdrawn due to issues with attribution and citation accuracy

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02069 2025-12-03 cs.CR cs.AI 89%

Large Language Model based Smart Contract Auditing with LLMBugScanner

基于大型语言模型的智能合约审计与LLMBugScanner

Yining Yuan, Yifei Wang, Yichang Xu, Zachary Yahn, Sihao Hu, Ling Liu

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 LLMBugScanner通过结合领域知识适应和集成推理,提升智能合约漏洞检测的鲁棒性和泛化能力,提供了一种高效且可扩展的审计框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01634 2025-11-13 cs.CR cs.AI 89%

Prompt Injection as an Emerging Threat: Evaluating the Resilience of Large Language Models

Daniyal Ganiuly, Assel Smaiyl

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05769 2025-11-11 cs.HC cs.AI 89%

Lived Experience in Dialogue: Co-designing Personalization in Large Language Models to Support Youth Mental Well-being

Kathleen W. Guan, Sarthak Giri, Mohammed Amara, Bernard J. Jansen, Enrico Liscio, Milena Esherick, Mohammed Al Owayyed, Ausrine Ratkute, Gayane Sedrakyan, Mark de Reuver, Joao Fernando Ferreira Goncalves, Caroline A. Figueroa

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏