arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-02 至 2025-12-02 共收录 17 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 17 篇

2512.01326 2025-12-02 cs.CR cs.CL cs.LG 88%

Securing Large Language Models (LLMs) from Prompt Injection Attacks

保护大型语言模型(LLMs)免受提示注入攻击

Omar Farooq Khan Suri, John McCrae

机构 * University of Galway, Ireland(Galway大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

AI总结 本研究评估了JATMO方法对提示注入攻击的鲁棒性,发现其在减少攻击成功率的同时仍存在漏洞,提示需要更复杂的防御策略。

Comments 10 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01317 2025-12-02 cs.LG cs.AI 88%

T-SHIRT: Token-Selective Hierarchical Data Selection for Instruction Tuning

T-SHIRT: 令牌选择性层次数据选择用于指令微调

Yanjun Fu, Faisal Hamman, Sanghamitra Dutta

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 T-SHIRT通过令牌选择性层次数据选择方法提升指令微调效率,使小规模数据集训练效果优于大规模数据集。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00231 2025-12-02 cs.SE cs.AI 85%

CodeFlowLM: Incremental Just-In-Time Defect Prediction with Pretrained Language Models and Exploratory Insights into Defect Localization

CodeFlowLM:基于预训练语言模型的增量即需缺陷预测与缺陷定位的探索性洞察

Monique Louise Monteiro, George G. Cabral, Adriano L. I. OLiveira

机构 * cin.ufpe.br(佛罗里达大学佩德罗斯分校计算机学院) Recife-PE – Brazil(巴西佩德罗斯)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

AI总结 CodeFlowLM通过增量学习提升即时软件缺陷预测性能,同时探索LLMs在缺陷定位中的潜力与局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00219 2025-12-02 cs.CL 85%

Minimal-Edit Instruction Tuning for Low-Resource Indic GEC

低资源印地语语法错误纠正的最小编辑指令微调

Akhil Rajeev P

机构 * Indian Heritage Language Computing Team Special and Strategic Projects (SSP) Group(印度遗产语言计算团队特殊与战略项目组) Centre for Development of Advanced Computing (C DAC)(高级计算发展中心)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一种无需数据增强的低资源印地语语法错误纠正方法,通过指令微调和保守解码实现高效纠错。

Comments Submitted to AACL-IJCNLP Bhasha Workshop Shared Task1 :GEC

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18735 2025-12-02 cs.LG cs.AI 85%

TLoRA: Tri-Matrix Low-Rank Adaptation of Large Language Models

TLoRA:大型语言模型的三矩阵低秩适应

Tanvir Islam

机构 * Okta

专题命中 指令微调 :large language model(title);language model(title);分类 cs.AI、cs.LG

AI总结 TLoRA通过三矩阵低秩适应方法实现高效参数微调,相比LoRA等方法在资源利用上更优,具有高表达性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00042 2025-12-02 cs.CV cs.AI cs.CL cs.CY 84%

Closing the Gap: Data-Centric Fine-Tuning of Vision Language Models for the Standardized Exam Questions

弥合差距:面向标准化考试题目的视觉语言模型数据驱动微调

Egemen Sert, Şeyda Ertekin

机构 * organization= Department of Computer Engineering, Middle East Technical University (METU) , city= Ankara , country= Türkiye organization= METU-DTX Digital Transformation \& Innovation Centre, METU , city= Ankara , country= Türkiye

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过高质量数据和优化语法提升视觉语言模型在标准化考试题目的多模态推理性能,达到接近SOTA的水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01038 2025-12-02 cs.LG cs.AI 81%

FMTK: A Modular Toolkit for Composable Time Series Foundation Model Pipelines

FMTK:用于可组合时间序列基础模型流水线的模块化工具包

Hetvi Shastri, Pragya Sharma, Walid A. Hanafy, Mani Srivastava, Prashant Shenoy

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) University of California Los Angeles(加州大学洛杉矶分校)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 FMTK提供了一个模块化工具包,用于构建和微调时间序列基础模型流水线,通过标准化的主干和组件抽象实现灵活组合和高效性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01267 2025-12-02 cs.MM cs.SD 78%

ZO-ASR: Zeroth-Order Fine-Tuning of Speech Foundation Models without Back-Propagation

ZO-ASR: 无需反向传播的语音基础模型零阶微调

Yuezhang Peng, Yuxin Liu, Yao Li, Sheng Wang, Fei Wen, Xie Chen

机构 * X-LANCE Lab, School of Computer Science, MoE Key Lab of Artificial Intelligence, Shanghai Jiao Tong University(X-LANCE实验室、计算机科学学院、人工智能重点实验室、上海交通大学)

专题命中 指令微调 :foundation model(title,abstract)

AI总结 ZO-ASR通过零阶方法无需反向传播实现高效语音模型微调,有效降低内存消耗并在领域适应和测试时间适应任务中取得优于现有方法的性能。

Comments 2025 IEEE Automatic Speech Recognition and Understanding Workshop (ASRU)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00670 2025-12-02 cs.AI 77%

EDIT: Early Diffusion Inference Termination for dLLMs Based on Dynamics of Training Gradients

EDIT:基于训练梯度动态的早期扩散推理终止用于dLLMs

He-Yen Hsieh, Hong Wang, H. T. Kung

机构 * CISPA Harvard University(哈佛大学) Intel Corporation(英特尔公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 EDIT通过利用训练梯度动态,在保持准确性的同时减少dLLM推理步骤,提升效率。

Comments 22 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13908 2025-12-02 cs.HC cs.AI stat.AP 70%

AI-Assisted Conversational Interviewing: Effects on Data Quality and Respondent Experience

AI辅助的对话访谈:对数据质量和受访者体验的影响

Soubhik Barari, Jarret Angbazo, Natalie Wang, Leah M. Christian, Elizabeth Dean, Zoe Slowinski, Brandon Sepulvado

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出AI辅助对话访谈框架,通过聊天机器人提升开放式数据收集质量,发现其在编码准确性上表现良好,但需平衡受访者体验与数据详细度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11569 2025-12-02 cs.LG cs.IT eess.SP math.IT 70%

Pre-Training and Personalized Fine-Tuning via Over-the-Air Federated Meta-Learning: Convergence-Generalization Trade-Offs

通过空中联邦元学习进行预训练和个性化微调:泛化与收敛的权衡

Haifeng Wen, Hong Xing, Osvaldo Simeone

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Department of ECE, The Hong Kong University of Science and Technology(香港科学与技术大学电子工程系) Department of Engineering, King’s College London(伦敦国王学院工程系)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了无线环境下基于元学习的个性化联邦学习在泛化与收敛之间的权衡,通过空中计算分析了信道损伤对泛化和收敛的影响。

Comments 40 pages, 10 figures, to appear in IEEE Trans. Cogn. Commun. Netw

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01141 2025-12-02 cs.SE cs.LG 70%

Neural Variable Name Repair: Learning to Rename Identifiers for Readability

神经变量名修复:学习为可读性重命名标识符

Muhammad Yousuf, Akshat Bagade, Chhittebbayi Penugonda, Maanas Baraya

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出神经变量名修复方法,通过微调和重排技术提升代码可读性,实验显示其在精确匹配和部分相似度评分上显著优于基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20793 2025-12-02 cs.CV cs.AI 70%

Rendering-Aware Reinforcement Learning for Vector Graphics Generation

面向渲染的强化学习用于矢量图形生成

Juan A. Rodriguez, Haotian Zhang, Abhay Puri, Aarash Feizi, Rishav Pramanik, Pascal Wichmann, Arnab Mondal, Mohammad Reza Samsami, Rabiul Awal, Perouz Taslakian, Spandana Gella, Sai Rajeswar, David Vazquez, Christopher Pal, Marco Pedersoli

机构 * ServiceNow Research(ServiceNow研究机构) Mila ÉTS Montréal(蒙特利尔ÉTS) Polytechnique Montréal(蒙特利尔Polytechnique) Columbia University(哥伦比亚大学) Stony Brook University(石溪大学) Apple(苹果公司) Google Research(谷歌研究) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) McGill University(麦吉尔大学)

专题命中 指令微调 :language model(abstract);pretraining(abstract);分类 cs.AI

AI总结 本文提出RLRF方法,通过利用渲染反馈提升自回归VLMs中SVG生成的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00902 2025-12-02 cs.DC 67%

Elastic Mixture of Rank-Wise Experts for Knowledge Reuse in Federated Fine-Tuning

弹性秩专家混合用于联邦微调中的知识重用

Yebo Wu, Jingguang Li, Zhijiang Guo, Li Li

专题命中 指令微调 :large language model(abstract);language model(abstract)

AI总结 SmartFed通过弹性秩专家混合和弹性专家配额分配,实现了高效的联邦微调,有效重用已有知识以提升模型性能和训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01993 2025-12-02 cs.RO cs.AI cs.CV cs.LG 62%

RoaD: Rollouts as Demonstrations for Closed-Loop Supervised Fine-Tuning of Autonomous Driving Policies

RoaD: 通过回滚作为演示实现自动驾驶策略的闭环监督微调

Guillermo Garcia-Cobo, Maximilian Igl, Peter Karkus, Zhejun Zhang, Michael Watson, Yuxiao Chen, Boris Ivanovic, Marco Pavone

机构 * NVIDIA Research(NVIDIA研究部) Huawei VN Research Center(华为越南研究中心) Stanford University(斯坦福大学)

专题命中 指令微调 :SFT(abstract);分类 cs.AI、cs.LG

AI总结 RoaD通过利用自动驾驶策略自身的闭环回滚作为额外训练数据,有效缓解协变量偏移问题,提升闭环监督微调性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01460 2025-12-02 cs.CL cs.LG 62%

Enhancing BERT Fine-Tuning for Sentiment Analysis in Lower-Resourced Languages

增强低资源语言情感分析中的BERT微调

Jozef Kubík, Marek Šuppa, Martin Takáč

机构 * Faculty of Mathematics Physics and Informatics(数学物理系) Comenius University in Bratislava(布拉迪斯拉发康门大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究通过结合主动学习与数据聚类策略,提升低资源语言情感分析中BERT模型的微调效果,实现标注节省和性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15605 2025-12-02 cs.RO cs.CL cs.CV 57%

SRPO: Self-Referential Policy Optimization for Vision-Language-Action Models

SRPO:用于视觉-语言-动作模型的自指政策优化

Senyu Fei, Siyin Wang, Li Ji, Ao Li, Shiduo Zhang, Liming Liu, Jinlong Hou, Jingjing Gong, Xianzhong Zhao, Xipeng Qiu

机构 * Fudan University(复旦大学) Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 指令微调 :post-training(abstract);分类 cs.CL

AI总结 SRPO通过自指政策优化方法,利用模型自身生成的成功轨迹作为参考,有效解决VLA-RL中的奖励稀疏问题,实现高成功率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏