arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-18 至 2025-12-18 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 6 篇

2512.15634 2025-12-18 cs.CL cs.AI cs.LG 80%

How Much is Too Much? Exploring LoRA Rank Trade-offs for Retaining Knowledge and Domain Robustness

过多的幅度有多大?探索LoRA秩的权衡以保留知识和领域鲁棒性

Darshita Rathore, Vineet Kumar, Chetna Bansal, Anindya Moitra

机构 * PayPal

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文探讨LoRA秩配置在保留知识和领域鲁棒性方面的权衡,通过多任务评估展示LoRA在推理任务中的竞争力。

Comments Accepted at AACL IJCNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15226 2025-12-18 cs.CL cs.AI 79%

Yes-MT's Submission to the Low-Resource Indic Language Translation Shared Task in WMT 2024

Yes-MT在WMT 2024低资源印地语翻译共享任务中的提交

Yash Bhaskar, Parameswari Krishnamurthy

机构 * IIIT Hyderabad(IIIT海得拉巴)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 Yes-MT在WMT 2024低资源印地语翻译共享任务中,通过多种方法探索低资源翻译挑战,展示了LLMs在微调下的表现。

Comments Accepted at WMT 2024

Journal ref In Proceedings of the Ninth Conference on Machine Translation (WMT 2024), pages 788-792, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07417 2025-12-18 cs.CR cs.AI cs.CL 79%

May I have your Attention? Breaking Fine-Tuning based Prompt Injection Defenses using Architecture-Aware Attacks

请允许我注意:利用架构感知攻击打破基于微调的提示注入防御

Nishit V. Pandya, Andrey Labunets, Sicun Gao, Earlence Fernandes

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种基于注意力的攻击算法,揭示了现有白盒提示注入防御的不足,攻击成功率高达85-95%

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23012 2025-12-18 cs.CV 78%

Multi-label classification for multi-temporal, multi-spatial coral reef condition monitoring using vision foundation model with adapter learning

利用视觉基础模型与适配器学习进行多时序、多空间珊瑚礁状态监测的多标签分类

Xinlei Shao, Hongruixuan Chen, Fan Zhao, Kirsty Magson, Jundong Chen, Peiran Li, Jiaqi Wang, Jun Sasaki

机构 * Department of Socio-Cultural Environmental Studies, Graduate School of Frontier Sciences, The University of Tokyo(社会文化环境研究部门,前沿科学研究生院,东京大学) Department of Environment Systems, Graduate School of Frontier Sciences, The University of Tokyo(环境系统部门,前沿科学研究生院,东京大学) New Heaven Reef Conservation Program, Koh Tao, Surat Thani, 84360, Thailand(新天堂珊瑚礁保护计划, Koh Tao, Surat Thani, 84360, Thailand) Data Science and AI Innovation Research Promotion Center, Shiga University(数据科学与人工智能创新研究促进中心,Shiga大学) Interfaculty Initiative in Information Studies, The University of Tokyo(跨学际信息研究倡议,东京大学)

专题命中 指令微调 :foundation model(title,abstract)

AI总结 本研究提出利用DINOv2视觉基础模型与LoRA适配器学习方法,实现多时序、多空间珊瑚礁状态的高效多标签分类,提升了分类精度并减少了计算资源消耗。

Journal ref Marine Pollution Bulletin, Vol. 223, Article 119054, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14741 2025-12-18 cs.CR cs.AI 70%

Persistent Backdoor Attacks under Continual Fine-Tuning of LLMs

在LLM持续微调下的持久后门攻击

Jing Cui, Yufei Han, Jianbin Jiao, Junge Zhang

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出P-Trojan算法,研究在LLM持续微调中后门的持久性问题,实验显示其在保持清洁任务准确性的同时实现高持久性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14895 2025-12-18 cs.LG cs.AI 62%

Imitation Learning for Multi-turn LM Agents via On-policy Expert Corrections

通过在线专家纠正实现多轮LM代理的模仿学习

Niklas Lauffer, Xiang Deng, Srivatsa Kundurthy, Brad Kenstler, Jeff Da

专题命中 指令微调 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过在线专家纠正解决多轮LM代理模仿学习中的协变量偏移问题,实验显示在软件工程任务中效果优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏