arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-12 至 2025-12-12 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11 篇

2512.10150 2025-12-12 cs.CL cs.AI 88%

Unforgotten Safety: Preserving Safety Alignment of Large Language Models with Continual Learning

遗忘的安全性:通过持续学习保持大型语言模型的安全对齐

Lama Alssum, Hani Itani, Hasan Abed Al Kader Hammoud, Philip Torr, Adel Bibi, Bernard Ghanem

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文通过持续学习方法有效缓解大型语言模型在适应新任务时的安全退化问题,证明了持续学习在保持模型安全性和任务实用性方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15456 2025-12-12 cs.CL 87%

Teaching Language Models to Evolve with Users: Dynamic Profile Modeling for Personalized Alignment

教导语言模型与用户共同进化:面向个性化对齐的动态资料模型

Weixiang Zhao, Xingyu Sui, Yulin Hu, Jiahe Guo, Haixiao Liu, Biye Li, Yanyan Zhao, Bing Qin, Ting Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

AI总结 本研究提出RLPA框架,通过动态资料推断提升个性化对话性能,Qwen-RLPA在多个基准测试中超越现有方法。

Comments NeurIPS 2025 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10043 2025-12-12 cs.LG 85%

Local LLM Ensembles for Zero-shot Portuguese Named Entity Recognition

本地大语言模型集成用于零样本葡萄牙命名实体识别

João Lucas Luz Lima Sarcinelli, Diego Furtado Silva

机构 * Instituto de Ciências Matemáticas e Computação, Universidade de São Paulo(数学与计算科学学院,圣保罗大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种本地大语言模型集成方法,用于零样本葡萄牙命名实体识别,通过选择最优模型组合提升性能,无需标注数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10750 2025-12-12 cs.CV 85%

LDP: Parameter-Efficient Fine-Tuning of Multimodal LLM for Medical Report Generation

LDP:多模态大语言模型在医疗报告生成中的参数高效微调

Tianyu Zhou, Junyi Tang, Zehui Li, Dahong Qian, Suncheng Xiang

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);preference optimization(abstract)

AI总结 LDP通过多模态大语言模型和参数高效微调技术,提升结肠镜息肉诊断报告的准确性和效率,显著降低训练成本并获得专家评分。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12820 2025-12-12 cs.AI cs.CL 81%

Emotional Support with LLM-based Empathetic Dialogue Generation

基于大语言模型的共情对话生成情感支持

Shiquan Wang, Ruiyu Fang, Zhongjiang He, Shuangyong Song, Yongxiang Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom Corp Ltd(人工智能研究院(TeleAI),中国电信股份有限公司)

专题命中 指令微调 :LLM(title);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于大语言模型和提示工程的共情对话生成方法,在NLPCC 2025任务中实现第二名,展示了LLM与适应方法结合在情感支持任务中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00614 2025-12-12 cs.LG physics.chem-ph 79%

RoFt-Mol: Benchmarking Robust Fine-Tuning with Molecular Graph Foundation Models

RoFt-Mol:基于分子图基础模型的鲁棒微调基准测试

Shikun Liu, Deyu Zou, Nima Shoghi, Victor Fung, Kai Liu, Pan Li

机构 * Georgia Institute of Technology(佐治亚理工学院) The Chinese University of Hong Kong(香港中文大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

AI总结 RoFt-Mol通过结合简单权重插值与复杂权重集合微调方法,提升分子图基础模型在回归和分类任务中的鲁棒微调性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14315 2025-12-12 cs.CL 79%

Mitigating Forgetting in LLM Fine-Tuning via Low-Perplexity Token Learning

通过低困惑度标记学习缓解大语言模型微调中的遗忘问题

Chao-Chung Wu, Zhi Rui Tam, Chieh-Yen Lin, Yun-Nung Chen, Shao-Hua Sun, Hung-yi Lee

机构 * Appier AI Research(Appier AI研究院) National Taiwan University(国立台湾大学)

专题命中 指令微调 :LLM(title,abstract);分类 cs.CL

AI总结 本文通过降低标记困惑度来缓解大语言模型微调后的遗忘问题,发现使用LLM生成数据可提升目标任务性能并减少非目标任务退化。

Comments The Thirty-ninth Annual Conference on Neural Information Processing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10172 2025-12-12 cs.HC cs.AI cs.CL 79%

Offscript: Automated Auditing of Instruction Adherence in LLMs

Offscript: LLMs指令遵循自动审计

Nicholas Clark, Ryan Bai, Tanu Mitra

机构 * University of Washington Information School Seattle Washington USA University of Washington\ G. Allen School of Computer Science \& Engineering Seattle Washington USA University of Washington Information School University of Washington\ G. Allen School of Computer Science \& Engineering

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 Offscript通过自动化审计检测LLM指令遵循问题,揭示86.4%的对话中存在潜在违规行为,其中22.2%经人工确认为实质性违规。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10545 2025-12-12 cs.CL 77%

XDoGE: Multilingual Data Reweighting to Enhance Language Inclusivity in LLMs

XDoGE: 多语言数据重新加权以增强大语言模型中的语言包容性

Iñaki Lacunza, José Javier Saiz, Alexander Shvets, Aitor Gonzalez-Agirre, Marta Villegas

机构 * Language Technologies Lab(语言技术实验室) Barcelona Supercomputing Center(巴塞罗那超级计算中心)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 XDoGE通过多语言数据重新加权提升大语言模型的语言包容性,优化语言分布并改进模型性能。

Comments Accepted and presented at the LLMs4All workshop at the IEEE BigData 2025 Conference, Macau - December 8-11, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00846 2025-12-12 cs.CV 75%

AFRAgent : An Adaptive Feature Renormalization Based High Resolution Aware GUI agent

AFRAgent:一种基于自适应特征归一化的高分辨率感知GUI代理

Neeraj Anand, Rishabh Jain, Sohan Patnaik, Balaji Krishnamurthy, Mausoom Sarkar

机构 * Media and Data Science Research, Adobe(Adobe媒体与数据科学研究所)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 AFRAgent通过自适应特征归一化技术,在保持高分辨率细节的同时,实现了更高效的GUI自动化性能,比现有模型小四分之一。

Comments Accepted at WACV 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10691 2025-12-12 cs.AI cs.CV 70%

Enhancing Radiology Report Generation and Visual Grounding using Reinforcement Learning

通过强化学习增强放射学报告生成和视觉基础识别

Benjamin Gundersen, Nicolas Deperrois, Samuel Ruiperez-Campillo, Thomas M. Sutter, Julia E. Vogt, Michael Moor, Farhad Nooralahzadeh, Michael Krauthammer

机构 * University of Zurich(苏黎世大学) ETH Zurich(苏黎世联邦理工学院) Zurich University of Applied Sciences(苏黎世应用科学大学)

专题命中 指令微调 :language model(abstract);SFT(abstract);分类 cs.AI

AI总结 本研究通过强化学习和思考机制提升放射学报告生成和视觉基础识别的性能,展示了在医学VLMs中RL作为SFT的有效补充。

Comments 10 pages main text (3 figures, 3 tables), 31 pages in total

详情

展开后加载摘要…

URL PDF HTML 收藏