arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-22 至 2025-12-22 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 12 篇

2512.17344 2025-12-22 cs.CL 88%

Governance-Aware Hybrid Fine-Tuning for Multilingual Large Language Models

面向治理的混合微调方法用于多语言大语言模型

Haomin Qi, Chengbo Huang, Zihan Dai, Yunkai Gao

机构 * University of California San Diego(加州大学圣地亚哥分校) Columbia University(哥伦比亚大学) University of Copenhagen(哥本哈根大学) Duke University(杜克大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出面向治理的混合微调方法,通过结合低秩更新和正交变换提升多语言大模型的适应效率与准确性。

Comments 11 pages, 4 figures, 6 tables. arXiv admin note: substantial text overlap with arXiv:2507.18076

Journal ref 2025 IEEE International Conference on Big Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09707 2025-12-22 eess.AS cs.CL cs.HC 85%

Fine-Tuning Large Audio-Language Models with LoRA for Precise Temporal Localization of Prolonged Exposure Therapy Elements

通过LoRA微调大音频-语言模型实现精确的延长暴露疗法元素时间定位

Suhas BN, Andrew M. Sherrill, Jyoti Alaparthi, Dominik Mattioli, Rosa I. Arriaga, Chris W. Wiese, Saeed Abdullah

机构 * 1College of Information Sciences \& Technology, The Pennsylvania State University, USA 2Department of Psychiatry \& Behavioral Sciences, Emory University, USA 3School of Interactive Computing, Georgia Institute of Technology, USA 4School of Psychology, Georgia Institute of Technology, USA

专题命中 指令微调 :language model(title,abstract);LLM(abstract);prompting(abstract);分类 cs.CL

AI总结 通过LoRA微调大音频-语言模型,实现对延长暴露疗法关键元素的精确时间定位,提升治疗师忠实性评估的效率和准确性。

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17636 2025-12-22 cs.LG cs.AI 82%

Trust-Region Adaptive Policy Optimization

信任区域自适应策略优化

Mingyu Su, Jian Guan, Yuxian Gu, Minlie Huang, Hongning Wang

机构 * The Conversational AI (CoAI) Group, Tsinghua University(清华大学对话式人工智能(CoAI)小组)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

AI总结 TRAPO通过结合SFT和RL的训练流程,提升大语言模型的推理能力,实现更稳定的训练和更高效的探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01939 2025-12-22 astro-ph.IM astro-ph.SR cs.AI cs.LG 82%

SpecCLIP: Aligning and Translating Spectroscopic Measurements for Stars

SpecCLIP:对齐和翻译恒星光谱测量

Xiaosheng Zhao, Yang Huang, Guirong Xue, Xiao Kong, Jifeng Liu, Xiaoyu Tang, Timothy C. Beers, Yuan-Sen Ting, A-Li Luo

机构 * School of Astronomy Space Science, University of Chinese Academy of Sciences, Beijing 100049, People's Republic of China National Astronomical Observatories, Chinese Academy of Sciences, Beijing 100012, People's Republic of China Department of Physics \& Astronomy, The Johns Hopkins University, Baltimore, MD 21218, USA Zhejiang Laboratory, Hangzhou 311121, People's Republic of China Research Center for Astronomical Computing, Zhejiang Laboratory, Hangzhou 311121, People's Republic of China Department of Physics Astronomy, University of Notre Dame, Notre Dame, IN 46556, USA Joint Institute for Nuclear Astrophysics -- Center for the Evolution of the Elements (JINA-CEE), USA Department of Astronomy, The Ohio State University, 140 West 18th Avenue, Columbus, OH 43210, USA Center for Cosmology AstroParticle Physics (CCAPP), The Ohio State University, Columbus, OH 43210, USA

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 SpecCLIP通过对比学习和光谱意识解码器提升恒星光谱分析的精度和应用灵活性。

Comments 29 pages, 8 figures, 6 tables. Accepted for publication in ApJ. Comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17093 2025-12-22 cs.AI cs.CL 82%

A Solver-in-the-Loop Framework for Improving LLMs on Answer Set Programming for Logic Puzzle Solving

一种用于改进逻辑谜题求解的LLM在Answer Set Programming中的求解器循环框架

Timo Pierre Schrader, Lukas Lange, Tobias Kaminski, Simon Razniewski, Annemarie Friedrich

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出了一种求解器循环框架,通过引导求解器进行指令微调,提升LLM在Answer Set Programming中生成逻辑谜题解答的性能。

Comments 15 pages, 7 figures, accepted at AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17292 2025-12-22 cs.CV 78%

Vision-Language Model Guided Image Restoration

基于视觉语言模型的图像修复

Cuixin Yang, Rongkang Dong, Kin-Man Lam

机构 * Department of Electrical and Electronic Engineering(电子与电气工程系)

专题命中 指令微调 :language model(title,abstract)

AI总结 本文提出VLMIR框架,利用视觉语言模型的先验知识提升图像修复性能,通过两阶段方法结合特征提取与扩散模型实现更高质量的图像恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18686 2025-12-22 cs.LG 77%

Hierarchical Multimodal LLMs with Semantic Space Alignment for Enhanced Time Series Classification

具有语义空间对齐的层次多模态大语言模型用于增强的时间序列分类

Xiaoyu Tao, Tingyue Pan, Mingyue Cheng, Yucong Luo, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 HiTime通过层次多模态大语言模型和语义空间对齐,提升时间序列分类的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17251 2025-12-22 cs.CR cs.AI cs.LG 74%

AlignDP: Hybrid Differential Privacy with Rarity-Aware Protection for LLMs

AlignDP: 用于大语言模型的混合差分隐私与稀有性感知保护

Madhava Gaikwad

机构 * Microsoft(微软)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG;LLM(comments)

AI总结 AlignDP通过混合差分隐私与稀有性感知保护,有效阻止大语言模型的知识转移,通过PAC和RAPPOR技术实现稀有和非稀有字段的隐私保护。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: LOCK-LLM Work-shop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17630 2025-12-22 cs.CL cs.LG 73%

Confidence-Credibility Aware Weighted Ensembles of Small LLMs Outperform Large LLMs in Emotion Detection

具有置信度-可信度意识的轻量级LLM加权集成在情绪检测中优于大LLM

Menna Elgabry, Ali Hamdi

机构 * Department of Computer Science(计算机科学系) MSA University(MSA大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种结合多种小模型的集成方法,在情绪检测任务中超越大模型性能。

Comments Accepted at IRICT 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17519 2025-12-22 cs.CR cs.AI 70%

Key-Conditioned Orthonormal Transform Gating (K-OTG): Multi-Key Access Control with Hidden-State Scrambling for LoRA-Tuned Models

基于密钥的正交变换门控(K-OTG):多密钥访问控制与隐藏状态混淆用于LoRA微调模型

Muhammad Haris Khan

机构 * University of Copenhagen(哥本哈根大学)

专题命中 指令微调 :language model(abstract);instruction tuning(abstract);分类 cs.AI

AI总结 K-OTG通过多密钥访问控制与隐藏状态混淆,实现对LoRA微调模型的授权保护,防止未经授权的使用同时保持授权功能的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17194 2025-12-22 cs.AI 70%

MMRAG-RFT: Two-stage Reinforcement Fine-tuning for Explainable Multi-modal Retrieval-augmented Generation

MMRAG-RFT: 两阶段强化微调用于可解释的多模态检索增强生成

Shengwei Zhao, Jingwen Yao, Sitong Wei, Linhai Xu, Yuying Liu, Dong Zhang, Zhiqiang Tian, Shaoyi Du

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MMRAG-RFT通过两阶段强化微调提升多模态检索增强生成的可解释性,实现更清晰的推理逻辑和更优的生成效果。

Comments This paper was accepted to AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17640 2025-12-22 cs.CV 67%

Generative Human-Object Interaction Detection via Differentiable Cognitive Steering of Multi-modal LLMs

通过可微认知引导的多模态大语言模型进行生成式人类-物体交互检测

Zhaolin Cai, Huiyu Duan, Zitong Xu, Fan Li, Zhi Liu, Jing Liu, Wei Shen, Xiongkuo Min, Guangtao Zhai

机构 * Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(上海交通大学图像通信与网络工程研究所) Xi’an Jiao Tong University(西安交通大学) Shandong University(山东大学) Tianjin University(天津大学)

专题命中 指令微调 :large language model(abstract);language model(abstract)

AI总结 本文提出GRASP-HO框架,通过可微认知引导的多模态大语言模型实现生成式人类-物体交互检测,解决封闭集分类与开放词汇生成之间的监督不匹配问题,实现判别感知与生成推理的统一。

详情

展开后加载摘要…

URL PDF HTML 收藏