arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-06 至 2026-01-06 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 24 篇

2406.17972 2026-01-06 cs.LG cs.CL econ.EM 92%

LABOR-LLM: Language-Based Occupational Representations with Large Language Models

LABOR-LLM:基于语言的职业表示与大语言模型

Susan Athey, Herman Brunborg, Tianyu Du, Ayush Kanodia, Keyon Vafa

机构 * Institute for Computational and Mathematical Engineering(计算与数学工程研究所) Stanford University(斯坦福大学) Graduate School of Business(商学院) Harvard Data Science Initiative(哈佛大学数据科学倡议) Harvard University(哈佛大学)

专题命中 指令微调 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);foundation model(abstract)

AI总结 LABOR-LLM通过大语言模型微调,利用职业历史预测下一个职业,展现优于传统模型的预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18754 2026-01-06 cs.CV cs.AI 90%

COLT: Enhancing Video Large Language Models with Continual Tool Usage

COLT: 通过持续工具使用增强视频大语言模型

Yuyang Liu, Meng Cao, Xinyuan Shi, Xiaondan Liang

机构 * University of Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed大学人工智能学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

AI总结 COLT通过持续工具使用增强视频大语言模型,解决工具数据持续变化的问题,提升视频理解性能。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18076 2026-01-06 cs.CL 89%

Hybrid and Unitary PEFT for Resource-Efficient Large Language Models

混合与单位元PEFT用于资源高效的大型语言模型

Haomin Qi, Zihan Dai, Chengbo Huang

机构 * Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong(信息工程系,香港中文大学) Department of Electrical and Computer Engineering, University of California San Diego, USA(电气与计算机工程系,加州大学圣地亚哥分校) Department of Computer Science, University of Copenhagen, Denmark(计算机科学系,哥本哈根大学) Department of Electrical Engineering, Columbia University, USA(电气工程系,哥伦比亚大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出混合与单位元PEFT方法,通过结合BOFT和LoRA-GA的优势,提升LLM微调效率,减少训练时间和内存使用,适用于资源受限场景。

Comments 11 pages, 2 figures and 7 table

Journal ref American Journal of Computer Science and Technology (Volume 8, Issue 4, 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08873 2026-01-06 cs.AI 88%

UCO: A Multi-Turn Interactive Reinforcement Learning Method for Adaptive Teaching with Large Language Models

UCO:一种用于基于大语言模型的自适应教学的多轮交互强化学习方法

Shouang Wei, Min Zhang, Xin Lin, Bo Jiang, Kun Kuang, Zhongxiang Dai

机构 * East China Normal University(东华大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 UCO通过多轮交互强化学习方法,利用进展奖励和支架奖励函数,提升大语言模型在教育场景中的自适应教学能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01362 2026-01-06 cs.CL cs.LG stat.ML 88%

Investigating the Multilingual Calibration Effects of Language Model Instruction-Tuning

探究语言模型指令微调的多语言校准效应

Jerry Huang, Peng Lu, Qiuhao Zeng, Yusuke Iwasawa, Yutaka Matsuo, Sarath Chandar, Edison Marrese-Taylor, Irene Li

机构 * Mila - Quebec AI Institute(魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) The University of Tokyo(东京大学) Western University(西方大学) Vector Institute(向量研究所) Polytechnique Montréal(蒙特利尔理工学院) CIFAR AI Chair(CIFAR人工智能主席) AIST(日本产业技术综合研究所)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);foundation model(abstract);SFT(abstract)

AI总结 本研究探讨了多语言环境下语言模型指令微调对校准的影响,发现高资源语言SFT数据能显著提升模型置信度,但准确性提升有限,揭示了标准SFT在多语言中的局限性。

Comments Accepted to The 19th Conference of the European Chapter of the Association for Computational Linguistics (EACL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00942 2026-01-06 cs.LG cs.CL 86%

Reliability Under Randomness: An Empirical Analysis of Sparse and Dense Language Models Across Decoding Temperatures

可靠性与随机性:在解码温度下对稀疏和密集语言模型的实证分析

Kabir Grover

机构 * Kabir Grover(独立研究者)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.LG

AI总结 本文研究了稀疏和密集语言模型在不同解码温度下的可靠性,发现指令微调比架构稀疏性对稳定性影响更大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22615 2026-01-06 cs.CV cs.CL 83%

Dream-VL & Dream-VLA: Open Vision-Language and Vision-Language-Action Models with Diffusion Language Model Backbone

Dream-VL & Dream-VLA: 基于扩散语言模型的开放视觉语言和视觉语言-动作模型

Jiacheng Ye, Shansan Gong, Jiahui Gao, Junming Fan, Shuang Wu, Wei Bi, Haoli Bai, Lifeng Shang, Lingpeng Kong

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 基于扩散语言模型构建的Dream-VL和Dream-VLA在视觉语言和视觉语言-动作任务中表现出色,实现了领先的性能。

Comments Add real-world experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23260 2026-01-06 cs.CL cs.AI cs.LG 80%

Interpretable Safety Alignment via SAE-Constructed Low-Rank Subspace Adaptation

通过SAE构造的低秩子空间适应实现可解释的安全对齐

Dianyun Wang, Qingsen Ma, Yuhu Shang, Zhifeng Lu, Zhenbo Xu, Lechen Ning, Huijia Wu, Zhaofeng He

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 SAILS通过SAE构造低秩子空间实现安全对齐,提升安全性能并保持参数效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01213 2026-01-06 cs.CV cs.LG 79%

Promptable Foundation Models for SAR Remote Sensing: Adapting the Segment Anything Model for Snow Avalanche Segmentation

可用于SAR遥感的可提示基础模型:为雪崩分割适应Segment Anything模型

Riccardo Gelato, Carlo Sgaravatti, Jakob Grahn, Giacomo Boracchi, Filippo Maria Bianchi

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

AI总结 本文提出基于Segment Anything Model的可提示基础模型,用于SAR遥感中雪崩分割任务,通过适配器、多编码器和提示工程策略提升标注效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26609 2026-01-06 cs.CV cs.LG eess.IV 79%

FARM: Fine-Tuning Geospatial Foundation Models for Intra-Field Crop Yield Regression

FARM:针对田间作物产量回归的地理空间基础模型微调

Shayan Nejadshamsi, Yuanyuan Zhang, Shadi Zaki, Brock Porth, Lysa Porth, Vahab Khoshdel

机构 * University of Manitoba(曼尼托巴大学) AIRM Consulting Ltd.(AIRM咨询有限公司)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

AI总结 FARM通过微调地理空间基础模型,实现了高分辨率田间作物产量预测,优于传统方法,为精准农业提供更有效的工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01827 2026-01-06 cs.CL cs.LG 79%

Aspect Extraction from E-Commerce Product and Service Reviews

从电子商务产品和服务评论中提取方面

Valiant Lance D. Dionela, Fatima Kriselle S. Dy, Robin James M. Hombrebueno, Aaron Rae M. Nicolas, Charibeth K. Cheng, Raphael W. Gonda

机构 * De La Salle University(德拉萨大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出了一种针对Taglish的综合方面提取流程,结合规则、LLM和微调技术,通过生成式LLM在隐式方面处理上取得高性能,展示了在混合语言环境中的ABSA增强能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02128 2026-01-06 cs.CL eess.AS 77%

Towards Multi-Level Transcript Segmentation: LoRA Fine-Tuning for Table-of-Contents Generation

迈向多级转录分割:LoRA微调用于目录生成

Steffen Freisinger, Philipp Seeberger, Thomas Ranzenberger, Tobias Bocklet, Korbinian Riedhammer

机构 * Technische Hochschule Nürnberg(纽伦堡技术大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出基于LoRA微调的多级转录分割方法,通过整合语音停顿特征,提升主题和子主题边界识别的准确性。

Comments Published in Proceedings of Interspeech 2025. Please cite the proceedings version (DOI: 10.21437/Interspeech.2025-2792)

Journal ref Proceedings of Interspeech 2025, pp. 276-280

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01915 2026-01-06 cs.CV 75%

TalkPhoto: A Versatile Training-Free Conversational Assistant for Intelligent Image Editing

TalkPhoto: 一种多功能的无需训练的对话式智能图像编辑助手

Yujie Hu, Zecheng Tang, Xu Jiang, Weiqi Li, Jian Zhang

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 TalkPhoto通过对话交互实现无需训练的多功能图像编辑,利用提示模板分层调用现有高级编辑方法,提升编辑精度与质量。

Comments a Conversational Assistant for Intelligent Image Editing

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01184 2026-01-06 cs.CR 75%

SecureCodeRL: Security-Aware Reinforcement Learning for Code Generation with Partial-Credit Rewards

SecureCodeRL: 为代码生成的具有安全意识的强化学习

Suryansh Singh Sijwali, Suman Saha

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 SecureCodeRL通过部分信用奖励提升代码生成的语法正确性和安全性,实现更高的测试通过率和更清洁的代码输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20629 2026-01-06 cs.LG cs.AI 73%

Learning Evolving Latent Strategies for Multi-Agent Language Systems without Model Fine-Tuning

为多智能体语言系统学习演化的潜在策略而无需模型微调

Wenlong Tang

机构 * Independent Researcher(独立研究者)

专题命中 指令微调 :language model(abstract);language agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出一种无需微调的多智能体语言系统框架,通过双环架构实现持续策略进化,利用外部潜在空间提供可解释的抽象战略表示。

Comments 17 pages, 5 figures. Code available at https://github.com/wltang-dev/Latent-Strategy-RL-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03802 2026-01-06 cs.LG cs.AI 73%

Balancing Fidelity and Plasticity: Aligning Mixed-Precision Fine-Tuning with Linguistic Hierarchies

在保真度与可塑性之间寻求平衡:将混合精度微调与语言层次结构对齐

Changhai Zhou, Shiyang Zhang, Yuhua Zhou, Qian Qiao, Jun Gao, Shichao Weng, Weizhong Zhang, Cheng Jin

机构 * Fudan University(复旦大学) Yale University(耶鲁大学) Zhejiang University(浙江大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 QR-Adaptor通过联合优化量化位宽和LoRA秩,解决混合精度微调中保真度与可塑性的平衡问题,实现内存与性能的高效资源分配。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01060 2026-01-06 cs.CL 70%

Unsupervised Text Style Transfer for Controllable Intensity

无监督文本风格迁移用于可控强度

Shuhuan Gu, Wenbiao Tao, Xinchen Ma, Kangkang He, Ye Guo, Xiang Li, Yunshi Lan

机构 * East China Normal University(东华大学) Baowu Group(宝武集团)

专题命中 指令微调 :LLM(abstract);SFT(abstract);分类 cs.CL

AI总结 本文提出了一种SFT-then-PPO方法,通过精心设计的奖励函数提升LLM在可控强度下的文本风格迁移性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02151 2026-01-06 cs.LG cs.AI cs.CL 67%

Entropy-Adaptive Fine-Tuning: Resolving Confident Conflicts to Mitigate Forgetting

熵适应微调:解决自信冲突以缓解遗忘

Muxi Diao, Lele Yang, Wuxuan Gong, Yutong Zhang, Zhonghao Yan, Yufei Han, Kongming Liang, Weiran Xu, Zhanyu Ma

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Zhongguancun Academy(中关村学院)

专题命中 指令微调 :SFT(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 熵适应微调通过利用令牌级熵区分知识不确定性和冲突,缓解微调过程中的遗忘问题,提升模型在多个领域的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20113 2026-01-06 cs.LG cs.AI 62%

Discovering Association Rules in High-Dimensional Small Tabular Data

在高维小表格数据中发现关联规则

Erkan Karabulut, Daniel Daza, Paul Groth, Victoria Degeler

机构 * University of Amsterdam(阿姆斯特丹大学) Amsterdam University Medical Center(阿姆斯特丹大学医学中心)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出两种改进Aerial+的方法,用于在高维低数据量情况下提升关联规则挖掘的性能。

Comments Published version is available at https://ceur-ws.org/Vol-4125/paper_26.pdf

Journal ref Proc. 1st Int. Workshop on Advanced Neuro-Symbolic Applications (ANSyA 2025), CEUR Workshop Proc., vol. 4125, pp. 105-113, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12015 2026-01-06 cs.LG cs.AI cs.CV 62%

EMLoC: Emulator-based Memory-efficient Fine-tuning with LoRA Correction

EMLoC:基于模拟器的内存高效微调与LoRA校正

Hsi-Che Lin, Yu-Chu Yu, Kai-Po Chang, Yu-Chiang Frank Wang

机构 * Graduate Institute of Communication Engineering, National Taiwan University(国立台湾大学通信工程研究所) NVIDIA

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 EMLoC通过基于模拟器的内存高效微调与LoRA校正,实现大模型在有限内存下高效适应不同任务的需求。

Comments Accepted to the 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Project page: https://hsi-che-lin.github.io/EMLoC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07890 2026-01-06 cs.CL cs.AI 62%

GRAPHMOE: Amplifying Cognitive Depth of Mixture-of-Experts Network via Introducing Self-Rethinking Mechanism

GRAPHMOE: 通过引入自我反思机制提升混合专家网络的认知深度

Bo Lv, Chen Tang, Zifan Zheng, Bohao Yang, Kun Zhao, Ning Liao, Xiaoxing Wang, Feiyu Xiong, Zhiyu Li, Nayu Liu, Jingchi Jiang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所) The University of Manchester(曼彻斯特大学) The University of Pittsburgh(匹兹堡大学) Harbin Institute of Technology(哈尔滨工业大学) University of Sydney(悉尼大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 GRAPHMOE通过引入自我反思机制,提升混合专家网络的认知深度,实现语言模型的先进性能。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02315 2026-01-06 cs.CV 50%

Prithvi-Complimentary Adaptive Fusion Encoder (CAFE): unlocking full-potential for flood inundation mapping

普里提维-互补自适应融合编码器(CAFE):解锁洪水淹没制图的全部潜力

Saurabh Kaushik, Lalit Maurya, Beth Tellman

机构 * Center for Sustainability and the Global Environment (SAGE), University of Wisconsin–Madison(可持续性与全球环境中心(SAGE),威斯康星大学麦迪逊分校) Portsmouth AI and Data Science Centre (PAIDS), School of Computing, University of Portsmouth(波特兰人工智能与数据科学中心(PAIDS),计算学院,波特兰大学)

专题命中 指令微调 :foundation model(abstract)

AI总结 普里提维-互补自适应融合编码器(CAFE)通过融合多通道多模态数据提升洪水制图的分割性能。

Comments Accepted at CV4EO Workshop @ WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02249 2026-01-06 cs.CV 50%

SLGNet: Synergizing Structural Priors and Language-Guided Modulation for Multimodal Object Detection

SLGNet: 结合结构先验与语言引导调制的多模态目标检测

Xiantai Xiang, Guangyao Zhou, Zixiao Wen, Wenshuai Li, Ben Niu, Feng Wang, Lijia Huang, Qiantong Wang, Yuhan Liu, Zongxu Pan, Yuxin Hu

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所) Key Laboratory of Target Cognition and Application Technology, Chinese Academy of Sciences(中国科学院目标认知与应用技术重点实验室) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件学院)

专题命中 指令微调 :foundation model(abstract)

AI总结 SLGNet通过结合结构先验与语言引导调制,在冻结的ViT基础上实现高效多模态目标检测,提升环境适应性和检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01416 2026-01-06 cs.CV 50%

AirSpatialBot: A Spatially-Aware Aerial Agent for Fine-Grained Vehicle Attribute Recognization and Retrieval

AirSpatialBot: 一种空间感知的空中智能体用于细粒度车辆属性识别与检索

Yue Zhou, Ran Ding, Xue Yang, Xue Jiang, Xingzhao Liu

机构 * Department of Electronic Engineering, Shanghai Jiao Tong University(电子工程系,上海交通大学) Department of Automation, Shanghai Jiao Tong University(自动化系,上海交通大学)

专题命中 指令微调 :language model(abstract)

AI总结 AirSpatialBot通过空间感知的VLM和两阶段训练策略,实现细粒度车辆属性识别与检索,解决遥感图像中的空间理解难题。

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏