arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-15 至 2025-12-15 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11 篇

2502.11028 2025-12-15 cs.CL cs.AI 91%

Mind the Confidence Gap: Overconfidence, Calibration, and Distractor Effects in Large Language Models

注意置信差距:大型语言模型中的过度自信、校准与干扰效应

Prateek Chhikara

机构 * University of Southern California(美国南加州大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);RLHF(abstract)

AI总结 本研究探讨了大型语言模型中的过度自信问题,通过引入干扰项显著改善校准,提出针对性的改进策略以提升模型可靠性。

Comments Published in Transactions on Machine Learning Research (TMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26898 2025-12-15 cs.LG 89%

Integrating Ontologies with Large Language Models for Enhanced Control Systems in Chemical Engineering

将本体与大语言模型结合以增强化工工程中的控制系统

Crystal Su, Kuai Yu, Jingrui Zhang, Mingyuan Shao, Daniel Bauer

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出结合本体的LLM框架,用于增强化工工程控制系统,通过结构化知识与生成推理结合,提升过程控制和安全分析的可解释性和可靠性。

Comments This paper is withdrawn due to issues with attribution and citation accuracy

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10501 2025-12-15 cs.AI 85%

Zero-shot 3D Map Generation with LLM Agents: A Dual-Agent Architecture for Procedural Content Generation

无监督3D地图生成与LLM代理:一种双代理架构用于程序化内容生成

Lim Chien Her, Ming Yan, Yunshu Bai, Ruihao Li, Hao Zhang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种双代理架构,利用LLM代理实现无监督3D地图生成,通过迭代推理优化参数配置,提升PCG指令遵循能力。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10493 2025-12-15 cs.SE 85%

Decoding Human-LLM Collaboration in Coding: An Empirical Study of Multi-Turn Conversations in the Wild

解码人类与大语言模型在编程中的协作:多轮对话的真实世界经验研究

Binquan Zhang, Li Zhang, Haoyuan Zhang, Fang Liu, Song Wang, Bo Shen, An Fu, Lin Shi

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究通过实证分析探讨人类与LLM在编程中的协作机制,发现任务类型影响交互模式,LLM在调试和重构任务中表现欠佳,用户满意度受任务类型影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11755 2025-12-15 cs.CL 83%

SUMFORU: An LLM-Based Review Summarization Framework for Personalized Purchase Decision Support

SUMFORU: 一种基于LLM的个性化购买决策支持的评论摘要框架

Yuming Feng, Xinrui Jiang

专题命中 指令微调 :LLM(title,abstract);SFT(abstract);分类 cs.CL

AI总结 SUMFORU通过可调节的多元对齐方法,实现个性化购买决策支持,结合高质量数据管道和两阶段对齐流程,提升摘要的一致性、基础性和偏好对齐性能。

Comments Code available at https://github.com/Harry20030331/SumForU

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11218 2025-12-15 cs.RO cs.CV 82%

Seeing to Act, Prompting to Specify: A Bayesian Factorization of Vision Language Action Policy

视觉与语言动作政策的贝叶斯分解:看见以行动,提示以指定

Kechun Xu, Zhenjie Zhu, Anzhe Chen, Shuqi Zhao, Qing Huang, Yifei Yang, Haojian Lu, Rong Xiong, Masayoshi Tomizuka, Yue Wang

机构 * Zhejiang University(浙江大学) UC Berkeley(伯克利大学)

专题命中 指令微调 :prompting(title);language model(abstract);foundation model(abstract)

AI总结 本文提出BayesVLA,通过贝叶斯分解策略,解决VLA模型中因模态不平衡导致的灾难性遗忘问题,提升泛化能力和指令遵循性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16134 2025-12-15 cs.CL cs.LG 79%

Beyond Early-Token Bias: Model-Specific and Language-Specific Position Effects in Multilingual LLMs

超越早期词偏见:多语言大语言模型中的模型特定和语言特定的位置效应

Mikhail Menschikov, Alexander Kharitonov, Maiia Kotyga, Vadim Porvatov, Anna Zhukovskaya, David Kagramanyan, Egor Shvetsov, Evgeny Burnaev

机构 * ITMO Applied AI(ITMO应用人工智能) SberAI Applied AI(应用人工智能) Lomonosov MSU(罗蒙诺索夫莫斯科国立大学) HSE University(俄罗斯高等经济大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

AI总结 研究揭示了多语言大语言模型中位置偏见的模型和语言特异性,发现部分模型偏好后期位置,提示策略影响准确性,且中间上下文信息对模型输出熵无显著影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24379 2025-12-15 cs.CV cs.AI 77%

Any2Caption:Interpreting Any Condition to Caption for Controllable Video Generation

Any2Caption:任何条件到字幕以实现可控视频生成

Shengqiong Wu, Weicai Ye, Jiahao Wang, Quande Liu, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai, Shuicheng Yan, Hao Fei, Tat-Seng Chua

机构 * Kuaishou Technology(快手科技) National University of Singapore(新加坡国立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI

AI总结 Any2Caption通过多模态大语言模型实现任何条件到字幕的可控视频生成,提升视频生成的可控性和质量。

Comments Project Page: https://sqwu.top/Any2Cap/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02630 2025-12-15 cs.LG cs.CL 73%

HyperAdaLoRA: Accelerating LoRA Rank Allocation During Training via Hypernetworks without Sacrificing Performance

HyperAdaLoRA: 通过超网络在训练过程中加速LoRA秩分配而不牺牲性能

Hao Zhang, Zhenjia Li, Runfeng Bao, Yifan Gao, Xi Xiao, Heng Zhang, Shuyang Zhang, Bo Huang, Yuhang Wu, Tianyang Wang, Hao Xu

机构 * Harvard University(哈佛大学) University of Chinese Academy of Sciences(中国科学院大学) Fudan University(复旦大学) University of Chicago(芝加哥大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) South China Normal University(华南师范大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai University of Engineering Science(上海工程技术大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 HyperAdaLoRA通过超网络实现训练过程中LoRA秩分配的加速,提升收敛速度同时保持性能

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11366 2025-12-15 cs.CL 70%

qa-FLoRA: Data-free query-adaptive Fusion of LoRAs for LLMs

qa-FLoRA: 无数据查询自适应融合LoRAs用于大语言模型

Shreya Shukla, Aditya Sriram, Milinda Kuppur Narayanaswamy, Hiteshi Jain

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 qa-FLoRA通过动态计算层级融合权重,无需数据和训练,实现LoRA的查询自适应融合,有效提升多领域任务性能。

Comments Accepted at AAAI 2026 (Main Technical Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10868 2025-12-15 cs.LG cs.AI cs.CL 67%

Large Continual Instruction Assistant

大规模持续指令助手

Jingyang Qiao, Zhizhong Zhang, Xin Tan, Yanyun Qu, Shouhong Ding, Yuan Xie

机构 * East China Normal University(东华大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Xiamen University(厦门大学) Tencent YouTu Lab(腾讯YouTu实验室)

专题命中 指令微调 :instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种持续指令微调框架,通过自适应平衡塑性与稳定性,提升模型抗遗忘能力和整体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏