arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-11 至 2026-02-11 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 16 篇

2601.20906 2026-02-11 cs.LG 88%

TwinWeaver: An LLM-Based Foundation Model Framework for Pan-Cancer Digital Twins

TwinWeaver: 一种基于大语言模型的跨癌症数字双胞胎基础模型框架

Nikita Makarov, Maria Bordukova, Lena Voith von Voithenberg, Estrella Pivel-Villanueva, Sabrina Mielke, Jonathan Wickes, Hanchen Wang, Mingyu Derek Ma, Keunwoo Choi, Kyunghyun Cho, Stephen Ra, Raul Rodriguez-Esteban, Fabian Schmich, Michael Menden

机构 * Computational Sciences Center of Excellence, Roche, Penzberg, Germany(罗氏计算科学卓越中心) Computational Health Center, Helmholtz Munich, Munich, Germany(海德堡慕尼黑计算健康中心) Department of Biology, Ludwig Maximilian University of Munich, Munich, Germany(慕尼黑路易斯·马克西米利安大学生物学系) Early Development Oncology, Roche Innovation Center Zurich, Roche, Schlieren, Switzerland(罗氏苏黎世创新中心早期肿瘤学) Computational Sciences Center of Excellence, Genentech, New York City, USA(基因泰克计算科学卓越中心) Computational Sciences Center of Excellence, Genentech, South San Francisco, USA(基因泰克计算科学卓越中心) Center for Data Science, New York University, New York City, USA(纽约大学数据科学中心) Department of Computer Science, Stanford University, Stanford, CA, USA(斯坦福大学计算机科学系) Computational Sciences Center of Excellence, Roche, Basel, Switzerland(罗氏巴塞尔计算科学卓越中心) Department of Biochemistry(生物化学系) Biotechnology Institute, The University of Melbourne, Melbourne, Australia(墨尔本大学生物技术研究所)

专题命中 指令微调 :LLM(title);foundation model(title);large language model(abstract);language model(abstract)

AI总结 TwinWeaver通过基于大语言模型的框架,构建跨癌症数字双胞胎,提升临床事件预测与风险分层精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09670 2026-02-11 astro-ph.IM 85%

Talking with the Latents -- how to convert your LLM into an astronomer

与潜在空间对话——如何将你的大语言模型转化为天文学家

Ilay Kamai, Marc-Huertas Company, Mike J. Smith, Hagai B. Perets

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 通过融合潜在物理特征与语言模型,将大语言模型转化为可解释的科学推理工具,实现对天文学等领域的有效推理与任务执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16276 2026-02-11 cs.GT 85%

Mechanism Design for LLM Fine-tuning with Multiple Reward Models

基于多重奖励模型的LLM微调机制设计

Haoran Sun, Yurong Chen, Siwei Wang, Xu Chu, Wei Chen, Xiaotie Deng

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于多重奖励模型的LLM微调机制设计,通过机制设计解决智能体策略性误报问题,实现社会福利最大化并确保支付规则的激励兼容性。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16596 2026-02-11 cs.CL cs.AI 82%

Analyzing the Effects of Supervised Fine-Tuning on Model Knowledge from Token and Parameter Levels

分析监督微调对模型知识的影响:从token和参数层面

Junjie Ye, Yuming Yang, Yang Nan, Shuo Li, Qi Zhang, Tao Gui, Xuanjing Huang, Peng Wang, Zhongchao Shi, Jianping Fan

机构 * Fudan University(复旦大学) Lenovo Research(联想研究) Shanghai Key Lab of Intelligent Information Processing(上海智能信息处理重点实验室) Shanghai Innovation Institute(上海创新研究院)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

AI总结 研究发现监督微调对模型知识的影响显著,通过分析token和参数层面发现大部分参数更新不促进知识增强,恢复更新可提升封闭书问题回答性能。

Comments Accepted by EMNLP 2025 Main Conference. Codes for parameter restoration are available at https://github.com/UmeanNever/ParamRestore

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09425 2026-02-11 cs.CV cs.LG 79%

Bridging the Modality Gap in Roadside LiDAR: A Training-Free Vision-Language Model Framework for Vehicle Classification

弥合道路激光雷达的模态差距:一种无需训练的视觉-语言模型框架用于车辆分类

Yiqiao Li, Bo Shang, Jie Wei

机构 * Department of Civil Engineering, City College of New York(城市学院土木工程系) Department of Computer Science, City College of New York(城市学院计算机科学系)

专题命中 指令微调 :language model(title,abstract);分类 cs.LG

AI总结 本文提出一种无需训练的视觉-语言模型框架,用于解决道路激光雷达中稀疏点云与密集图像之间的模态差距问题,实现细粒度车辆分类。

Comments 12 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05980 2026-02-11 cs.LG 79%

Are Time-Indexed Foundation Models the Future of Time Series Imputation?

时间索引基础模型是否是时间序列填补的未来?

Etienne Le Naour, Tahar Nabil, Adrien Petralia, Ghislain Agoua

机构 * EDF R&D(EDF研究与开发)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

AI总结 本文首次对时间索引基础模型进行大规模实证研究,证明其在多种场景下无需重新训练即可实现零样本时间序列填补。

Comments Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18065 2026-02-11 cs.CV cs.AI 79%

EffoVPR: Effective Foundation Model Utilization for Visual Place Recognition

EffoVPR: 有效利用基础模型进行视觉位置识别

Issar Tzachor, Boaz Lerner, Matan Levy, Michael Green, Tal Berkovitz Shalev, Gavriel Habib, Dvir Samuel, Noam Korngut Zailer, Or Shimshi, Nir Darshan, Rami Ben-Ari

机构 * OriginAI The Hebrew University of Jerusalem(海法大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI

AI总结 EffoVPR通过有效利用基础模型提升视觉位置识别的性能,结合自注意力层提取特征和单阶段池化方法,实现更优的识别效果和特征紧凑性。

Comments ICLR 2025

Journal ref International Conference on Learning Representations (ICLR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09703 2026-02-11 cs.CL cs.AI 79%

Maastricht University at AMIYA: Adapting LLMs for Dialectal Arabic using Fine-tuning and MBR Decoding

马斯特里赫特大学AMIYA:通过微调和MBR解码适应方言阿拉伯语

Abdulhai Alali, Abderrahmane Issam

机构 * Maastricht University at AMIYA(马斯特里赫特大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文通过LoRA微调和MBR解码技术,提升方言阿拉伯语的生成与翻译性能,实验显示该方法在保持语义准确性的基础上提高了方言忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09445 2026-02-11 cs.IR 78%

Personalized Parameter-Efficient Fine-Tuning of Foundation Models for Multimodal Recommendation

面向多模态推荐的个性化参数高效微调

Sunwoo Kim, Hyunjin Hwang, Kijung Shin

专题命中 指令微调 :foundation model(title,abstract)

AI总结 本文提出PerPEFT,一种面向多模态推荐的个性化参数高效微调策略,通过按兴趣分组并为每个组分配独立模块,提升推荐效果。

Comments To be published at The Web Conference 2026 (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09395 2026-02-11 cs.LG 77%

Sparse Layer Sharpness-Aware Minimization for Efficient Fine-Tuning

稀疏层尖锐性感知最小化用于高效的微调

Yifei Cheng, Xianglin Yang, Guoxia Wang, Chao Huang, Fei Ma, Dianhai Yu, Xiaochun Cao, Li Shen

机构 * School of Cyber Science and Technology, Sun Yat-sen University, Shenzhen Campus(网络安全科学与技术学院,中山大学深圳校区) School of Computing, National University of Singapore(计算学院,新加坡国立大学) Baidu Inc(百度公司) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳))

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 SL-SAM通过稀疏技术优化微调过程,减少计算成本并提升效率,实现与先进基线相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09112 2026-02-11 cs.AI 70%

A Small-Scale System for Autoregressive Program Synthesis Enabling Controlled Experimentation

一个小型系统用于自回归程序合成,以实现受控实验

Russ Webb, Jason Ramapuram

机构 * Apple(苹果公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Cadmus系统通过低成本模型实现复杂程序合成任务,展示其在整数算术任务中的优越性能并揭示大模型的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11097 2026-02-11 cs.CL 70%

The Devil behind the mask: An emergent safety vulnerability of Diffusion LLMs

面具背后的魔鬼:扩散语言模型的新兴安全漏洞

Zichen Wen, Jiashu Qu, Zhaorun Chen, Xiaoya Lu, Dongrui Liu, Zhiyuan Liu, Ruixi Wu, Yicun Yang, Xiangqi Jin, Haoyun Xu, Xuyang Liu, Weijia Li, Chaochao Lu, Jing Shao, Conghui He, Linfeng Zhang

机构 * EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室) Shanghai AI Laboratory(上海人工智能实验室) University of Chicago(芝加哥大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 DIJA揭示了扩散语言模型的安全漏洞,通过构造对抗性提示利用双向建模和并行解码机制,使有害内容在对齐训练模型中得以生成。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17538 2026-02-11 cs.LG cs.AI cs.CL 67%

LoRA Provides Differential Privacy by Design via Random Sketching

LoRA通过随机草图实现差分隐私

Saber Malekmohammadi, Golnoosh Farnadi

机构 * Mila - Quebec AI Institute, Montreal, Canada(魁北克人工智能研究所) School of Computer Science, McGill University(麦吉尔大学计算机学院)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 LoRA通过随机草图机制在设计上实现差分隐私,其低秩适应等效于使用噪声梯度微调适配器,隐私水平受适应秩和批量大小影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09701 2026-02-11 cs.CV cs.AI 57%

GenSeg-R1: RL-Driven Vision-Language Grounding for Fine-Grained Referring Segmentation

GenSeg-R1: 通过强化学习驱动的视觉-语言接地进行细粒度指称分割

Sandesh Hegde, Jaison Saji Chacko, Debarshi Banerjee, Uma Mahesh

机构 * Camcom Technologies Pvt. Ltd.(Camcom技术有限公司)

专题命中 指令微调 :language model(abstract);分类 cs.AI

AI总结 GenSeg-R1 通过强化学习驱动的视觉-语言接地方法,在细粒度指称分割任务中实现了优于基线的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14957 2026-02-11 q-bio.NC cs.LG 57%

POCO: Scalable Neural Forecasting through Population Conditioning

POCO:通过群体条件实现可扩展的神经预测

Yu Duan, Hamza Tahir Chaudhry, Misha B. Ahrens, Christopher D Harvey, Matthew G Perich, Karl Deisseroth, Kanaka Rajan

机构 * EECS, MIT(MIT电子工程与计算机科学系) SEAS, Harvard University(哈佛大学科学与工程系) Janelia Research Campus(贾尔尼亚研究校园) Harvard Medical School(哈佛医学院) Kempner Institute(凯普纳研究所) Université de Montréal(蒙特利尔大学) Mila - Quebec AI Institute(魁北克人工智能研究所) Stanford University(斯坦福大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 POCO通过结合轻量级预测器和群体编码器,实现跨会话神经预测,提升预测精度并揭示生物结构。

Journal ref Advances in Neural Information Processing Systems (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07629 2026-02-11 cs.RO 50%

LCLA: Language-Conditioned Latent Alignment for Vision-Language Navigation

LCLA:语言引导的潜在对齐用于视觉-语言导航

Nitesh Subedi, Adam Haroon, Samuel Tetteh, Prajwal Koirala, Cody Fleming, Soumik Sarkar

专题命中 指令微调 :language model(abstract)

AI总结 LCLA通过将视觉-语言观测对齐到专家策略的潜在空间,实现轻量级的视觉-运动学习,提升在不同环境下的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏