arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12698 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 1045 篇

2608.21386 2026-08-25 cs.LG cs.AI 新提交 62%

Model of Models: When Does Emitting a Specialist Beat Attending, Adapting, or Tuning?

模型的模型:何时生成专家模型优于注意力、适配或微调?

John C. Howell

机构 * Nineonefour

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究对比零样本、上下文注意力等四种模型专业化机制,发现生成专家模型在匹配质量下成本更低,但在高维序列建模中不及上下文注意力,还提出可证伪论点界定各机制适用场景。

Comments 14 pages, 7 sections

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20290 2026-08-21 cs.AI cs.CL 新提交 62%

Phantom Gains: Auditing Self-Improvement Against a Measured Null

幻影增益:针对可测量零假设的自我改进审计

Cheng Xu, Nan Yan, Liming Chen, M-Tahar Kechadi

机构 * University College Dublin(都柏林大学学院) Georgia Institute of Technology(佐治亚理工学院) Dalian University of Technology(大连理工大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对Qwen3-8B的LoRA自训练开展审计,发现测量伪影会反转改进结论,提出用逐问题精确检验替代自然阈值修复,还揭示外部蒸馏与自训练的不同效果及自训练的破坏作用。

Comments Code and evaluation artifacts are available at https://github.com/chengxuphd/phantom-gains

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18090 2026-08-20 cs.CL cs.AI 新提交 62%

Nine Emotion Centroids: A Label-Free Valence Axis That Transfers Across Four Modalities

九个情绪质心:跨四种模态迁移的无标签效价轴

Yousef Radwan

机构 * KAUST(阿卜杜拉国王科技大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出一种仅用9个情绪类别名称和少量叙事段落即可找到跨视觉、音频等四种模态迁移的无标签效价轴的方法,该轴在多模态情感任务中表现优异且具有机制活性。

Comments 15 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09834 2026-08-11 cs.CL cs.LG 新提交 62%

RA-FinBERT: Rule-aware LoRA adaptation for low-resource financial sentiment classification

RA-FinBERT:面向低资源金融情感分类的规则感知LoRA适配

Fan Zhang, Jiaming Li

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出规则感知FinBERT(RA-FinBERT),将LoRA与VADER衍生特征结合,仅增1024个参数,在金融情感分类任务中较基线模型准确率、宏F1值及中性类召回率均显著提升,适配低资源场景。

Comments 12 pages, 6 figures, 2 tables. Fan Zhang and Jiaming Li are co-first authors. Corresponding author: Jiaming Li

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07749 2026-08-11 cs.CV cs.AI cs.LG 新提交 62%

LoRSA: Toward Generalizable Parameter-Efficient Fine-Tuning for Biomedical Downstream Tasks

LoRSA:面向生物医学下游任务的可泛化参数高效微调方法

Saed Moradi, Benyamin Ghojogh, M. Hadi Sepanj, Yimin Yang, Ashirbani Saha

机构 * McMaster University(麦克马斯特大学) University of Waterloo(滑铁卢大学) Western University(西安大略大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出LoRSA框架,联合学习两类低秩分量实现生物医学视觉模型的参数高效微调,在乳腺密度分类任务中显著提升了模型对未见医学影像域的泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03875 2026-08-05 cs.LG cs.AI 新提交 62%

Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning

通过结构感知微调增强视觉语言模型奖励模型

Pyrros Koussios, Chenhao Li, Xin Chen, Andreas Krause

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出结构感知微调(SAFT)方法,利用LoRA适配器和内在结构先验优化视觉语言模型奖励信号,实现更快策略收敛与更好对齐,为稳定文本条件强化学习提供可扩展路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03842 2026-08-05 cs.CL cs.LG 新提交 62%

Sensitivity, Causality, and Repair Dissociate: A Layer-Wise Analysis of Perturbation Robustness and Its Scaling

敏感性、因果性与修复能力的分离:扰动鲁棒性的逐层分析及其缩放规律

Nathan Labiosa, David Buff, Ena Nayak, Erica Donno

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.LG

AI总结 该研究分析了语言模型的扰动鲁棒性,发现敏感性、因果性、补偿能力三种层映射分离,识别两种传播机制,提出级联中断机制,给出实用指导并指出方法学警示。

Comments 29 pages, 18 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00473 2026-08-04 cs.CV cs.AI cs.CL 新提交 62%

CrossProjection: Geometric Grounding Beyond Viewpoint Change in Architectural Drawings

CrossProjection:建筑图纸中超越视角变化的几何定位

Kaho Li, Pengyu Zeng, Yuqin Dai, Jun Yin, Tianjing Feng, Shuai Lu

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) University College London(伦敦大学学院)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出CrossProjection方法评估视觉语言模型在异构建筑视图间的几何定位能力,发现模型在自由几何定位上性能脆弱,仅封闭选择成功不代表具备可靠几何定位能力。

Comments Initial controlled diagnostic study on 23 natural drawing sets and three VLMs; broader model, building, repeated-inference, and human coverage is planned for a subsequent version

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28434 2026-07-31 cs.AI cs.CL 新提交 62%

Metaphor Tracer: A Theory-Informed Analysis of Hidden States

隐喻追踪器:基于理论指导的隐状态分析

Marc Heimann, Roxana Assadi Moghaddam, Olga Brovkina, Mark Pettifor, Lutz Goetzmann

机构 * Hermeneutic AI(诠释学人工智能公司)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出Metaphor Tracer工具,通过聚合器与区分器分析语言模型隐状态,验证其可追踪文本结构与隐喻迁移,为隐状态提供关系论解读。

Comments 39 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21595 2026-07-24 cs.CV cs.AI cs.LG 新提交 62%

3D-Aware VLMs with Implicit and Explicit Geometries

具有隐式和显式几何的3D感知视觉语言模型

Wenhao Li, Xueying Jiang, Quanhao Qian, Deli Zhao, Ran Xu, Shijian Lu, Gongjie Zhang

机构 * Nanyang Technological University(南洋理工大学) DAMO Academy, Alibaba Group(阿里巴巴达摩院) HuPan Lab(湖畔实验室)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对多数2D视觉输入的VLM处理3D任务困难的问题,提出VLM-IE3D框架,通过引入隐式和显式几何令牌及3D感知适配器,融合几何表示与视觉线索,在多种3D任务中表现优异。

Comments Accepted by ECCV 2026, Open Sourced

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20460 2026-07-24 cs.CL cs.AI 新提交 62%

Instruct-FD: Can Your Full-Duplex Speech System Follow Turn-Taking Instructions?

Instruct-FD:你的全双工语音系统能遵循轮流发言指令吗?

Yuzhi Tang, Wentao Ma, Xiling Zhao, Ahmad Salimi, Sepehr Harfi Moridani, Dongming Shen, Jixuan Wang, Abdulrahman Abdulrazzag, Murdock Aubry, Yu-Hua Chen, Daniel Lee, Jaewon Lee, Jonah Mackey, Silin Meng, Nicholas Stranges, Chenxu Xiong, Hao Yu, Yi Zhu, Mu Li, Alex Smola

机构 * Boson AI(玻色子人工智能公司)

专题命中 指令微调 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究全双工语音系统在明确指令下的轮流发言行为,引入Instruct-FD基准,开发相关工具,通过对六个先进系统测试发现遵循指令的轮流管理有差距,为构建适应性全双工对话系统指明关键方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18570 2026-07-22 cs.CL cs.AI 新提交 62%

For What Reason? Interpreting Models' Encoding of Causation and Antithesis

出于什么原因?解释模型对因果关系和对立关系的编码

Abhidip Bhattacharyya, Shira Wein

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) University of South Florida(南佛罗里达大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 研究指令微调的Transformer模型对英语话语关系的编码,聚焦因果和对立关系。通过下一个token预测任务及可解释性技术,发现早期层在序列中间做预测,中层接近末尾确定决策,部分层有答案偏好,揭示话语推理的不对称表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17524 2026-07-21 cs.CL cs.LG 新提交 62%

Token-Level Off-Policy Learning for Faithful Generation Under Distribution Shift

分布转移下忠实生成的令牌级离策略学习

Zitong Huang, Gustavo Lucas Carvalho, Deqing Fu, Robin Jia

机构 * University of Southern California(南加州大学)

专题命中 指令微调 :post-training(abstract);分类 cs.CL、cs.LG

AI总结 研究分布转移下忠实生成问题,提出令牌级离策略标注(TOPL)方法,通过训练模型区分响应中好坏令牌引导生成,在文档摘要等任务实验中实现强大分布外泛化,能有效转移到机器翻译,且学习信号关键,更新具可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11919 2026-07-15 cs.NE cs.AI cs.CV cs.LG 新提交 62%

Do You Remember? Toward Memory-Centric Multimodal AI

你还记得吗?迈向以记忆为中心的多模态人工智能

Xuguang Yu, Weigang Zheng, Minyue Yu

专题命中 指令微调 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 研究针对当前多模态语言模型缺乏重建性记忆的问题,提出DoYouRemember三阶段架构,通过VQ-VAE、LoRA微调语言模型和扩散解码器实现,经实验发现语言模型隐藏状态视觉信息少,还解决了共享记忆矩阵训练问题,统一相关发现于信息论框架。

Comments 43 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05968 2026-07-08 cs.CL cs.AI cs.IR 新提交 62%

InfluMatch: Frontier-Quality KOL Search at 4B-Model Cost

InfluMatch:以4B模型成本实现前沿质量的关键意见领袖搜索

Krittanon Kaewtawee, Petmongkon Pornpichitsuwan, Natchaya Temyingyong, Nutnicha Laplamoon, Wachiravit Modecrua, Krittin Pachtrachai, Touchapon Kraisingkorn

专题命中 指令微调 :prompting(abstract);分类 cs.CL、cs.AI

AI总结 研究如何将关键意见领袖与泰国营销标准匹配,提出低成本三阶段级联InfluMatch,由小型开放权重模型构建,能以低得多的成本达到前沿模型效果,是可部署、可解释的KOL搜索系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03763 2026-07-07 cs.LG cs.AI 新提交 62%

FedACT: Federated Adaptive Coordinate Trust Modulation for Robust Transformer Training under Data Heterogeneity

FedACT:数据异构下用于稳健Transformer训练的联邦自适应坐标信任调制

Shuai Li, Qinglin Wang, Ping Luo, Jiahuan Wang, Hongyang Hu, Haotian Mo, Yigui Feng, Ziang Liu, Qisong Xiao, Jie Liu, Tao Sun

机构 * NUDT(南京理工大学)

专题命中 指令微调 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 研究数据异构下联邦Transformer训练问题,提出FedACT方法,先形成全局校正自适应方向,再依坐标信任分数重分配更新幅度,实验表明其优于基线,能提升跨客户端方向一致性。

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00687 2026-07-02 cs.CV cs.AI cs.LG cs.PF 新提交 62%

LUMA: Benchmarking Segmentation via a Lightweight Universal Mask Adapter

LUMA: 通过轻量级通用掩码适配器进行分割基准测试

Tobias Christian Nauen, Anosh Billimoria, Federico Raue, Stanislav Frolov, Brian B. Moser, Andreas Dengel

机构 * RPTU University Kaiserslautern-Landau(凯泽斯劳滕-兰道大学) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI))

专题命中 指令微调 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 提出轻量级通用掩码适配器(LUMA),一种与骨干无关的掩码Transformer头,通过廉价交叉注意力实现高精度分割,并基于此对20种骨干网络和11种预训练方案进行基准测试,发现高效token混合器未实现高效,预训练目标主导分割质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00634 2026-07-02 cs.LG cs.AI 新提交 62%

Loss Smoothing for Stable Adaptation Under Distribution Shift

损失平滑:分布偏移下的稳定自适应

Darshan Patil, Ekaterina Lobacheva, Razvan Pascanu, Sarath Chandar

机构 * Chandar Research Lab(Chandar 研究实验室) Mila – Quebec AI Institute(Mila – 魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Polytechnique Montréal(蒙特利尔理工学院) Canada CIFAR AI Chair(加拿大 CIFAR 人工智能主席)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 提出损失平滑方法,通过在自适应初期插值源与目标训练目标,实现平滑过渡,保留有用特征,在多种分布偏移场景下提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00004 2026-07-02 cs.IR cs.AI cs.LG 新提交 62%

Why Advanced Encoders Lag on Sparse Retrieval? The Answer and an Approach to Bridging Vocabulary Gaps

为什么高级编码器在稀疏检索上落后?答案及弥合词汇鸿沟的方法

Zhichao Geng, Yang Yang

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 发现高级编码器在稀疏检索中落后于旧模型的原因是词汇鸿沟:现代分词器使用原始、区分大小写的词汇表导致语义单元冗余。提出词汇迁移框架,通过语义初始化和激活势校准解决该问题,在BEIR上取得SOTA性能。

Comments Accepted at SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27939 2026-06-29 cs.LG cs.AI q-bio.BM q-bio.GN 新提交 62%

Two-Stage Fine-Tuning for Protein Sequence Generation with Targeted Amino-Acid Composition

针对目标氨基酸组成的蛋白质序列生成的两阶段微调

Violeta Basten-Romero, Rubén Muñoz-Tafalla, Anna María Díaz-Rovira, Bertran Miquel-Oliver, Isaac Filella-Merce, Víctor Guallar

机构 * Barcelona Supercomputing Center (BSC)(巴塞罗那超级计算中心) Nostrum Biodiscovery S.L.(Nostrum生物发现有限公司) ICREA

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 提出两阶段微调方法,先领域自适应微调,再强化学习迭代微调,以生成符合目标氨基酸组成且保持序列质量的蛋白质序列。

Comments 17 pages, 5 figures, ICML 2026 Workshop GenBio

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27793 2026-06-29 cs.CL cs.AI 新提交 62%

Position Bias Correction is Insufficient for One-Pass Attention Sorting

位置偏差校正不足以实现单遍注意力排序

Qiong Tang, Xiangkun Hu, Xiangyang Liu, Yiran Chen, Yunfan Shao

机构 * Analemma

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 针对长上下文语言模型的位置偏差问题,提出去偏单遍注意力排序方法,通过估计位置偏差曲线校正注意力分数,实验表明校正效果有限,无法替代迭代排序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26987 2026-06-26 cs.CL cs.AI 新提交 62%

Where Do Models Find Happiness? Emotion Vectors in Open-Source LLMs

模型在哪里找到幸福?开源大语言模型中的情感向量

Sinie van der Ben, Raphaël Baur, Yannick Metz, Mennatallah El-Assady

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 研究在开源模型中复现情感向量,发现效价几何结构在层间分布存在差异,且唤醒度编码受语料影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26620 2026-06-26 cs.LG cs.AI 新提交 62%

Discovering Millions of Interpretable Features with Sparse Autoencoders

利用稀疏自编码器发现数百万可解释特征

XinYang He, Wei Wang, Bing Zhao, Xuan Ren, WenBo Li, WeiXu Qiao, Hu Wei, Lin Qu

机构 * AI DATA, Alibaba Group Holding Limited(阿里巴巴集团控股有限公司 AI DATA) Beijing Institute of Technology(北京理工大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Qwen3-Instruct SAE,在Qwen3指令微调模型系列上训练稀疏自编码器,通过激活级和模型级评估揭示稀疏性-保真度权衡,并展示其在拒绝行为引导中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26290 2026-06-26 cs.LG cs.AI 新提交 62%

SSM Adapters via Hankel Reduced-order Modeling: Injection Site Determines Task Suitability in Long-Context Fine-Tuning

通过Hankel降阶建模的SSM适配器:注入位置决定长上下文微调中的任务适用性

Omanshu Thapliyal

机构 * Hitachi America Ltd.(日立美洲有限公司)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 提出Hankel降阶模型(HRM)适配器,一种基于SSM的残差模块,通过平衡截断初始化,在长上下文任务中优于LoRA,并支持FFT并行扫描。

Comments 14 pages, 12 figures, HiLD Workshop @ ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26112 2026-06-26 cs.CL cs.AI 新提交 62%

From Lexicon to AI: A Structured-Data Pipeline for Specialized Conversational Systems in Low-Resource Languages

从词汇到AI:低资源语言中专有对话系统的结构化数据流水线

Siddhant Hitesh Mantri, Dhara Gorasiya, Malhar Kulkarni, Pushpak Bhattacharya

机构 * NMIMS, Mumbai(NMIMS孟买分校) CFILT, IIT Bombay(印度理工学院孟买分校CFILT)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 提出利用专家编纂的词汇数据库(如印地语WordNet)生成指令对,微调12B参数语言模型,构建低资源语言专用对话系统,在教育任务中效果优于通用模型。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24119 2026-06-24 cs.LG cs.CL 新提交 62%

When Top-1 Fails: Calibrating LoRA Monitors for Masked Diffusion LMs

当Top-1失败时:为掩蔽扩散LM校准LoRA监控器

Lucky Verma, Pratik Yadav

机构 * Independent Researcher(独立研究员) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.LG

AI总结 针对离散扩散语言模型微调中top-1 argmax作为崩溃预警的零精度问题,提出使用最大LoRA梯度范数作为参数侧信号,在LLaDA族上实现0.68精度和0.79 F1分数,并建议每族DLM校准阈值。

Comments 14 pages, 3 figures. Code and result artifacts: https://github.com/lucky-verma/top1-fails-dlm-lora-monitors

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22272 2026-06-23 cs.CL cs.AI 新提交 62%

MixedPEFT: Combining Multiple PEFT Methods with Mixed Objectives for Unsupervised Domain Adaptation

MixedPEFT:结合混合目标的多参数高效微调方法用于无监督域适应

Mohammed Rawhani, Dervis Karaboga, Ozkan Ufuk Nalbantoglu, Alper Basturk, Bahriye Akay

机构 * Computer Engineering Department(计算机工程系) Erciyes University(埃里奇大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 提出一种结合自定义PEFT架构和混合目标训练的参数高效无监督域适应策略,在MNLI数据集上超越现有方法,仅使用7%可训练参数。

Comments 6 pages, 5 tables. Builds upon our preliminary work presented at UBMK 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21496 2026-06-23 cs.RO cs.AI cs.CV cs.LG 新提交 62%

Decoupling the Declarative from the Procedural in Vision-Language-Action Models

在视觉-语言-动作模型中解耦声明性知识与程序性知识

Nikolaos Tsagkas, Andreas Sochopoulos, Chris Xiaoxuan Lu, Oisin Mac Aodha, Alexandros Kouris

机构 * University of Edinburgh(爱丁堡大学) UCL(伦敦大学学院) Samsung AI Center - Cambridge, UK(三星人工智能中心 - 英国剑桥)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 针对现有VLA模型无法解耦声明性与程序性知识导致零样本技能迁移脆弱的问题,提出w$^{2}$VLA模型,通过重构信息流实现模块化、可解释的知识解耦,显著提升对未见物体的零样本技能迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19317 2026-06-18 cs.LG cs.AI 新提交 62%

Explaining Attention with Program Synthesis

用程序合成解释注意力机制

Amiri Hayes, Belinda Z Li, Jacob Andreas

机构 * NJIT(新泽西理工学院) MIT(麻省理工学院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 提出用可执行程序近似深度网络组件行为的方法,针对Transformer注意力头,通过生成Python程序再现注意力模式,实现可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10929 2026-06-10 cs.LG cs.AI 新提交 62%

Recoverable but Not Stationary:Local Linear Structures in Weights and Activations

可恢复但不稳定:权重和激活中的局部线性结构

Irina Piontkovskaia, Sergey Nikolenko

机构 * St. Petersburg Department of the Steklov Institute of Mathematics(斯捷克洛夫数学研究所圣彼得堡分所) St. Petersburg State University(圣彼得堡国立大学)

专题命中 指令微调 :LLM(abstract_cn);分类 cs.AI、cs.LG

AI总结 研究神经网络中线性结构的存在性与尺度,发现局部低秩任务梯度结构,但固定任务平面假设不成立;首次恢复更新形成轨迹前缀基,捕获大部分恢复位移;提出随机搜索理论解释高维随机参数搜索有效性,并验证参数扰动与激活引导的关系。

Comments 23 pages, 8 tables, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏