One Adapter Pair per Model: A Universal Activation Interface for Language Models
每个模型一个适配器对:语言模型的通用激活接口
专题命中 指令微调 :language model(title,abstract);分类 cs.AI
AI总结 本研究提出通用激活总线框架,为兼容语言模型提供通用激活接口,每个模型配备轻量级适配器对,可实现激活工具跨模型共享与复用,为可复用工具建立稳定的激活契约。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
每个模型一个适配器对:语言模型的通用激活接口
专题命中 指令微调 :language model(title,abstract);分类 cs.AI
AI总结 本研究提出通用激活总线框架,为兼容语言模型提供通用激活接口,每个模型配备轻量级适配器对,可实现激活工具跨模型共享与复用,为可复用工具建立稳定的激活契约。
ChronoState:用于冻结骨干语言模型中时间-状态动作选择的隐式流逝时间条件
机构 * Johns Hopkins University(约翰斯·霍普金斯大学)
专题命中 指令微调 :language model(title,abstract);分类 cs.AI
AI总结 该研究提出 ChronoState 基准,证实冻结骨干语言模型可在直接监督下将隐式流逝时间与符号状态组合,但其泛化性有限,且性能不及提示注入时间戳基线。
Comments Submitted to SPIE Defense and Commercial Sensing 2027
当置信度误导时:扩散语言模型的后缀锚定与锚邻近置信度调制
机构 * RICS(智能研究学院) ; AIIS(人工智能研究所) ; IPAI(人工智能研究所) ; Department of Intelligence and Information(智能与信息系) ; Daegu Gyeongbuk Institute of Science and Technology(大邱庆州市科学技术院)
专题命中 指令微调 :language model(title,abstract);分类 cs.CL
AI总结 针对扩散语言模型中置信度误导导致生成不完整或过早解码的问题,提出后缀锚定与锚邻近置信度调制方法,无需训练即可提升完全非自回归解码性能。
Comments Preprint
ZOMP:面向视觉-语言模型的零阶多模态提示调优
机构 * UC Santa Barbara(加州大学圣巴巴拉分校)
专题命中 指令微调 :language model(title,abstract)
AI总结 本文提出ZOMP方法,通过跨模态低秩重参数化等技术,在仅前向传递的条件下高效调优CLIP模型,在13个基准上优于现有无反向传播的提示调优方法,泛化能力更强。
金融数值预测与分配:以 token 生成的方式实现
专题命中 指令微调 :SFT(abstract,abstract_cn);language model(abstract);分类 cs.LG
AI总结 本研究提出 FinATOM 框架,通过因果语言模型的 token 生成实现金融数值预测与 ETF 分配,在多组测试中显著提升了夏普比率与累计收益,验证了该方法的可行性。
GraphWalker: 通过合成轨迹课程实现基于知识图谱的代理问答
机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室) ; Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)
专题命中 指令微调 :SFT(abstract,abstract_cn);prompting(abstract);分类 cs.CL
AI总结 GraphWalker通过自动化轨迹合成和分阶段微调解决知识图谱问答中的探索与泛化问题,提升轻量强化学习性能,在CWQ和WebQSP上取得最优效果。
Comments COLM 2026
用于自动驾驶汽车鲁棒交通标志感知的视觉-语言模型蒸馏
机构 * Clemson University(克莱姆森大学)
专题命中 指令微调 :language model(title);分类 cs.LG
AI总结 本研究提出LAMDA框架,通过冻结OpenCLIP文本编码器构建原型库监督视觉特征,在GTSRB和LISA数据集上,可同时提升TSR模型对三类物理攻击的鲁棒性且不降低干净准确率。
Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)
代数图构造的神经符号发现
机构 * TU Wien(维也纳技术大学)
专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 针对仅提供原始图数据无法揭示其结构性质的问题,提出基于通用大语言模型与SageMath的神经符号智能体,可自动发现代数图构造,在100个高度对称图基准上全部成功,还找到Bernhart-Kainen可散度猜想的最小反例。
金融披露文本中的细粒度不一致分类诊断
机构 * Hitachi America, Ltd(美国日立公司)
专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究针对金融披露文本的细粒度不一致分类问题,在SBID-FD基准上对比多种模型,发现紧凑型监督编码器效率较高,证据定位是关键瓶颈,需同时提升证据提取与类别推理能力。
复杂逻辑指令生成
机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) ; Independent Researcher(独立研究者) ; Duke University(杜克大学) ; University of Central Florida(佛罗里达大学中央分校)
专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
AI总结 本文提出LogicIFGen和LogicIFEval,用于生成和评估复杂逻辑指令,揭示了当前LLMs在复杂指令跟随上的不足。
Comments COLM 2026 Acceptance
通过专家引导的多模态融合与大语言模型的统一框架实现情绪识别与情感分析
机构 * School of Software, Dalian University of Technology, China(软件学院,大连理工大学,中国)
专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 本文提出EGMF框架,通过专家引导的多模态融合与大语言模型结合,实现情绪识别与情感分析的统一处理,提升跨语言鲁棒性。
Comments 14 pages, 6 figures
展示TOFFEE:一个大规模合成数据代理轨迹的学习系统
机构 * Nanyang Technological University(南洋理工大学) ; Huawei(华为) ; Industrial and Commercial Bank of China Limited(中国工商银行)
专题命中 指令微调 :LLM(abstract);SFT(abstract);分类 cs.AI
AI总结 针对现有数据代理难以适应新环境的问题,提出TOFFEE系统,通过蒙特卡洛树搜索等方法,能从给定数据环境合成高质量数据代理轨迹,可用于监督微调与上下文学习,还展示了系统框架、界面及工作流程与应用场景。
Comments Accepted to VLDB 2026
早期数据暴露提高对后续微调的鲁棒性
机构 * Department of Computer Science(计算机科学系) ; Cranberry-Lemon University(Cranberry-Lemon 大学) ; Department of Computational Neuroscience(计算神经科学系) ; University of the Witwatersrand(沃茨沃斯兰德大学)
专题命中 指令微调 :pretraining(abstract);post-training(abstract);分类 cs.LG
AI总结 本文研究了上游训练策略如何影响模型在后续微调中的鲁棒性,发现早期数据暴露能提升模型在微调后的表现,而传统方法如回放和dropout在后续微调中提供补充增益。
Comments Published at COLM 2026. Project website: https://ar-forum.github.io/earlyexposure-website/
RA-FinBERT:面向低资源金融情感分类的规则感知LoRA适配
专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.LG
AI总结 本研究提出规则感知FinBERT(RA-FinBERT),将LoRA与VADER衍生特征结合,仅增1024个参数,在金融情感分类任务中较基线模型准确率、宏F1值及中性类召回率均显著提升,适配低资源场景。
Comments 12 pages, 6 figures, 2 tables. Fan Zhang and Jiaming Li are co-first authors. Corresponding author: Jiaming Li
Macaron-V1:面向具备自我改进与LoRA混合能力的开放持续学习
专题命中 指令微调 :post-training(abstract);分类 cs.CL、cs.LG
AI总结 本研究提出Macaron-V1开放智能体模型家族,结合MoL架构与递归自我改进机制,经多基准评估验证其有效性,为开放持续学习提供新方案。
Comments 49 pages, technical report
LoRSA:面向生物医学下游任务的可泛化参数高效微调方法
机构 * McMaster University(麦克马斯特大学) ; University of Waterloo(滑铁卢大学) ; Western University(西安大略大学)
专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG
AI总结 本文提出LoRSA框架,联合学习两类低秩分量实现生物医学视觉模型的参数高效微调,在乳腺密度分类任务中显著提升了模型对未见医学影像域的泛化性能。
从手册到维护:在低资源场景中微调MedGemma以提供多模态成像系统支持
机构 * Carnegie Mellon University Africa(非洲卡内基梅隆大学) ; IngenziAI(因根齐人工智能公司) ; Federal University of Health Sciences Azare(阿扎雷联邦健康科学大学) ; University of Maiduguri Teaching Hospital(迈杜古里大学教学医院) ; Lawson Health Research Institute(劳森健康研究所) ; University of Pennsylvania(宾夕法尼亚大学) ; McGill University(麦吉尔大学)
专题命中 指令微调 :foundation model(abstract);分类 cs.AI
AI总结 针对中低收入国家医疗设备维护难题,研究人员构建INGENZI_DatasetV1数据集,用QLoRA微调MedGemma-4b-it模型,使维修问答指标大幅提升,为低资源场景AI辅助医疗维护奠定基础。
Comments Accepted at the AFRICAI 2026 Workshop, a satellite event at MICCAI 2026. To appear in Springer Lecture Notes in Computer Science (LNCS)
VTO:面向视频异常检测的可视化工具编排
机构 * State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; School of Digital Media & Design Art(数字媒体与设计艺术学院)
专题命中 指令微调 :foundation model(abstract);分类 cs.AI
AI总结 针对视频异常检测中传统方法泛化差、多模态智能体工具编排难的问题,提出过程监督强化学习框架VTO,结合VAD-Tool工具集,在工具调度上较基线提升10.2%。
Comments Accepted by ACM MM 2026
PatchHead:学习空间块证据以实现可泛化的AI生成图像检测
专题命中 指令微调 :foundation model(abstract)
AI总结 针对AI生成图像检测器泛化能力差的问题,提出保留DINO块token二维结构的PatchHead,仅优化少量参数,在9个跨数据集基准上表现优异,提升了检测准确率并降低了域差异。
基于粗到细VLM跟踪流水线的零样本交通事故检测
机构 * Bangladesh University of Engineering and Technology(孟加拉工程技术大学)
专题命中 指令微调 :language model(abstract)
AI总结 本文提出一种无需训练的双通粗到细流水线,结合Qwen3-VL-32B-Instruct、YOLO11x与BoT-SORT,在零样本约束下于ACCIDENT @ CVPR基准测试中实现22%相对优势,达成0.504的三方调和均值得分。
Comments Accepted at the AUTOPILOT Workshop, CVPR 2026, Denver, CO
面向计算高效的Transformer适配的电路微调
专题命中 指令微调 :language model(abstract)
AI总结 提出电路微调(CFT)框架,通过电路发现选择ViT待微调子图,仅微调该子图,可大幅降低训练FLOPs与时间,在多类视觉任务上验证了有效性。
将物理先验知识蒸馏为流式世界模型
专题命中 指令微调 :pretraining(abstract)
AI总结 本文提出PhyS三阶段框架,构建120K物理交互数据集,经微调、蒸馏及在线强化学习结合TCR方法,提升流式世界模型的物理一致性,在PhysicsIQ等基准上取得显著性能提升。
Comments 9 pages, 7 figures. Project page: https://lyongo.github.io/PhyS/
LIRA:面向视觉-语言-动作解码的局部跨层信息路由
专题命中 指令微调 :language model(abstract)
AI总结 LIRA是面向VLA模型的局部跨层信息路由机制,通过深度感知路由VLM特征,在多机器人操作基准及真实场景中提升了动作预测性能与分布偏移下的鲁棒性。
Comments 9 pages, 4 figures. Code and model checkpoints will be released upon acceptance of the paper
针对非典型分裂细胞图分类的、在自然图像上预训练的DINOv3的高效微调
机构 * Mines Paris, PSL University, Center for Computational Biology(巴黎 Mines 大学计算生物学中心) ; Mines Paris, PSL University, Center for Mathematical Morphology(巴黎 Mines 大学数学形态学中心) ; Sanofi(桑福有限公司) ; Institut Curie, PSL University(Curie 机构,巴黎 Mines 大学) ; INSERM, U1331 Computational Oncology(INSERM,U1331 计算肿瘤学) ; Department of Pathology, University Hospital of Nantes(南特大学医院病理学系)
专题命中 指令微调 :pretraining(abstract)
AI总结 本研究针对MIDOG 2025非典型分裂细胞图分类任务,采用低秩适配微调仅130万参数的DINOv3-H+,结合数据增强与领域加权Focal Loss,最终获挑战赛测试集第一名。
Comments 11 pages, 4 figures. Challenge report for MIDOG 2025 (Task 2: Atypical Mitotic Figure Classification). Published in LNCS
Journal ref Mitotic Figure Detection and Atypia Classification in Whole Slide Images, Lecture Notes in Computer Science, vol. 16519, pp. 15-25, Springer, 2026
TSPORec:基于偏好优化的 token 选择的 LLM 序列推荐
专题命中 后训练与偏好优化 :LLM(title,title_cn);preference optimization(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出 TSPORec 方法,通过三阶段流程与新型代理奖励选择信息 token,在提升 LLM 序列推荐性能的同时降低计算成本,实验显示其较基线方法性能提升最高 31.25%、效率提升最高 63.4%。
Comments 16 pages
跨国价值观模拟中的表征平等:对大型语言模型的系统分析
专题命中 后训练与偏好优化 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);post-training(abstract)
AI总结 本研究分析59国的LLM跨国价值观模拟,发现富裕技术先进国家人群模拟更准确,且两种干预路径的准确率提升未必带来表征平等,为构建更具包容性的LLM模拟提供指导。
Comments Accepted for publication in Computational Linguistics
谁构建了这个模型?通过权重空间中的光谱指纹追踪大语言模型(LLM)谱系
机构 * Michigan State University(密歇根州立大学)
专题命中 后训练与偏好优化 :LLM(title,title_cn);large language model(abstract);language model(abstract);post-training(abstract)
AI总结 本研究提出几何指纹框架,通过权重空间的光谱能量和子空间对齐分析,实现对110余个开源权重LLM对的谱系区分,为模型溯源提供稳健可解释的信号。
Comments Accepted to COLM 2026
超越可解性:任务可学习性作为大语言模型强化学习后训练的静态先验
机构 * Sun Yat-Sen University(中山大学) ; Alibaba Group(阿里巴巴集团)
专题命中 后训练与偏好优化 :LLM(title,summary_cn);post-training(title,abstract);large language model(abstract);language model(abstract)
AI总结 该研究提出TrajVal估计任务可学习性,将其作为静态先验用于LLM的RL后训练任务采样,可提升数据效率并与在线调度方法互补。
不只是RLHF:为何仅对齐不足以解决多智能体趋同
机构 * California Institute of Technology(加州理工学院) ; Evergreen Valley College(艾弗绿谷学院)
专题命中 后训练与偏好优化 :RLHF(title,title_cn);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG
AI总结 本文研究了多智能体系统在模拟同伴分歧下的错误率问题,发现预训练基础模型与指令模型存在相似的替换模式,且错误率较高。通过激活修补发现错误集中在中间层,修复后可恢复大部分正确率差距。研究还指出压力抑制了清洁推理特征,而非激活新的趋同回路。
面向时间序列基础模型强化学习后训练的真实值邻域正则化方法
专题命中 后训练与偏好优化 :foundation model(title,abstract);post-training(title,abstract);分类 cs.AI、cs.LG
AI总结 针对时间序列基础模型强化学习后训练的次优崩溃问题,提出真实值邻域正则化方法,可缓解该问题并提升模型性能,且能灵活集成到各类强化学习方法中。