arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-18 至 2026-02-18 共收录 26 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 26 篇

2506.02649 2026-02-18 cs.AI 89%

From Prompts to Protection: Large Language Model-Enabled In-Context Learning for Smart Public Safety UAV

从提示到保护:基于大语言模型的上下文学习用于智能公共安全无人机

Yousef Emami, Hao Zhou, Miguel Gutierrez Gaitan, Kai Li, Luis Almeida, Zhu Han

机构 * Real-Time and Embedded Computing Systems Research Centre (CISTER)(实时嵌入式计算系统研究中心) Carnegie Mellon University(卡内基梅隆大学) Pontificia Universidad Católica de Chile(天主教大学) School of Computer Science, McGill University(麦吉尔大学计算机科学学院) Instituto de Telecomunicações, Faculdade de Engenharia, Universidade do Porto(电信研究所,工程学院,葡萄牙里斯本大学) University of Houston(休斯顿大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型的上下文学习提升公共安全无人机的自主决策能力,通过自然语言提示和示例指导实现路径规划和速度控制,减少数据丢失并缓解安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14492 2026-02-18 cs.CL cs.IR 88%

Query as Anchor: Scenario-Adaptive User Representation via Large Language Model

查询作为锚点:通过大语言模型实现场景自适应的用户表示

Jiahao Yuan, Yike Xu, Jinyong Wen, Baokun Wang, Ziyi Gao, Xiaotong Lin, Yun Liu, Xing Fu, Yu Cheng, Yongchao Liu, Weiqiang Wang, Zhongle Xie

机构 * Ant Group(蚂蚁集团) East China Normal University(东华大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 通过Query-as-Anchor框架,利用大语言模型实现动态查询感知的用户表示,提升工业级用户建模的场景适应性和性能表现。

Comments 15 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15391 2026-02-18 cs.AI 85%

Improving LLM Reliability through Hybrid Abstention and Adaptive Detection

通过混合回避与自适应检测提升大语言模型可靠性

Ankit Sharma, Nachiket Tapas, Jyotiprakash Patra

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于上下文感知的自适应回避框架,通过动态调整安全阈值和级联检测机制,提升大语言模型在安全与效用之间的平衡能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15669 2026-02-18 cs.AI 81%

PERSONA: Dynamic and Compositional Inference-Time Personality Control via Activation Vector Algebra

PERSONA:通过激活向量代数实现动态和组合性的人格控制

Xiachong Feng, Liang Zhao, Weihong Zhong, Yichong Huang, Yuxuan Gu, Lingpeng Kong, Xiaocheng Feng, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) The University of Hong Kong(香港大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 PERSONA通过激活向量代数实现动态人格控制,无需训练即可达到微调水平性能,并在多个基准测试中表现出色。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14073 2026-02-18 cs.CL cs.AI 81%

Annotation-Efficient Vision-Language Model Adaptation to the Polish Language Using the LLaVA Framework

利用LLaVA框架实现波兰语视觉-语言模型的高效标注

Grzegorz Statkiewicz, Alicja Dobrzeniecka, Karolina Seweryn, Aleksandra Krasnodębska, Karolina Piosek, Katarzyna Bogusz, Sebastian Cygert, Wojciech Kusa

机构 * NASK National Research Institute(国家研究机构NASK)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出利用LLaVA框架高效适应波兰语的视觉-语言模型,通过自动化翻译和合成数据提升多模态模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00565 2026-02-18 cs.AI cs.LG 81%

Toward Safer Diffusion Language Models: Discovery and Mitigation of Priming Vulnerability

迈向更安全的扩散语言模型:发现和缓解提示漏洞

Shojiro Yamabe, Jun Sakuma

机构 * Institute of Science Tokyo(东京科学研究所) RIKEN AIP(理化学研究所AIP)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文发现扩散语言模型存在因迭代去噪过程导致的提示漏洞,并提出针对性的安全对齐方法以缓解该问题。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20293 2026-02-18 cs.LG cs.AI 81%

Beacon: Post-Training Quantization with Integrated Grid Selection

Beacon:集成网格选择的后训练量化

Shihao Zhang, Rayan Saab

专题命中 效率与部署 :post-training(title,abstract);分类 cs.AI、cs.LG

AI总结 Beacon 提出了一种无需手动调优的后训练量化方法,通过利用标量量化几何特性自动确定最优缩放因子,实现高效的模型压缩。

Journal ref IEEE Signal Processing Letters 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11695 2026-02-18 cs.LG cs.AI math.OC 81%

Qronos: Correcting the Past by Shaping the Future... in Post-Training Quantization

Qronos:通过塑造未来修正过去……在训练后量化中

Shihao Zhang, Haoyu Zhang, Ian Colbert, Rayan Saab

机构 * Department of Mathematics University of California, San Diego(数学系加州大学圣地亚哥分校) Software Architecture Advanced Micro Devices, Inc.(软件架构先进微器件公司) Department of Mathematics & HDSI University of California, San Diego(数学系及HDSI加州大学圣地亚哥分校)

专题命中 效率与部署 :post-training(title,abstract);分类 cs.AI、cs.LG

AI总结 Qronos通过迭代优化框架在训练后量化中显式纠正误差并超越现有方法,提升模型精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07849 2026-02-18 cs.AI 79%

LQA: A Lightweight Quantized-Adaptive Framework for Vision-Language Models on the Edge

LQA: 一种轻量级量化自适应框架,用于边缘设备上的视觉-语言模型

Xin Wang, Hong Jia, Hualin Zhou, Sheng Guang Wang, Yu Zhang, Ting Dang, Tao Gu

机构 * School of Computing(计算机学院) Information Systems, University of Melbourne, Melbourne, Australia(信息系统学院,墨尔本大学,澳大利亚墨尔本) Faculty of Science, Auckland, New Zealand(科学学院,新西兰奥克兰) School of Computing, University of Macquarie, Sydney, Australia(计算机学院,麦考瑞大学,澳大利亚悉尼)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 LQA提出了一种轻量级量化自适应框架,用于在边缘设备上高效部署视觉-语言模型,通过选择性混合量化和无梯度适应机制,提升适应性能并降低内存使用。

Comments 15 pages, 9 figures ,9 tables, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17529 2026-02-18 cs.NI 78%

Time-Series Foundation Models for ISP Traffic Forecasting

用于ISP流量预测的时间序列基础模型

Fan Liu, Behrooz Farkiani, Patrick Crowley

专题命中 效率与部署 :foundation model(title,abstract)

AI总结 本文提出基于时间序列基础模型的ISP流量预测方法,展示其在多种场景下的高准确性和低延迟表现。

Comments Accepted by the IEEE/IFIP Network Operations and Management Symposium (NOMS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04330 2026-02-18 physics.optics 78%

Impact of aberrations in SLM-based far-field holography

相位-only 光空间光调制器在远场全息中的像差影响

Markus Zimmermann, Andreas Brenner, Tobias Haist, Stephan Reichelt

专题命中 效率与部署 :SLM(title,abstract)

AI总结 研究通过相机回路校准相位-only SLM,探讨远场全息中像差对图像质量和衍射效率的影响,并评估斑点对比度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15724 2026-02-18 cs.CV cs.AI 77%

Learning to Retrieve Navigable Candidates for Efficient Vision-and-Language Navigation

学习高效视觉-语言导航中的可导航候选检索

Shutian Gu, Chengkai Huang, Ruoyu Wang, Lina Yao

机构 * University of New South Wales, Sydney, Australia(新南威尔士大学) Macquarie University, Sydney, Australia(麦考瑞大学) Data61, CSIRO, Sydney, Australia(Data61, CSIRO) The School of Computer Science(计算机科学学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出检索增强框架,通过指令级示例检索和候选剪枝提升LLM在视觉-语言导航中的效率和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15212 2026-02-18 cs.AI 77%

Secure and Energy-Efficient Wireless Agentic AI Networks

安全且节能的无线代理人工智能网络

Yuanyan Song, Kezhi Wang, Xinmian Xu

机构 * Department of Computer Science, Brunel University of London(布鲁内尔大学计算机科学系) Nanjing University of Posts and Telecommunications(南京邮电大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种安全且节能的无线代理人工智能网络,通过动态分配代理和优化资源分配,提升服务质量并降低能耗。

Comments Submitted to journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00539 2026-02-18 cs.CL cs.AI 73%

Intermittent Semi-Working Mask: A New Masking Paradigm for LLMs

间歇半工作掩码:一种新的LLM掩码范式

HaoYuan Hu, Mingcong Lu, Di Luo, XinYa Wu, Jiangcai Zhu, Taoye Yin, Zheng Li, Hao Wang, Shusheng Zhang, KeZun Zhang, KaiLai Shao, Chao Chen, Feng Wang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 间歇半工作掩码通过引入稀疏双向注意力,实现高效多轮对话和上下文密集型任务处理,同时保持推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15377 2026-02-18 cs.CL cs.AI 73%

Orchestration-Free Customer Service Automation: A Privacy-Preserving and Flowchart-Guided Framework

无编排客户服务自动化:一种隐私保护且流程图引导的框架

Mengze Hong, Chen Jason Zhang, Zichang Guo, Hanlin Gu, Di Jiang, Li Qing

机构 * Hong Kong Polytechnic University(香港理工大学)

专题命中 效率与部署 :language model(abstract);small language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种无编排的客户服务自动化框架,利用面向任务的流程图实现端到端自动化,通过本地部署和去中心化蒸馏提升隐私保护与泛化能力。

Comments Accepted by TheWebConf 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15318 2026-02-18 cs.CV cs.AI 70%

Sparrow: Text-Anchored Window Attention with Visual-Semantic Glimpsing for Speculative Decoding in Video LLMs

Sparrow: 一种基于文本锚定窗口注意力与视觉语义窥视的推测解码方法用于视频大语言模型

Libo Zhang, Zhaoning Zhang, Wangyang Hong, Peng Qiao, Dongsheng Li

机构 * National Key Laboratory of Parallel and Distributed Computing(平行与分布式计算国家重点实验室) College of Computer Science and Technology(计算机科学与技术学院) National University of Defense Technology(国防科技大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Sparrow通过文本锚定窗口注意力与视觉语义窥视方法,解决视频大语言模型中推测解码的性能下降问题,实现2.82倍加速。

Comments 15 pages , 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12174 2026-02-18 cs.LG cs.AI cs.CL cs.CV 67%

Just KIDDIN: Knowledge Infusion and Distillation for Detection of INdecent Memes

Just KIDDIN: 基于知识注入与蒸馏的有害表情包检测

Rahul Garg, Trilok Padhi, Hemang Jain, Ugur Kursuncu, Ponnurangam Kumaraguru

机构 * IIIT Hyderabad Georgia State University(佐治亚州立大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种结合知识蒸馏与注入的框架,用于提升有害表情包检测的性能,通过整合大规模知识图谱和视觉语言模型,实现更准确的毒性识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02799 2026-02-18 cs.LG cs.CL 62%

Stratified Hazard Sampling: Minimal-Variance Event Scheduling for CTMC/DTMC Discrete Diffusion and Flow Models

分层危险采样:CTMC/DTMC离散扩散和流模型的最小方差事件调度

Seunghwan Jang, SooJean Han

机构 * Department of EE KAIST(电子工程系,韩国科学技术院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.LG

AI总结 分层危险采样通过最小化方差提升CTMC/DTMC离散扩散和流模型的样本质量与鲁棒性。

Comments Work in progress. Feedback welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01143 2026-02-18 cs.AI cs.LG 62%

Generalized Parallel Scaling with Interdependent Generations

基于相互依赖世代的通用并行扩展

Harry Dong, David Brandfonbrener, Eryk Helenowski, Yun He, Mrinal Kumar, Han Fang, Yuejie Chi, Karthik Abinav Sankararaman

机构 * Meta Carnegie Mellon University(卡内基梅隆大学) Yale University(耶鲁大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 Bridge通过将批量LLM隐藏状态视为整体张量,实现相互依赖的并行生成,提升响应准确率和一致性,适用于任意生成宽度和聚合技术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15828 2026-02-18 cs.RO cs.CV cs.LG 57%

Dex4D: Task-Agnostic Point Track Policy for Sim-to-Real Dexterous Manipulation

Dex4D:一种任务无关的点轨迹策略用于仿真到现实的灵巧操作

Yuxuan Kuang, Sungjae Park, Katerina Fragkiadaki, Shubham Tulsiani

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :prompting(abstract);分类 cs.LG

AI总结 Dex4D通过仿真学习任务无关的点轨迹策略,实现零样本部署的灵巧操作任务。

Comments Project page: https://dex4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15200 2026-02-18 cs.LG 57%

COMPOT: Calibration-Optimized Matrix Procrustes Orthogonalization for Transformers Compression

COMPOT:用于Transformer压缩的校准优化矩阵Procrustes正交化

Denis Makhov, Dmitriy Shopkhoev, Magauiya Zhussip, Ammar Ali, Baher Mohammad, Stamatios Lefkimmiatis

机构 * Fundamental Research Center MWS AI(MWS AI基础研究中心)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 COMPOT是一种无需训练的Transformer压缩框架,通过校准优化矩阵Procrustes正交化实现高质量压缩,优于低秩和稀疏基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15061 2026-02-18 cs.RO cs.AI 57%

Safe-SDL:Establishing Safety Boundaries and Control Mechanisms for AI-Driven Self-Driving Laboratories

Safe-SDL:建立AI驱动自主实验室的安全边界与控制机制

Zihan Zhang, Haohui Que, Junhan Chang, Xin Zhang, Hao Wei, Tong Zhu

机构 * Shanghai Innovation Institute(上海创新研究院) Nankai University(南开大学) East China Normal University(华东师范大学) AI for Science Institute, Beijing(北京人工智能科学研究院) Peking University(北京大学) DP Technology(DP技术公司) Shanghai Jiao Tong University(上海交通大学) National Key Laboratory of Advanced Micro and Nano Manufacture Technology, School of Integrated Circuits, Shanghai Jiao Tong University, Shanghai 200240, China(上海交通大学国家先进微纳米制造技术重点实验室,集成电路学院,上海200240,中国)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 Safe-SDL通过建立安全边界和控制机制,解决AI驱动自主实验室中的语法到安全间隙问题,确保实验系统的安全性和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02766 2026-02-18 cs.LG cs.IT math.IT 57%

Theoretical Guarantees for Low-Rank Compression of Deep Neural Networks

深度神经网络低秩压缩的理论保证

Shihao Zhang, Rayan Saab

机构 * Department of Mathematics, University of California San Diego(加州大学圣地亚哥分校数学系) Department of Mathematics(数学系) Hal c o g lu Data Science Institute, University of California San Diego(Hal c o g lu数据科学研究所,加州大学圣地亚哥分校)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 本文提出了一种数据驱动的后训练低秩压缩分析框架,通过理论证明在不同假设下恢复定理,以解释低秩压缩方法优于数据无关方法的原因,并推动理论支持的压缩算法发展。

Journal ref Applied and Computational Harmonic Analysis 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15734 2026-02-18 cs.CV 50%

Language and Geometry Grounded Sparse Voxel Representations for Holistic Scene Understanding

基于语言和几何的稀疏体素表示用于整体场景理解

Guile Wu, David Huang, Bingbing Liu, Dongfeng Bai

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University of Toronto(多伦多大学)

专题命中 效率与部署 :foundation model(abstract)

AI总结 本文提出基于语言和几何的稀疏体素表示方法,通过统一框架建模3D场景的外观、语义和几何,提升整体场景理解和重建性能。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15543 2026-02-18 cs.RO 50%

Selective Perception for Robot: Task-Aware Attention in Multimodal VLA

机器人选择性感知:多模态VLA中的任务感知注意力

Young-Chae Son, Jung-Woo Lee, Yoon-Ji Choi, Dae-Kwan Ko, Soo-Chul Lim

机构 * Dongguk University(东国大学)

专题命中 效率与部署 :language model(abstract)

AI总结 本文提出了一种动态信息融合框架,通过任务感知注意力提升机器人多模态VLA模型的效率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01843 2026-02-18 cs.RO 50%

MoIRA: Modular Instruction Routing Architecture for Multi-Task Robotics

MoIRA:多任务机器人中的模块化指令路由架构

Dmytro Kuzmenko, Nadiya Shvai

机构 * Department of Multimedia Systems, National University of Kyiv-Mohyla Academy(多媒体系统系,基尔夫学院国家大学) Department of Mathematics, National University of Kyiv-Mohyla Academy(数学系,基尔夫学院国家大学)

专题命中 效率与部署 :language model(abstract)

AI总结 MoIRA是一种模块化指令路由架构,通过外部文本路由器协调专家,实现高效多任务机器人系统。

Comments Updated to reflect the final accepted version published in Neurocomputing

Journal ref Neurocomputing, vol. 674, 132962, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏