arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-25 至 2026-02-25 共收录 207 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 39 篇

2602.19626 2026-02-25 cs.IT cs.CL math.IT 70%

Nacrith: Neural Lossless Compression via Ensemble Context Modeling and High-Precision CDF Coding

Nacrith:通过集成上下文建模和高精度CDF编码的神经无损压缩

Roberto Tacconelli

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :LLM(abstract);language model(abstract);分类 cs.CL

AI总结 Nacrith通过集成上下文建模和高精度CDF编码,实现高效的神经无损压缩,优于现有方法并适用于任意二进制文件。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03022 2026-02-25 cs.AI 70%

STAR: Similarity-guided Teacher-Assisted Refinement for Super-Tiny Function Calling Models

STAR: 基于相似性引导的教师辅助细化方法用于超小功能调用模型

Jiliang Ni, Jiachen Pu, Zhongyi Yang, Jingfeng Luo, Conggang Hu

机构 * Algorithm Platform Team, AI Hardware Division, Alibaba(阿里巴巴人工智能硬件事业部算法平台团队)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 STAR通过约束知识蒸馏和基于相似性的强化学习,有效将大语言模型能力转移到超小模型,实现复杂功能调用任务的高性能表现。

Comments The paper has been accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15148 2026-02-25 cs.CL 70%

ATTS: Asynchronous Test-Time Scaling via Conformal Prediction

ATTS: 通过置信预测实现异步测试时间扩展

Jing Xiong, Qiujiang Chen, Fanghua Ye, Zhongwei Wan, Chuanyang Zheng, Chenyang Zhao, Hui Shen, Hanbo Li, Chaofan Tao, Haochen Tan, Haoli Bai, Lifeng Shang, Lingpeng Kong, Ngai Wong

机构 * The University of Hong Kong(香港大学) Huawei Technologies Co., Ltd(华为技术有限公司) University College London(伦敦大学学院) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ATTS通过异步测试时间扩展方法,在保持精度的同时实现测试时间扩展的显著加速和吞吐量提升。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20717 2026-02-25 cs.SE cs.CR 67%

PackMonitor: Enabling Zero Package Hallucinations Through Decoding-Time Monitoring

PackMonitor: 通过解码时监控实现零包 hallucinations

Xiting Liu, Yuetong Liu, Yitong Zhang, Jia Li, Shi-Min Hu

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 PackMonitor通过解码时监控实现零包 hallucinations,通过上下文感知解析器和包名干预者有效消除推荐中的虚假包问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20577 2026-02-25 cs.CV 67%

Efficient and Explainable End-to-End Autonomous Driving via Masked Vision-Language-Action Diffusion

高效的端到端自动驾驶:通过掩码视觉-语言-动作扩散

Jiaru Zhang, Manav Gagvani, Can Cui, Juntong Peng, Ruqi Zhang, Ziran Wang

机构 * Institute for Physical Artificial Intelligence (IPAI), Purdue University(物理人工智能研究所(IPAI)、普渡大学) College of Engineering, Purdue University(工程学院、普渡大学) Department of Computer Science, Purdue University(计算机科学系、普渡大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 MVLAD-AD通过掩码视觉-语言-动作扩散模型,提升自动驾驶的效率与规划精度,实现高效且可解释的端到端自动驾驶。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20517 2026-02-25 cs.AI cs.CL cs.LG 67%

Inner Speech as Behavior Guides: Steerable Imitation of Diverse Behaviors for Human-AI coordination

内部言语作为行为引导:为人类-人工智能协调的可操控模仿

Rakshit Trivedi, Kartik Sharma, David C Parkes

机构 * Massachusetts Institute of Technology(麻省理工学院) Georgia Institute of Technology(佐治亚理工学院) Harvard University(哈佛大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MIMIC通过语言作为内部表示,利用视觉语言模型和扩散策略实现人类-人工智能协调中的行为引导与多样化的模仿控制。

Comments Spotlight paper at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21081 2026-02-25 cs.LG eess.SP 57%

Scaling Vision Transformers: Evaluating DeepSpeed for Image-Centric Workloads

扩大视觉变换器:评估DeepSpeed在图像中心工作负载中的应用

Huy Trinh, Rebecca Ma, Zeqi Yu, Tahsin Reza

机构 * Electrical \& Computer Eng University of Waterloo

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本研究评估DeepSpeed在图像处理任务中的可扩展性,通过实验探讨分布式数据并行对训练效率和性能的影响,并为优化视觉变换器的分布式训练提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02276 2026-02-25 cs.AI 57%

BioX-Bridge: Model Bridging for Unsupervised Cross-Modal Knowledge Transfer across Biosignals

BioX-Bridge:生物信号跨模态知识迁移的模型桥接

Chenqi Li, Yu Liu, Timothy Denison, Tingting Zhu

机构 * Department of Engineering Science University of Oxford(工程科学系 奥克大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 BioX-Bridge通过轻量级桥接网络实现生物信号跨模态无监督知识迁移,显著减少可训练参数并提升迁移性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20423 2026-02-25 cs.CV cs.CL 57%

MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation

MedCLIPSeg: 基于概率视觉语言适应的数据高效且可泛化的医学图像分割

Taha Koleilat, Hojat Asgariandehkordi, Omid Nejati Manzari, Berardino Barile, Yiming Xiao, Hassan Rivaz

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 MedCLIPSeg通过概率视觉语言适应方法,提升医学图像分割的数据效率和泛化能力,提供可解释的不确定性图。

Comments CVPR 2026; Project Page: https://tahakoleilat.github.io/MedCLIPSeg

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05182 2026-02-25 cs.CL 57%

The Single-Multi Evolution Loop for Self-Improving Model Collaboration Systems

单一-多进化循环用于自我改进的模型协作系统

Shangbin Feng, Kishan Panaganti, Yulia Tsvetkov, Wenhao Yu

机构 * University of Washington(华盛顿大学) Tencent AI Seattle Lab(腾讯AI西雅图实验室)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 本文提出单一-多进化循环,通过模型协作与蒸馏实现自我改进,提升模型性能与效率。

Comments Code at https://github.com/BunsenFeng/moco_distill

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21042 2026-02-25 cs.CV 50%

OmniOCR: Generalist OCR for Ethnic Minority Languages

OmniOCR:面向少数民族语言的通用OCR

Bonan Liu, Zeyu Zhang, Bingbing Meng, Han Wang, Hanshuo Zhang, Chengping Wang, Daji Ergu, Ying Cai

机构 * Southwest Minzu University(西南民族大学) AI Geeks

专题命中 效率与部署 :foundation model(abstract)

AI总结 OmniOCR通过动态LoRA和稀疏正则化技术,实现了对少数民族语言的高效OCR识别,显著提升了低资源和零样本场景下的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21010 2026-02-25 cs.CV 50%

Le-DETR: Revisiting Real-Time Detection Transformer with Efficient Encoder Design

Le-DETR:重新审视具有高效编码器设计的实时检测变压器

Jiannan Huang, Aditya Kane, Fengzhe Zhou, Yunchao Wei, Humphrey Shi

机构 * Beijing Jiaotong University(北京交通大学)

专题命中 效率与部署 :pretraining(abstract)

AI总结 Le-DETR通过高效编码器设计实现低预训练成本的实时检测性能提升

Comments CVPR Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06063 2026-02-25 cs.DC 50%

Mapping Gemma3 onto an Edge Dataflow Architecture

将Gemma3映射到边缘数据流架构上

Shouyu Du, Miaoxiang Yu, Zhenyu Xu, Zhiheng Ni, Jillian Cai, Qing Yang, Tao Wei

专题命中 效率与部署 :LLM(abstract)

AI总结 本文提出将Gemma3模型高效部署到边缘数据流架构上,通过硬件感知技术提升推理速度和能效,实现低功耗的LLM和VLM边缘推理。

Comments Original Version, data shall be updated

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20672 2026-02-25 cs.CV 50%

BBQ-to-Image: Numeric Bounding Box and Qolor Control in Large-Scale Text-to-Image Models

BBQ-to-Image: 数字边界框与颜色控制在大规模文本到图像模型中

Eliran Kachlon, Alexander Visheratin, Nimrod Sarid, Tal Hacham, Eyal Gutflaish, Saar Huberman, Hezi Zisman, David Ruppin, Ron Mokady

机构 * BRIA AI(BRIA人工智能)

专题命中 效率与部署 :prompting(abstract)

AI总结 BBQ-to-Image通过引入数字边界框和RGB三元组的直接条件生成,实现了对文本到图像模型中物体位置、大小和颜色的精确控制,提升了生成图像的准确性和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20566 2026-02-25 cs.RO cs.CV 50%

BFA++: Hierarchical Best-Feature-Aware Token Prune for Multi-View Vision Language Action Model

BFA++: 多视角视觉语言动作模型的分层最佳特征感知令牌剪枝

Haosheng Li, Weixin Mao, Zihan Lan, Hongwei Xiong, Hongan Wang, Chenyang Si, Ziwei Liu, Xiaoming Deng, Hua Chen

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) LimX Dynamic(LimX动态) Nanjing University(南京大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :language model(abstract)

AI总结 BFA++通过分层最佳特征感知令牌剪枝提升多视角视觉语言动作模型的效率和成功率

Comments 9 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21390 2026-02-25 gr-qc astro-ph.CO astro-ph.IM 50%

GraviBERT: Transformer-based inference for gravitational-wave time series

GraviBERT:基于Transformer的引力波时间序列推断

Martin Benedikt, Ippocratis D. Saltas

专题命中 效率与部署 :pretraining(abstract)

AI总结 GraviBERT通过自监督预训练和监督微调,实现了引力波时间序列推断的高效迁移学习,显著提升了推断精度和收敛速度。

Comments v2: Text improved for clarity, 2 new figures, references updated, results unchanged. Link with code added

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05926 2026-02-25 cs.IT math.IT 50%

L2T-Hyena: Enhancing State-Space Models with an Adaptive Learn-to-Teach Framework

L2T-Hyena:通过自适应学-教框架增强状态空间模型

Fatemeh Sohbati, Farzan Haddadi, Hamid Salahinejad

专题命中 效率与部署 :language model(abstract)

AI总结 L2T-Hyena通过自适应学-教框架提升状态空间模型的性能,在语言建模任务中取得显著改进。

Comments 8 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13068 2026-02-25 eess.AS 50%

MSR-Codec: A Low-Bitrate Multi-Stream Residual Codec for High-Fidelity Speech Generation with Information Disentanglement

MSR-Codec:一种低比特率多流残差编解码器用于高质量语音生成与信息解耦

Jingyu Li, Guangyan Zhang, Zhen Ye, Yiwen Guo

专题命中 效率与部署 :language model(abstract)

AI总结 MSR-Codec通过低比特率多流残差编解码器实现高质量语音生成,利用信息解耦技术提升语音合成与转换性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13027 2026-02-25 cs.CV 50%

A deep learning framework for efficient pathology image analysis

一种用于高效病理图像分析的深度学习框架

Peter Neidlinger, Tim Lenz, Sebastian Foersch, Chiara M. L. Loeffler, Jan Clusmann, Marco Gustav, Lawrence A. Shaktah, Rupert Langer, Bastian Dislich, Lisa A. Boardman, Amy J. French, Ellen L. Goode, Andrea Gsur, Stefanie Brezina, Marc J. Gunter, Robert Steinfelder, Hans-Michael Behrens, Christoph Röcken, Tabitha Harrison, Ulrike Peters, Amanda I. Phipps, Giuseppe Curigliano, Nicola Fusco, Antonio Marra, Michael Hoffmeister, Hermann Brenner, Jakob Nikolas Kather

专题命中 效率与部署 :foundation model(abstract)

AI总结 EAGLE是一种高效病理图像分析框架,通过选择性分析信息区域,提升处理效率并减少计算时间,实现更快速和可靠的病理诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00618 2026-02-25 cs.CV 50%

RegTrack: Simplicity Beneath Complexity in Robust Multi-Modal 3D Multi-Object Tracking

RegTrack: 复杂性之下蕴含的简洁性在鲁棒多模态3D多目标跟踪中

Lipeng Gu, Xuefeng Yan, Song Wang, Mingqiang Wei

机构 * School of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(计算机科学与技术学院,南京航空航天大学) Shenzhen Institute of Research, Nanjing University of Aeronautics and Astronautics(深圳研究院,南京航空航天大学) Collaborative Innovation Center of Novel Software Technology and Industrialization, Nanjing, China(新型软件技术与产业化协同创新中心,南京,中国) School of Computer Science and Control Engineering, Shenzhen University of Advanced Technology(计算机科学与控制工程学院,深圳大学先进技术学院)

专题命中 效率与部署 :language model(abstract)

AI总结 RegTrack通过统一三 cue 编码器实现鲁棒、高效且通用的多模态3D多目标跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 14 篇

2602.20324 2026-02-25 cs.AI cs.CL cs.LG 89%

An artificial intelligence framework for end-to-end rare disease phenotyping from clinical notes using large language models

基于大语言模型的端到端罕见病表型从临床笔记中提取人工智能框架

Cathy Shyr, Yan Hu, Rory J. Tinker, Thomas A. Cassini, Kevin W. Byram, Rizwan Hamid, Daniel V. Fabbri, Adam Wright, Josh F. Peterson, Lisa Bastarache, Hua Xu

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 RARE-PHENIX通过整合大语言模型、本体标准化和监督排名,实现了端到端罕见病表型分析,优于现有深度学习基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21127 2026-02-25 cs.HC cs.AI cs.CR cs.SI 85%

"Are You Sure?": An Empirical Study of Human Perception Vulnerability in LLM-Driven Agentic Systems

你确定吗?:一项关于LLM驱动代理系统中人类感知脆弱性的实证研究

Xinfeng Li, Shenyu Dai, Kelong Zheng, Yue Xiao, Gelei Deng, Wei Dong, Xiaofeng Wang

机构 * Nanyang Technological University(南洋理工大学) KTH(皇家理工学院) William & Mary(威廉与玛丽学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过实证分析揭示人类对LLM驱动代理系统中代理介导欺骗的脆弱性,并提出基于HAT-Lab的防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21045 2026-02-25 cs.HC cs.CL 85%

PaperTrail: A Claim-Evidence Interface for Grounding Provenance in LLM-based Scholarly Q&A

PaperTrail: 一种用于在基于大语言模型的学术问答中建立溯源的声明-证据接口

Anna Martin-Boyle, Cara A. C. Leckey, Martha C. Brown, Harmanpreet Kaur

机构 * University of Minnesota(明尼苏达大学) NASA Langley Research Center(NASA兰利研究中心)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 PaperTrail通过分解LLM回答和源文档为声明与证据,帮助学术领域更严谨地验证LLM的可信度,并揭示其信任worthiness。

Comments 25 pages, 3 figures. Accepted at the ACM CHI conference on Human Factors in Computing Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20663 2026-02-25 cs.CR 85%

ICSSPulse: A Modular LLM-Assisted Platform for Industrial Control System Penetration Testing

ICSSPulse:一个模块化的LLM辅助平台用于工业控制系统渗透测试

Michail Takaronis, Athanasia Kollarou, Vyron Kampourakis, Vasileios Gkioulos, Sokratis Katsikas

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 ICSSPulse是一个模块化平台,利用LLM生成报告,用于工业控制系统安全评估和渗透测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07172 2026-02-25 cs.AI 83%

NewtonBench: Benchmarking Generalizable Scientific Law Discovery in LLM Agents

NewtonBench: 在LLM代理中评估可推广的科学定律发现

Tianshi Zheng, Kelvin Kiu-Wai Tam, Newt Hue-Nam K. Nguyen, Baixuan Xu, Zhaowei Wang, Jiayang Cheng, Hong Ting Tsang, Weiqi Wang, Jiaxin Bai, Tianqing Fang, Yangqiu Song, Ginny Y. Wong, Simon See

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) NVIDIA(英伟达)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 NewtonBench通过反事实定律变化生成科学定律发现任务,评估LLM代理在复杂系统中发现隐藏原理的能力,并揭示其在系统复杂性和观测噪声下的脆弱性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05598 2026-02-25 cs.IR cs.AI 83%

AgentDR: Dynamic Recommendation with Implicit Item-Item Relations via LLM-based Agents

AgentDR: 通过基于LLM的代理进行动态推荐:利用隐式物品-物品关系

Mingdai Yang, Nurendra Choudhary, Jiangshu Du, Edward W. Huang, Philip S. Yu, Karthik Subbian, Danai Koutra

机构 * Amazon(亚马逊) University of Michigan(密歇根大学)

专题命中 领域大模型 :LLM(title,abstract);prompting(abstract);分类 cs.AI

AI总结 AgentDR通过基于LLM的代理利用隐式物品-物品关系,结合记忆机制和提示策略,提升动态推荐的全排名性能和相关性。

Comments 12 pages, accepted by WWW'26 as long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20644 2026-02-25 cs.SE 82%

An LLM-driven Scenario Generation Pipeline Using an Extended Scenic DSL for Autonomous Driving Safety Validation

基于扩展Scenic DSL的LLM驱动场景生成流水线用于自动驾驶安全验证

Fida Khandaker Safa, Yupeng Jiang, Xi Zheng

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract)

AI总结 本文提出基于扩展Scenic DSL和LLM的场景生成流水线,实现高精度自动驾驶安全验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08055 2026-02-25 q-bio.OT 82%

MCPmed: A Call for MCP-Enabled Bioinformatics Web Services for LLM-Driven Discovery

MCPmed: 一种面向LLM驱动发现的MCP启用生物信息学Web服务的呼吁

Matthias Flotho, Ian Ferenc Diks, Philipp Flotho, Leidy-Alejandra G. Molano, Pascal Hirsch, Andreas Keller

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract)

AI总结 MCPmed旨在通过MCP协议提升生物信息学Web服务的自动化和互操作性,以支持LLM驱动的发现研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08274 2026-02-25 cs.CL cs.AI 81%

Language Modeling and Understanding Through Paraphrase Generation and Detection

通过改写生成与检测实现语言模型与理解

Jan Philip Wahle

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究通过分解改写类型提升语言模型对语义等价的理解能力,在剽窃检测和重复问题识别中取得显著成效。

Comments PhD Thesis (Dissertation), University of Göttingen Germany, 2025. 186 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12007 2026-02-25 cs.IR cs.AI 77%

Diffusion Generative Recommendation with Continuous Tokens

基于连续令牌的扩散生成推荐

Haohao Qu, Shanru Lin, Yujuan Ding, Yiqi Wang, Wenqi Fan

机构 * The Hong Kong Polytechnic University(香港理工大学) City University of Hong Kong(香港城市大学) National University of Defense Technology(国防科技大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ContRec通过整合连续令牌和扩散模型,提升基于LLM的推荐系统性能。

Comments Accepted by The ACM Web Conference (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏