arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-11 至 2026-03-11 共收录 232 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 28 篇

2602.23616 2026-03-11 physics.optics cs.AI cs.ET 70%

ReDON: Recurrent Diffractive Optical Neural Processor with Reconfigurable Self-Modulated Nonlinearity

ReDON:具有可重构自调制非线性的递归衍射光学神经处理器

Ziang Yin, Qi Jing, Raktim Sarma, Rena Huang, Yu Yao, Jiaqi Gu

机构 * Arizona State University(亚利桑那州立大学) Center for Integrated Nanotechnologies, Sandia National Laboratories(沙伊达国家实验室集成纳米技术中心) Rensselaer Polytechnic Institute(伦塞拉尔理工学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ReDON通过递归自调制非线性机制提升光学计算效率,实现20%的准确率提升

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09347 2026-03-11 cs.DB 67%

The Virtuous Cycle: AI-Powered Vector Search and Vector Search-Augmented AI

良性循环:AI驱动的向量搜索与向量搜索增强的AI

Jiuqi Wei, Quanqing Xu, Chuanhui Yang

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文探讨了AI与向量搜索的协同优化,通过AI增强向量搜索和向量搜索增强AI,形成良性循环,提升智能信息系统的性能和能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15414 2026-03-11 eess.IV 67%

Entropy-and-Channel-Aware Adaptive-Rate Semantic Communication with MLLM-Aided Feature Compensation

熵与信道感知的自适应速率语义通信 with MLLM辅助特征补偿

Weixuan Chen, Qianqian Yang, Yuhao Chen, Chongwen Huang, Qian Wang, Zehui Xiong, Zhaoyang Zhang

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文提出一种基于熵与信道感知的自适应速率语义通信框架,利用MLLM辅助特征补偿提升通信效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09527 2026-03-11 cs.LG cs.AI 62%

Efficiently Aligning Draft Models via Parameter- and Data-Efficient Adaptation

通过参数和数据高效适应实现草稿模型的高效对齐

Luxi Lin, Zhihang Lin, Zhanpeng Zeng, Yuhao Chen, Qingyu Zhang, Jixiang Luo, Xuelong Li, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学) Shanghai Innovation Institute(上海创新研究院) Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究所(TeleAI)) University of Science and Technology of China (USTC)(中国科学技术大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文提出高效草稿适应框架EDA,通过解耦架构、数据再生策略和样本选择机制,实现草稿模型在特定领域微调时的高效适应,降低训练成本并提升推测解码性能。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09222 2026-03-11 cs.CL 57%

LooComp: Leverage Leave-One-Out Strategy to Encoder-only Transformer for Efficient Query-aware Context Compression

LooComp: 通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率

Thao Do, Dinh Phu Tran, An Vo, Seon Kwon Kim, Daeyoung Kim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL

AI总结 LooComp通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率,实现高效压缩与高吞吐量推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02023 2026-03-11 cs.CL 57%

PonderLM-3: Adaptive Token-Wise Pondering with Differentiable Masking

PonderLM-3: 基于可微掩码的自适应逐token pondering

He Li, Feichen Song, Boyi Zeng, Shixiang Song, Zhiqin John Xu, Ziwei He, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

专题命中 效率与部署 :pretraining(abstract);分类 cs.CL

AI总结 PonderLM-3通过可微掩码实现token级自适应计算分配,降低预训练困惑度并提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09004 2026-03-11 cs.SE 50%

Can AI Agents Generate Microservices? How Far are We?

AI代理能否生成微服务?我们距离多远?

Bassam Adnan, Matteo Esposito, Davide Taibi, Karthik Vaidhyanathan

专题命中 效率与部署 :prompting(abstract)

AI总结 本文研究了AI代理生成微服务的能力,发现渐进式生成在单元测试中表现较好,而清洁状态生成在集成测试中表现更优,但整体上仍需人类监督。

Comments 10 pages, 7 figures, accepted at the 2026 IEEE International Conference on Software Architecture (ICSA 2026). This is the pre-print version; the camera-ready version is published by IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01046 2026-03-11 cs.CR 50%

Lightening the Load: A Cluster-Based Framework for A Lower-Overhead, Provable Website Fingerprinting Defense

减轻负担:一种基于集群的框架,用于设计一种低开销、可证明的网站指纹攻击防御

Khashayar Khajavi, Tao Wang

专题命中 效率与部署 :prompting(abstract)

AI总结 本文提出了一种基于集群的自适应网站指纹攻击防御框架,通过结合正则化和超序列方法,实现低开销和可证明安全性的平衡。

Comments NDSS'26

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 14 篇

2508.10729 2026-03-11 cs.CV cs.AI 88%

EgoCross: Benchmarking Multimodal Large Language Models for Cross-Domain Egocentric Video Question Answering

EgoCross:多模态大语言模型跨领域眼动视频问答基准测试

Yanjun Li, Yuqian Fu, Tianwen Qian, Qi'ao Xu, Silong Dai, Danda Pani Paudel, Luc Van Gool, Xiaoling Wang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 EgoCross提出一个跨领域眼动视频问答基准,评估多模态大语言模型在不同领域中的泛化能力,揭示现有模型在非日常领域任务中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08837 2026-03-11 cs.SI cs.AI 85%

Debiasing International Attitudes: LLM Agents for Simulating US-China Perception Changes

消除国际偏见:用于模拟中美感知变化的LLM代理

Nicholas Sukiennik, Yichuan Xu, Yuqing Kan, Jinghua Piao, Yuwei Yan, Chen Gao, Yong Li

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出基于LLM代理的框架,通过去偏机制模拟中美感知变化,发现魔鬼代言人代理最有效缓解偏见。

Comments Submitted to TCSS

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09231 2026-03-11 cs.AI 81%

Cognitively Layered Data Synthesis for Domain Adaptation of LLMs to Space Situational Awareness

认知分层数据合成用于LLM在空间态势感知领域的领域适应

Ding Linghu, Cheng Wang, Da Fan, Wei Shi, Kaifeng Yin, Xiaoliang Xue, Fan Yang, Haiyi Ren, Cong Zhang

机构 * Qian Xuesen Laboratory of Space Technology(钱学森空间技术实验室) China Academy of Space Technology(中国航天科技研究院) State Key Laboratory of Space Information System and Integrated Application(空间信息系统与集成应用国家重点实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 本文提出BD-FDG框架,通过认知分层问题建模和结构化知识组织,构建高质量SFT数据集,提升LLM在空间态势感知领域的适应性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09685 2026-03-11 cs.CL cs.AI cs.IR 79%

Automatic Cardiac Risk Management Classification using large-context Electronic Patients Health Records

基于大上下文电子健康记录的自动心脏风险管理分类

Jacopo Vitale, David Della Morte, Luca Bacco, Mario Merone, Mark de Groot, Saskia Haitjema, Leandro Pecchia, Bram van Es

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种基于大上下文电子健康记录的自动心脏风险管理分类方法,通过定制Transformer架构在纵向临床文本中实现高精度的风险分层。

Comments 17 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09018 2026-03-11 cs.AI 77%

Meissa: Multi-modal Medical Agentic Intelligence

Meissa:多模态医疗代理智能

Yixiong Chen, Xinyi Bai, Yue Pan, Zongwei Zhou, Alan Yuille

机构 * Johns Hopkins University(约翰霍普金斯大学) Cornell University(康奈尔大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Meissa是一种轻量级多模态医疗代理智能模型,通过离线学习策略选择与执行,实现高效医疗决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09733 2026-03-11 cs.CV cs.MA 75%

FetalAgents: A Multi-Agent System for Fetal Ultrasound Image and Video Analysis

FetalAgents:一种用于胎儿超声图像和视频分析的多智能体系统

Xiaotian Hu, Junwei Huang, Mingxuan Liu, Kasidit Anmahapong, Yifei Chen, Yitong Luo, Yiming Huang, Xuguang Bai, Zihan Li, Yi Liao, Haibo Qu, Qiyuan Tian

机构 * Tsinghua University(清华大学) University of California San Diego(加州大学圣地亚哥分校) West China Second University Hospital, Sichuan University(四川大学华西第二医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 FetalAgents是一种多智能体系统,通过动态协调视觉专家,实现胎儿超声图像和视频的端到端分析与报告,提供高准确性和流程对齐的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18315 2026-03-11 cs.NI 75%

CovertComBench: A First Domain-Specific Testbed for LLMs in Wireless Covert Communication

CovertComBench: 一个用于无线隐蔽通信中LLM的首个领域特定测试平台

Zhaozhi Liu, Jiaxin Chen, Yuanai Xie, Yuna Jiang, Minrui Xu, Xiao Zhang, Pan Lai, Zan Zhou

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 CovertComBench是首个用于评估LLM在无线隐蔽通信中安全约束优化能力的领域特定测试平台,揭示了LLM在高阶数学推导上的不足,强调需通过外部工具增强构建可信无线AI系统。

Comments 6 pages, corrected a typo: "DeepSeek-R1:70B" was previously incorrectly written as "DeepSeek-V3.2:70B"

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08921 2026-03-11 cs.CV cs.LG 74%

Vision-Language Models Encode Clinical Guidelines for Concept-Based Medical Reasoning

视觉-语言模型编码临床指南以实现基于概念的医学推理

Mohamed Harmanani, Bining Long, Zhuoxin Guo, Paul F. R. Wilson, Amirhossein Sabour, Minh Nguyen Nhat To, Gabor Fichtinger, Purang Abolmaesumi, Parvin Mousavi

机构 * Queen’s University(女王大学) University of British Columbia(不列颠哥伦比亚大学) McMaster University(麦马斯特大学) Vector Institute(向量研究所)

专题命中 领域大模型 :language model(title);分类 cs.LG

AI总结 MedCBR通过整合临床指南与视觉-语言模型,提升医学影像诊断的可解释性和决策支持能力。

Comments CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00957 2026-03-11 cs.CY 67%

Generative AI and LLMs in Industry: A text-mining Analysis and Critical Evaluation of Guidelines and Policy Statements Across Fourteen Industrial Sectors

生成式AI与大语言模型在工业中的应用:对十四大工业部门指南和政策声明的文本挖掘分析与批判性评估

Junfeng Jiao, Saleh Afroogh, Kevin Chen, David Atkinson, Amit Dhurandhar

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文通过文本挖掘分析十四大工业部门的指南和政策声明,评估生成式AI和大语言模型的治理挑战,提出负责任整合的建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09349 2026-03-11 cs.LG cs.AI 62%

TA-GGAD: Testing-time Adaptive Graph Model for Generalist Graph Anomaly Detection

TA-GGAD: 通用图异常检测的测试时自适应图模型

Xiong Zhang, Hong Peng, Changlong Fu, Xin Jin, Yun Yang, Cheng Xie

机构 * School of Software and AI, Yunnan University(云南大学软件与人工智能学院)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 TA-GGAD提出一种测试时自适应图模型,解决通用图异常检测中的域移问题,实现跨域泛化和高检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00097 2026-03-11 cs.LG cs.AI 62%

GraphKeeper: Graph Domain-Incremental Learning via Knowledge Disentanglement and Preservation

GraphKeeper: 通过知识解耦与保留实现图领域增量学习

Zihao Guo, Qingyun Sun, Ziwei Zhang, Haonan Yuan, Huiping Zhuang, Xingcheng Fu, Jianxin Li

机构 * SKLCCSE, School of Computer Science and Engineering, Beihang University(信息与通信工程学院,北京航空航天大学) Shien-Ming Wu School of Intelligent Engineering, South China University of Technology(智能工程学院,华南理工大学) Key Lab of Education Blockchain and Intelligent Technology, Guangxi Normal University(教育区块链与智能技术重点实验室,广西师范大学)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 GraphKeeper通过知识解耦与保留解决图领域增量学习中的灾难性遗忘问题,实现跨多领域稳定学习。

Comments Accepted by the Main Track of NeurIPS-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09374 2026-03-11 cs.CV cs.AI 57%

MIL-PF: Multiple Instance Learning on Precomputed Features for Mammography Classification

MIL-PF:基于预计算特征的多实例学习用于乳腺分类

Nikola Jovišić, Milica Škipina, Nicola Dall'Asen, Dubravko Ćulibrk

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI

AI总结 MIL-PF通过预计算特征和轻量级聚合模块,实现高效乳腺分类,减少训练复杂性并提升分类性能。

Comments 10 pages, 2 figures, 4 tables. Code will be released

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08989 2026-03-11 cs.CL 57%

Automated Thematic Analysis for Clinical Qualitative Data: Iterative Codebook Refinement with Full Provenance

临床定性数据的自动化主题分析:带完整溯源的迭代代码书精炼

Seungjun Yi, Joakim Nguyen, Huimin Xu, Terence Lim, Joseph Skrovan, Mehak Beri, Hitakshi Modi, Andrew Well, Carlos M. Mery, Yan Zhang, Mia K. Markey, Ying Ding

专题命中 领域大模型 :LLM(abstract);分类 cs.CL

AI总结 本文提出一个结合迭代代码书精炼和完整溯源追踪的自动化主题分析框架,在多个临床和社交媒体语料库上取得了较高的综合质量评分,且在四个数据集上显著提升了代码重用性和分布一致性。

Comments Submitted to AMIA 2026 Annual Symposium (American Medical Informatics Association)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18384 2026-03-11 cs.CV 50%

LiDAR Remote Sensing Meets Weak Supervision: Concepts, Methods, and Perspectives

LiDAR遥感与弱监督学习:概念、方法与展望

Yuan Gao, Shaobo Xia, Pu Wang, Xiaohuan Xi, Sheng Nie, Cheng Wang

机构 * aircas.ac.cn(航空科学研究院)

专题命中 领域大模型 :foundation model(abstract)

AI总结 本文从弱监督学习视角系统回顾了LiDAR遥感的最新进展,探讨了弱监督方法在数据解释、参数反演及跨域适应中的应用,并展望了WSL在提升LiDAR遥感性能与泛化能力方面的未来方向。

Journal ref ISPRS Journal of Photogrammetry and Remote Sensing Volume 235, May 2026, Pages 72-104

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 15 篇

2308.07847 2026-03-11 cs.CR 89%

Robustness Over Time: Understanding Adversarial Examples' Effectiveness on Longitudinal Versions of Large Language Models

时间鲁棒性:对抗示例在大型语言模型纵向版本中的有效性

Yugeng Liu, Tianshuo Cong, Zhengyu Zhao, Michael Backes, Yun Shen, Yang Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文研究了大型语言模型在纵向版本中的对抗鲁棒性,发现更新并不总是提升鲁棒性,部分模型在误分类和幻觉方面有所下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09012 2026-03-11 cs.HC 78%

"Who wants to be nagged by AI?": Investigating the Effects of Agreeableness on Older Adults' Perception of LLM-Based Voice Assistants' Explanations

谁想被AI nag?:探究 agreeableness 对老年人感知基于LLM的语音助手解释的影响

Niharika Mathur, Hasibur Rahman, Smit Desai

专题命中 知识编辑与模型理解 :LLM(title,abstract)

AI总结 研究探讨了agreeableness对老年人感知基于LLM的语音助手解释的影响,发现高 agreeableness 助手在日常场景中更受信任,但在紧急情况下清晰度更重要,且可接受的老年人更严厉惩罚低 agreeableness 助手。

Comments To be published as a poster extended abstract at CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08869 2026-03-11 cs.CL 74%

One Language, Two Scripts: Probing Script-Invariance in LLM Concept Representations

一种语言,两种文字:探究LLM概念表示中的文字不变性

Sripad Karne

专题命中 知识编辑与模型理解 :LLM(title);分类 cs.CL

AI总结 本研究通过塞尔维亚双文测试,发现SAE特征在不同书写系统下仍保持语义一致性,表明模型能捕捉超越表面分词的抽象语义。

Comments Accepted at the UCRL Workshop at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09125 2026-03-11 cs.CV cs.AI 70%

QUSR: Quality-Aware and Uncertainty-Guided Image Super-Resolution Diffusion Model

QUSR: 一种基于质量感知和不确定性引导的图像超分辨率扩散模型

Junjie Yin, Jiaju Li, Hanfa Xing

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 QUSR通过引入质量感知先验和不确定性引导噪声生成模块,提升图像超分辨率在复杂场景下的真实感和细节还原能力。

Comments This paper has been accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09212 2026-03-11 eess.AS 67%

Acoustic and Semantic Modeling of Emotion in Spoken Language

语音中情感的声学与语义建模

Soumya Dutta

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

AI总结 本研究通过联合建模声学与语义信息,提升语音中情感的理解与合成能力,提出情感意识的预训练框架和对话场景下的情感识别方法,以及无文本的语音情感风格转换技术。

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09972 2026-03-11 cs.LG cs.AI cs.CV 62%

From Data Statistics to Feature Geometry: How Correlations Shape Superposition

从数据统计到特征几何:相关性如何塑造叠加

Lucas Prieto, Edward Stevinson, Melih Barsbey, Tolga Birdal, Pedro A. M. Mediano

机构 * Imperial College London(帝国理工学院伦敦分校)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG

AI总结 通过Bag-of-Words Superposition研究特征相关性对叠加的影响,揭示现实数据中叠加可产生建设性干扰和语义聚类。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09815 2026-03-11 cs.LG cs.AI 62%

Correction of Transformer-Based Models with Smoothing Pseudo-Projector

基于平滑伪投影器的变换器模型校正

Vitaly Bulgakov

机构 * Profiteya LLC Mass General Brigham

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于伪投影器的变换器模型校正方法,通过抑制噪声敏感性提升训练动态和鲁棒性。

Comments 29 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25268 2026-03-11 cs.RO cs.AI cs.CV 57%

SynHLMA:Synthesizing Hand Language Manipulation for Articulated Object with Discrete Human Object Interaction Representation

SynHLMA:基于离散人类物体交互表示的合成手语操纵

Wang zhi, Yuyan Liu, Liu Liu, Li Zhang, Ruixuan Lu, Dan Guo

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 SynHLMA通过离散人类物体交互表示生成可变形物体的手语操纵序列,实现抓取生成、预测和插值任务。

详情

展开后加载摘要…

URL PDF HTML 收藏