arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 1111 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 1111 篇

2602.05116 2026-07-23 eess.SY cs.SY 版本更新 67%

GPU-to-Grid: Voltage Regulation via GPU Utilization Control

GPU到电网:通过GPU利用率控制实现电压调节

Zhirui Liang, Jae-Won Chung, Mosharaf Chowdhury, Jiasi Chen, Vladimir Dvorkin

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 本文提出GPU到电网框架,通过控制GPU利用率实现分布级电压调节,发现减少GPU功率消耗可能缓解电压下限问题,而增加GPU功率可缓解电压上限问题,挑战传统观点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19863 2026-07-22 cs.CV 版本更新 67%

Brewing Stronger Features: Dual-Teacher Distillation for Multispectral Earth Observation

酿造更强的特征:多光谱地球观测的双教师蒸馏

Filip Wolf, Blaž Rolih, Luka Čehovin Zajc

机构 * University of Ljubljana, Faculty of Computer and Information Science(卢布尔雅纳大学计算机与信息科学学院)

专题命中 效率与部署 :foundation model(abstract);pretraining(abstract)

AI总结 本文提出双教师对比蒸馏框架,用于多光谱地球观测,通过结合多光谱和光学教师,实现跨模态表示学习,提升多光谱和光学数据的性能。

Comments Accepted to CVPR 2026 as Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12035 2026-07-22 cs.AR cs.CV 版本更新 67%

Timeripple: Accelerating vDiTs by Understanding the Spatio-Temporal Correlations in Latent Space

Timeripple:通过理解潜在空间中的时空相关性加速视频扩散变换器

Wenxuan Miao, Yulin Sun, Aiyue Chen, Jing Lin, Yiwu Yao, Yiming Gan, Jieru Zhao, Jingwen Leng, Minyi Guo, Yu Feng

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Qizhi Institute(上海启智研究院) Huawei Technologies Co.,Ltd(华为技术有限公司) Institute of Computing Technology, Chinese Academy of Science(中国科学院计算技术研究所)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 针对视频生成中vDiT模型推理延迟问题,利用潜在空间时空相关性,提出轻量级自适应重用策略,通过重用相关令牌部分注意力分数近似计算,相比现有技术计算节省85%,且视频质量损失小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28634 2026-07-21 cs.RO 版本更新 67%

PrimitiveVLA: Learning Reusable Motion Primitives for Efficient and Generalizable Robotic Manipulation

PrimitiveVLA:学习可复用的运动基元以实现高效且可泛化的机器人操作

Yutai Li, Shaohui Peng, Jiaming Guo, Di Huang, Zihao Zhang, Yuxuan Guo, Yunkai Gao, Siming Lan, Ling Li, Xing Hu, Yunji Chen

机构 * State Key Lab of Processors, Institute of Computing Technology, CAS(处理器国家重点实验室,计算技术研究所,中国科学院) Jiangsu Key Laboratory of AI for Industries, Institute of AI for Industries, CAS(江苏人工智能工业重点实验室,人工智能工业研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Cambricon Technologies(寒武科技) Intelligent Software Research Center, Institute of Software, CAS(软件研究所智能软件研究中心,中国科学院) University of Science and Technology of China(中国科学技术大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 提出PrimitiveVLA框架,通过将视觉-语言-动作模型从直接指令到控制映射转向以基元为中心的拆解与组装范式,利用多模态规范表示和自动化流水线,提升数据效率并实现零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13795 2026-07-21 cs.NI 版本更新 67%

Agent-OSI: An Interoperability Architecture for Communication and Settlement in the Decentralized Internet of Agents

Agent-OSI: 向去中心化的智能体互联网的分层协议栈

Wenxin Xu, Taotao Wang, Yihan Xia, Shengli Zhang, Soung Chang Liew

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 Agent-OSI提出了一种基于现有互联网的六层协议栈,旨在实现去中心化智能体网络的互操作性、信任和按使用付费结算。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27350 2026-07-20 cs.AR 版本更新 67%

CHIA: An open-source framework for principled, agentic AI-driven hardware/software co-design research

CHIA: 一个用于原则性、智能体AI驱动的硬件/软件协同设计研究的开源框架

Angela Cui, Ferran Hermida-Rivera, Jack Toubes, Raghav Gupta, Jim Fang, Chengyi Lux Zhang, Ella Schwarz, Junha Kim, Yakun Sophia Shao, Borivoje Nikolic, Christopher W. Fletcher, Sagar Karandikar

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 提出CHIA开源框架,通过有向循环图表达智能体AI驱动的协同设计流程,支持多种工具集成,实现可扩展、容错的大规模协同设计研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17222 2026-07-20 cs.CR 版本更新 67%

Triple-Hoisted Baby-Step Giant-Step Linear Transformation over CKKS Homomorphic Encryption and Hardware Accelerator

三重提升的Baby-Step Giant-Step线性变换在CKKS同态加密与硬件加速器上

Sajjad Akherati, Xinmiao Zhang

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文提出了一种三重提升的Baby-Step Giant-Step算法,用于减少CKKS同态加密中线性变换所需的密文旋转次数,并设计了优化的FPGA硬件加速器以降低离芯片内存访问和计算延迟。

Comments 11 pages, 6 figures, 7 tables, 34 refrences, and journal paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20147 2026-07-20 cs.SE 版本更新 67%

Not All Tokens Matter: Data-Centric Optimization for Efficient Code Summarization

并非所有标记都重要:面向高效代码摘要的数据导向优化

Saima Afrin, Zaiyu Cheng, Tushar Sharma, Alexander Serebrenik, Massimiliano Di Penta, Antonio Mastropaolo

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本研究探讨了系统提示对代码生成任务中ILMs和CLMs性能的影响,发现模型规模越大影响越显著,少样本提示效果优于零样本提示,且Java对提示变化更敏感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25743 2026-07-16 econ.EM 版本更新 67%

Agentic Economic Modeling

代理经济建模

Bohan Zhang, Jiaxuan Li, Ali Hortaçsu, Xiaoyang Ye, Victor Chernozhukov, Angelo Ni, Edward W Huang

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 本文提出代理经济建模(AEM),通过合成大语言模型选择与少量人类证据对齐,提升经济计量推断可靠性。方法生成任务条件合成选择,学习偏差修正映射,再用标准计量估计器恢复需求弹性。实验验证AEM在大规模联合研究和区域实地实验中有效,提升RCT效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13894 2026-07-14 cs.LG cs.AI cs.CL cs.CV 版本更新 67%

Gefen: Optimized Stochastic Optimizer

Gefen: 优化随机优化器

Nadav Benedek, Tomer Koren, Ohad Fried

机构 * Reichman University(赖希曼大学) Tel Aviv University(特拉维夫大学) Google Research(谷歌研究院)

专题命中 效率与部署 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出Gefen优化器,通过共享二阶矩估计和量化一阶矩,将AdamW内存占用减少约8倍,同时保持相同性能,支持更大批量和吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25917 2026-07-14 cs.AI cs.CL cs.LG 版本更新 67%

Recursive Multi-Agent Systems

递归多智能体系统

Jiaru Zou, Rui Pan, Ruizhong Qiu, Pan Lu, Shizhe Diao, Jindong Jiang, Hanghang Tong, Tong Zhang, Markus J. Buehler, Jingrui He, James Zou

机构 * UIUC(伊利诺伊大学香槟分校) Stanford University(斯坦福大学) NVIDIA(英伟达) MIT(麻省理工学院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出递归多智能体框架RecursiveMAS,通过递归计算提升多智能体协作效率,实验证明其在多个基准测试中准确率提升8.3%,推理速度提升1.2-2.4倍,token使用减少34.6%-75.6%。

Comments Project Website: https://recursivemas.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29655 2026-07-08 cs.CV cs.GR 版本更新 67%

SuperVoxelGPT: Adaptive and Ordered 3D Tokenization for Autoregressive Shape Generation

SuperVoxelGPT: 自适应有序3D令牌化用于自回归形状生成

Yuan Li, Congyi Zhang, Xifeng Gao, Xiaohu Guo

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) Tencent America(腾讯美国)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 提出SuperVoxelGPT框架,通过自适应且有序的超体素令牌化解决自回归3D生成中序列长度与空间顺序的矛盾,实现高质量、高效率的形状生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11001 2026-07-08 cs.DB cs.MA 版本更新 67%

Rethinking Query Optimization for Multi-Agent Systems [Vision]

重新思考多智能体系统的查询优化 [视觉]

Zoi Kaoudi, Ioana Giurgiu

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 研究多智能体系统的查询优化问题,提出NOMA框架,针对其面临的多维搜索等挑战,通过控制实验揭示差异,最优计划为异构配置,实际部署存在低效率,还提出集成优化循环设定研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09921 2026-07-03 cs.CV 版本更新 67%

WikiCLIP: An Efficient Contrastive Baseline for Open-domain Visual Entity Recognition

WikiCLIP: 一种高效的开放领域视觉实体识别对比基线

Shan Ning, Longtian Qiu, Jiaxuan Sun, Xuming He

机构 * ShanghaiTech University(上海科技大学) Shanghai Engineering Research Center of Intelligent Vision and Imaging(上海智能视觉与成像工程技术研究中心) Lingang Laboratory(临港实验室)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文提出WikiCLIP,通过结合大语言模型嵌入和视觉引导的知识适配器,高效解决开放领域视觉实体识别问题,在OVEN基准测试中显著超越现有基线。

Comments Accepted by CVPR26, codes and weights are publicly available

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05717 2026-07-02 eess.AS 版本更新 67%

Enhancing Audio Captioning with Auxiliary AudioSet Semantics

利用辅助AudioSet语义增强音频描述生成

Shubham Gupta, Adarsh Arigala, Sri Rama Murty Kodukula

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 提出一种资源高效的自动音频描述生成框架,通过ConvNeXt编码器提取帧级声学表示并融合AudioSet关键词语义,使用紧凑的六层BART解码器生成描述,在Clotho V2和AudioCaps上取得竞争性性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11925 2026-07-02 cs.CV 版本更新 67%

Continuous Speculative Decoding for Autoregressive Image Generation

连续推测解码用于自回归图像生成

Zili Wang, Zheng Zhang, Kun Ding, Qi Yang, Fei Li, Shiming Xiang

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统实验室) JD.COM Inc(京东集团股份有限公司) China Tower Corporation Limited(中国铁塔股份有限公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 提出连续推测解码方法,通过近似准则、去噪轨迹对齐和接受-拒绝采样,加速连续视觉自回归模型,实现2倍以上加速且保持生成质量。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05560 2026-07-01 cs.SE 版本更新 67%

An Iterative Test-and-Repair Framework for Competitive Code Generation

面向竞争性代码生成的迭代测试与修复框架

Lingxiao Tang, Muyang Ye, Zhaoyang Chu, Xiaoxue Ren, Zhongxin Liu, Lingfeng Bao, He Ye

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 FixAudit通过迭代测试与修复循环改进代码生成,通过共享模型和专门角色联合训练,提升代码质量与测试覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23951 2026-06-29 cs.CV 版本更新 67%

HunyuanImage 3.0 Technical Report

HunyuanImage 3.0 技术报告

Tencent Hunyuan Foundation Model Team

专题命中 效率与部署 :foundation model(abstract);post-training(abstract)

AI总结 HunyuanImage 3.0是一种统一多模态理解与生成的自回归模型,通过精心数据整理、先进架构、原生思维链、渐进预训练和激进后训练,训练出超800亿参数MoE模型(推理时激活130亿),在文本-图像对齐和视觉质量上媲美最先进模型,并开源代码和权重。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26376 2026-06-25 cs.CV 版本更新 67%

ScalingAR: Scaling Confidence for Autoregressive Image Generation

ScalingAR: 自回归图像生成的置信度缩放

Harold Haodong Chen, Xianfeng Wu, Wen-Jie Shu, Rongjin Guo, Disen Lan, Harry Yang, Ying-Cong Chen

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 提出ScalingAR框架,通过令牌熵作为置信度信号,在轮廓级和策略级进行自适应轨迹剪枝和动态引导调度,无需早期解码或外部奖励,显著提升自回归图像生成性能。

Comments ICML 2026; Code: https://github.com/EnVision-Research/ScalingAR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12342 2026-06-23 eess.AS 版本更新 67%

MamTra: A Hybrid Mamba-Transformer Backbone for Speech Synthesis

MamTra:一种用于语音合成的混合Mamba-Transformer骨干网络

Tan Dat Nguyen, Sangmin Bae, Joon Son Chung, Ji-Hoon Kim

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 提出MamTra混合框架,结合Mamba的线性效率与Transformer的全局建模能力,通过知识迁移策略降低训练成本,在仅用2%数据时仍保持语音保真度并减少34%推理显存。

Comments Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10324 2026-06-23 cs.CV 版本更新 67%

EchoingPixels: Aliasing-Resistant Joint Token Reduction for Audio-Visual LLMs

EchoingPixels: 抗混叠的音频-视觉联合令牌缩减方法

Chao Gong, Depeng Wang, Zhipeng Wei, Ya Guo, Huijia Zhu, Jingjing Chen

机构 * Fudan University(复旦大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 针对音频-视觉大语言模型中令牌冗余和位置混叠问题,提出EchoingPixels框架,通过跨模态语义筛和Sync-RoPE实现抗混叠的联合令牌缩减,仅用5-20%令牌达到全模型性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10791 2026-06-19 eess.IV 版本更新 67%

Semantic Satellite Communications for Synchronized Audiovisual Reconstruction

面向同步视听重建的语义卫星通信

Fangyu Liu, Peiwen Jiang, Wenjin Wang, Xiao Li, Shi Jin

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 提出自适应多模态语义传输系统,通过双流生成架构和动态关键帧更新机制,在带宽受限的卫星场景下实现高质量同步视听重建,显著降低带宽消耗并提升鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01690 2026-06-19 physics.optics physics.app-ph physics.comp-ph 版本更新 67%

Quantum Nonlinearity for Optical Neural Computing

用于光学神经计算的量子非线性

Qingyi Zhou, Jungmin Kim, Yutian Tao, Guoming Huang, Ming Zhou, Zewei Shao, Zongfu Yu

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 提出嵌入量子发射体的逆向设计纳米光子结构,利用量子发射体的饱和特性实现强非线性,通过物理感知训练实现全光神经网络的非线性分类和强化学习,并建立量化非线性与网络表达能力的框架。

Comments Main text: 11 pages, 4 figures; Supplementary: 36 pages, 26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05373 2026-06-16 cs.SD eess.AS 版本更新 67%

MSpoofTTS: Multi-Resolution Spoof-Guided Inference for Discrete Speech Synthesis

MSpoofTTS:用于离散语音合成的多分辨率欺骗引导推理

Junchuan Zhao, Minh Duc Vu, Ye Wang

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) Department of Statistics & Data Science, National University of Singapore(新加坡国立大学统计与数据科学系)

专题命中 效率与部署 :language model(abstract);preference optimization(abstract)

AI总结 提出MSpoof-TTS框架,通过多分辨率欺骗检测和分层解码策略,无需重新训练即可提升神经编解码语言模型的零样本语音合成质量。

Comments 7 pages, 3 figures, 3 tables, 2 algorithms. Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08976 2026-06-16 cs.CV cs.DC cs.IR 版本更新 67%

MIRAGE: Runtime Scheduling for Multi-Vector Image Retrieval with Hierarchical Decomposition

MIRAGE:基于层次分解的多向量图像检索运行时调度

Maoliang Li, Ke Li, Yaoyang Liu, Jiayu Chen, Zihao Zheng, Yinjun Wu, Chenchen Liu, Xiang Chen

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) School of Electronics Engineering and Computer Science, Peking University(北京大学电子工程与计算机科学学院) School of Information, Renmin University of China(中国人民大学信息学院) School of Integrated Circuit Science and Engineering, Beihang University(北京航空航天大学集成电路科学与工程学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 提出MIRAGE框架,通过层次化分解和跨层次相似性一致性减少冗余计算,实现多向量图像检索的精度提升和3.5倍计算加速。

Comments Will appear in DAC'2026, camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01661 2026-06-16 cs.DC 版本更新 67%

HeRo: Adaptive Orchestration of Agentic RAG on Heterogeneous Mobile SoC

HeRo: 异构移动SoC上智能体RAG的自适应编排

Maoliang Li, Jiayu Chen, Zihao Zheng, Ziqian Li, Xinhao Sun, Guojie Luo, Chenchen Liu, Xiang Chen

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 提出HeRo框架,通过基于性能分析的在线调度器,结合形状感知子阶段划分、关键性加速器映射和带宽感知并发控制,在异构移动SoC上实现低延迟智能体RAG,端到端延迟降低达10.94倍。

Comments Will appear in DAC'2026, Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09174 2026-06-11 cs.HC 版本更新 67%

Demonstrating chart-plot: Closing the Last Mile of Academic Chart Generation

展示chart-plot:弥合学术图表生成的最后一英里

Yinghao Tang, Yupeng Xie, Yingchaojie Feng, Jiale Lao, Tingfeng Lan, Wei Chen

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 提出chart-plot系统,通过风格感知代码生成、部署感知渲染循环和结构化编辑层,解决学术图表从代码到发表的质量差距问题。

Comments 7 pages, 6 figures. Submitted to the VLDB ADS 2026 Workshop: The Joint Workshop on Agentic Data Systems and Data-Centric AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06057 2026-06-11 cs.DC cs.MS 版本更新 67%

FalconGEMM: Surpassing Hardware Peaks with Lower-Complexity Matrix Multiplication

FalconGEMM:通过低复杂度矩阵乘法超越硬件极限

Honglin Zhu, Jiaping Cao, Jiang Shao, Siyuan Feng, Qian Qiu, Peng Chen, Xu Zhang, Yixian Zhou, Man Lung Yiu, Guang Ji, Minwen Deng, Jintao Meng, Wenxi Zhu

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 FalconGEMM通过自动化部署优化低复杂度矩阵乘法算法,实现DL性能提升,在GPU和CPU上均超越传统GEMM库和AlphaTensor等竞品。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09141 2026-06-10 eess.AS cs.SD 版本更新 67%

FlashTTS: Fast Streaming TTS with MTP Acceleration and X-pred Mean Flow Distillation

FlashTTS: 基于MTP加速和X-pred均值流蒸馏的快速流式TTS

Hanke Xie, Xiaming Ren, Dake Guo, Ruonan You, Wenhao Li, Jingbin Hu, Guobin Ma, Huakang Chen, Kejie Xu, Rui Huang, Weiguo Tan, Xianrong Wang, Lei Xie

机构 * Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 提出FlashTTS框架,通过滞后多轨架构、并行多令牌预测和X-pred均值流匹配解码器,实现低延迟流式TTS,首包延迟降至325ms,保持零样本语音克隆和跨语言可懂度。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22208 2026-06-09 cs.CV 版本更新 67%

EvoIR-Agent: Self-Evolving Image Restoration Agentic System via Experience-Driven Learning

EvoIR-Agent: 通过经验驱动学习实现自进化图像修复智能体

Kailin Zhuang, Jiawei Wu, Zhi Jin

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文提出EvoIR-Agent,通过经验驱动学习解决图像修复中经验不足导致的规划失败问题,通过构建分层经验池和自进化机制提升修复性能和效率,实验表明其在全参考指标上表现优异,且在性能与效率之间取得显著平衡。

Comments Temporarily withdrawn for institutional clearance and compliance review. A revised version will be uploaded once the process is finalized

详情

展开后加载摘要…

URL PDF HTML 收藏