arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-25 至 2026-02-25 共收录 207 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 50 篇

2602.20520 2026-02-25 cs.CV cs.AI 57%

How Do Inpainting Artifacts Propagate to Language?

图像修复伪影如何传播到语言?

Pratham Yashwante, Davit Abrahamyan, Shresth Grover, Sukruth Rao

机构 * UC San Diego(圣迭戈大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

AI总结 研究图像修复伪影对视觉-语言模型语言生成的影响,通过两阶段诊断方法分析重建保真度与描述质量的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20198 2026-02-25 q-bio.QM cs.LG 57%

KEMP-PIP: A Feature-Fusion Based Approach for Pro-inflammatory Peptide Prediction

KEMP-PIP:一种基于特征融合的促炎肽预测方法

Soumik Deb Niloy, Md. Fahmid-Ul-Alam Juboraj, Swakkhar Shatabda

机构 * Department of Computer Science and Engineering(计算机科学与工程系) BRAC University(布拉克大学)

专题命中 评测与基准 :language model(abstract);分类 cs.LG

AI总结 KEMP-PIP通过融合深度嵌入与手工特征,提升促炎肽预测性能,实现更高的MCC、准确率和AUC。

Comments 11 pages, 4 figures, 6 tables; includes web server and GitHub implementation

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20170 2026-02-25 cs.CY cs.AI 57%

CAGE: A Framework for Culturally Adaptive Red-Teaming Benchmark Generation

CAGE:一种用于文化适应性红队基准生成的框架

Chaeyun Kim, YongTaek Lim, Kihyun Kim, Junghwan Kim, Minwoo Kim

机构 * Seoul National University(首尔国立大学) AI Safety Team, DATUMO INC(DATUMO公司人工智能安全团队)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

AI总结 CAGE框架通过文化适应性生成方法,系统地调整红队提示以适应不同文化背景,从而生成更有效的安全评估基准。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25609 2026-02-25 cs.AI cs.CY 57%

A Framework for Studying AI Agent Behavior: Evidence from Consumer Choice Experiments

研究AI代理行为的框架:来自消费者选择实验的证据

Manuel Cherep, Chengtian Ma, Abigail Xu, Maya Shaked, Pattie Maes, Nikhil Singh

机构 * MIT(麻省理工学院) Tsinghua University(清华大学) Dartmouth College(达特茅斯学院)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

AI总结 本文提出ABxLab框架,通过控制选项属性和说服性提示,研究AI代理在现实决策中的选择行为,揭示代理在无认知限制下仍存在强烈偏好偏见,为AI代理行为研究提供测试平台。

Comments ICLR, 31 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03393 2026-02-25 cs.LG 57%

Pre-training Epidemic Time Series Forecasters with Compartmental Prototypes

利用传染模型原型预训练流行病时间序列预测器

Zewen Liu, Juntong Ni, Bohan Wang, Max S. Y. Lau, Wei Jin

机构 * Emory University Department of Computer Science Atlanta GA USA(埃默里大学计算机科学系) Emory University Rollins School of Public Health Atlanta GA USA(埃默里大学罗林斯公共卫生学院) Emory University(埃默里大学)

专题命中 评测与基准 :foundation model(abstract);分类 cs.LG

AI总结 CAPE 是首个开源的流行病预测预训练模型,通过预训练学习流行病学语义,提升预测鲁棒性和泛化能力。

Comments version 3.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21015 2026-02-25 cs.CV 50%

From Perception to Action: An Interactive Benchmark for Vision Reasoning

从感知到行动:一个交互式基准测试用于视觉推理

Yuhao Wu, Maojia Song, Yihuai Lan, Lei Wang, Zhiqiang Hu, Yao Xiao, Heng Zhou, Weihua Zheng, Dylan Raharja, Soujanya Poria, Roy Ka-Wei Lee

机构 * Singapore University of Technology(新加坡科技设计大学) Singapore Management University (SMU), Singapore(新加坡管理学院) Nanyang Technological University (NTU), Singapore(南洋理工大学) University of Science(科学大学)

专题命中 评测与基准 :language model(abstract)

AI总结 CHAIN基准测试通过交互式3D物理驱动环境,评估模型在动态环境中理解、规划和执行基于物理约束的结构化动作序列的能力。

Comments Work in processing. Website: https://social-ai-studio.github.io/CHAIN/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13134 2026-02-25 cs.SE cs.CV 50%

Earth Embeddings as Products: Taxonomy, Ecosystem, and Standardized Access

地球嵌入作为产品:分类、生态系统和标准化访问

Heng Fang, Adam J. Stewart, Isaac Corley, Xiao Xiang Zhu, Hossein Azizpour

机构 * KTH Royal Institute of Technology, Stockholm, Sweden(皇家理工学院) Chair of Data Science in Earth Observation, Technical University of Munich, Munich, Germany(地球观测数据科学主任,慕尼黑技术大学) Wherobots, San Antonio, USA(Wherobots公司)

专题命中 评测与基准 :foundation model(abstract)

AI总结 本文提出通过三层分类法标准化地球嵌入数据,扩展TorchGeo以统一API,解决碎片化生态系统问题,提升地球观测工作流程的透明性和可访问性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20818 2026-02-25 cs.CV 50%

GatedCLIP: Gated Multimodal Fusion for Hateful Memes Detection

GatedCLIP:用于仇恨表情包检测的门控多模态融合

Yingying Guo, Ke Zhang, Zirong Zeng

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 评测与基准 :language model(abstract)

AI总结 GatedCLIP通过门控融合和对比学习提升多模态仇恨表情包检测性能,实现0.66 AUROC优于CLIP基线。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20543 2026-02-25 cs.CV 50%

Beyond Human Performance: A Vision-Language Multi-Agent Approach for Quality Control in Pharmaceutical Manufacturing

超越人类表现:一种视觉-语言多智能体方法用于制药制造中的质量控制

Subhra Jyoti Mandal, Lara Rachidi, Puneet Jain, Matthieu Duvinage, Sander W. Timmer

机构 * GSK, Enterprise AI(葛兰素史克、企业人工智能) Databricks

专题命中 评测与基准 :language model(abstract)

AI总结 本文提出一种结合深度学习与视觉-语言模型的多智能体框架,用于提高制药制造中菌落形成单位检测的准确性和效率,实现高质量的质量控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20500 2026-02-25 cs.RO cs.CV 50%

Strategy-Supervised Autonomous Laparoscopic Camera Control via Event-Driven Graph Mining

基于事件驱动图挖掘的策略监督自主腹腔镜摄像机控制

Keyu Zhou, Peisen Xu, Yahao Wu, Jiming Chen, Gaofeng Li, Shunlei Li

机构 * Hangzhou Dianzi University(杭州电子科技大学) Zhejiang University(浙江大学)

专题命中 评测与基准 :language model(abstract)

AI总结 本研究提出基于事件驱动图挖掘的策略监督自主腹腔镜摄像机控制方法,通过结合视觉-语言推理与闭环控制,提升手术视野稳定性与可解释性,实验表明其在减少视野偏移和图像抖动方面表现优异。

Comments Submitted to IEEE Transactions on Robotics (T-RO). 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03477 2026-02-25 hep-ph hep-ex 50%

$J/ψ$ production in proton-proton collisions at Spin Physics Detector energies of the JINR Nuclotron-based Ion Collider fAcility

$J/ψ$生产在质子-质子碰撞中的Spin Physics Detector能量范围内的Nuclotron-based Ion Collider fAcility

Shubham Sharma, Alexey Aparin

专题命中 评测与基准 :LLM(abstract)

AI总结 研究了在NICA SPD能量范围内的$J/ψ$生产,比较了不同参数化方法,揭示了颜色八极化机制的主导作用及胶子TMDs对阈值附近敏感性。

Comments 5 pages, 5 figures

Journal ref Phys. Rev. C 113, no.2, L022201 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 39 篇

2602.20457 2026-02-25 cs.LG stat.ML 89%

Oracle-Robust Online Alignment for Large Language Models

面向大语言模型的Oracle鲁棒在线对齐

Zimeng Li, Mudit Gaur, Vaneet Aggarwal

机构 * Purdue University(普渡大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出了一种Oracle鲁棒的在线对齐方法,通过引入不确定性集和敏感性惩罚,实现了对大语言模型在不准确偏好反馈下的鲁棒优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20489 2026-02-25 cs.CE 89%

Application of Large Language Models for Container Throughput Forecasting: Incorporating Contextual Information in Port Logistics

大型语言模型在集装箱吞吐量预测中的应用:在港口物流中融入上下文信息

Minseop Kim, Jaeeun Kwon, Hanbyeol Park, Kikun Park, Taekhyun Park, Hyerim Bae

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本研究利用大型语言模型预测集装箱吞吐量,通过设计新的提示结构融入港口运营上下文信息,实验表明其优于现有方法,并探讨了LLM在港口物流中的应用约束与未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11184 2026-02-25 cs.LG cs.AI 88%

KBVQ-MoE: KLT-guided SVD with Bias-Corrected Vector Quantization for MoE Large Language Models

KBVQ-MoE:基于KLT引导SVD与偏置校正向量量化的大语言模型MoE

Zukang Xu, Zhixiong Zhao, Xing Hu, Zhixuan Chen, Dawei Yang

机构 * Houmo AI Nanyang Technological University(南洋理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 KBVQ-MoE通过KLT引导SVD和偏置校正输出稳定化,提升MoE大语言模型的极低比特量化精度与部署效率。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20164 2026-02-25 cs.CL cs.LG 84%

Benchmarking Distilled Language Models: Performance and Efficiency in Resource-Constrained Settings

评估压缩语言模型:在资源受限环境中的性能与效率

Sachin Gopal Wani, Eric Page, Ajay Dholakia, David Ellison

专题命中 效率与部署 :language model(title,abstract);small language model(abstract);分类 cs.CL、cs.LG

AI总结 本文通过对比蒸馏模型与原始模型,验证了蒸馏在资源受限环境下提升性能与效率的优越性。

Comments 16 pages, 5 figures, accepted at the the 2025 TPCTC Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20595 2026-02-25 cs.CR cs.AI 83%

OptiLeak: Efficient Prompt Reconstruction via Reinforcement Learning in Multi-tenant LLM Services

OptiLeak: 通过强化学习在多租户LLM服务中高效重建提示

Longxiang Wang, Xiang Zheng, Xuhao Zhang, Yao Zhang, Ye Wu, Cong Wang

机构 * City University of Hong Kong(香港城市大学) ByteDance Inc.(字节跳动公司)

专题命中 效率与部署 :LLM(title,abstract);preference optimization(abstract);分类 cs.AI

AI总结 OptiLeak通过强化学习和两阶段微调,在多租户LLM服务中高效重建提示,减少请求次数达12.48倍,提升隐私保护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20662 2026-02-25 cs.AR 82%

TOM: A Ternary Read-only Memory Accelerator for LLM-powered Edge Intelligence

TOM:一种用于LLM赋能边缘智能的三进制只读存储器加速器

Hongyi Guan, Yijia Zhang, Wenqiang Wang, Yizhao Gao, Shijie Cao, Chen Zhang, Ningyi Xu

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

AI总结 TOM通过三进制量化与混合ROM-SRAM架构,实现高密度、低功耗的边缘智能推理加速。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20449 2026-02-25 cs.LG cs.AI cs.CL q-bio.BM 82%

Protein Language Models Diverge from Natural Language: Comparative Analysis and Improved Inference

蛋白质语言模型偏离自然语言:比较分析与改进推理

Anna Hart, Chi Han, Jeonghwan Kim, Huimin Zhao, Heng Ji

机构 * Siebel School of Data Science and Computing(数据科学与计算系) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) DOE Center for Advanced Bioenergy and Bioproducts Innovation(能源与生物产品创新部门) Chemical and Biomolecular Engineering(化学与生物分子工程系)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究通过比较蛋白质与自然语言领域中信息分布差异,改进蛋白质非结构性质预测的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08219 2026-02-25 cs.LG 79%

Characterizing LLM Inference Energy-Performance Tradeoffs across Workloads and GPU Scaling

表征跨工作负载和GPU扩展的LLM推理能效权衡

Paul Joe Maliakel, Shashikant Ilager, Ivona Brandic

机构 * Multiscale Networked Systems Group University of Amsterdam, Netherlands(多尺度网络化系统组 阿姆斯特丹大学,荷兰)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.LG

AI总结 本文研究了LLM推理在不同工作负载和GPU扩展下的能效权衡,发现解码阶段主导推理时间且对GPU频率不敏感,通过降低频率可实现显著能耗节省,同时提出结合工作负载感知模型选择与阶段感知DVFS的节能策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10914 2026-02-25 cs.LG 79%

Foundation Models for Causal Inference via Prior-Data Fitted Networks

通过先验-数据拟合网络进行因果推断的基础模型

Yuchen Ma, Dennis Frauen, Emil Javurek, Stefan Feuerriegel

机构 * LMU Munich & MCML(慕尼黑莱茵恩大学及MCML)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

AI总结 CausalFM通过先验-数据拟合网络构建因果推断的基础模型框架,实现贝叶斯因果推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20918 2026-02-25 cs.AI cs.CL 79%

Predicting Sentence Acceptability Judgments in Multimodal Contexts

在多模态上下文中预测句子可接受性判断

Hyewon Jang, Nikolai Ilinykh, Sharid Loáiciga, Jey Han Lau, Shalom Lappin

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨了在多模态上下文中,视觉上下文对人类和LLM句子可接受性判断的影响,发现LLM在去除视觉上下文时表现更优,且不同模型的判断分布各异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21140 2026-02-25 cs.DC 78%

ReviveMoE: Fast Recovery for Hardware Failures in Large-Scale MoE LLM Inference Deployments

ReviveMoE: 大规模MoE大语言模型推理部署中硬件故障的快速恢复

Haley Li, Xinglu Wang, Cong Feng, Chunxu Zuo, Yanan Wang, Hei Lo, Yufei Cui, Bingji Wang, Duo Cui, Shuming Jing, Yizhou Shan, Ying Xiong, Jiannan Wang, Yong Zhang, Zhenan Fan

专题命中 效率与部署 :LLM(title,abstract)

AI总结 ReviveMoE通过无需重启服务实例实现大规模MoE大语言模型部署中的快速故障恢复,基于华为的xDeepServe平台和XCCL通信库。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20926 2026-02-25 cs.AI 77%

HELP: HyperNode Expansion and Logical Path-Guided Evidence Localization for Accurate and Efficient GraphRAG

HELP: 图形节点扩展与逻辑路径引导的证据定位用于准确且高效的图RAG

Yuqi Huang, Ning Liao, Kai Yang, Anning Hu, Shengchao Hu, Xiaoxing Wang, Junchi Yan

机构 * Shanghai Jiao Tong University, China(上海交通大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 HELP通过HyperNode扩展和逻辑路径引导的证据定位策略,提升图RAG在准确性和效率之间的平衡,实现高效且准确的知识检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20708 2026-02-25 cs.AI cs.CR 77%

ICON: Indirect Prompt Injection Defense for Agents based on Inference-Time Correction

ICON:基于推理时校正的代理间接提示注入防御

Che Wang, Fuyao Zhang, Jiaming Zhang, Ziqi Zhang, Yinghui Wang, Longtao Huang, Jianbo Gao, Zhong Chen, Wei Yang Bryan Lim

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡) Alibaba(阿里巴巴) School of Computer Science, Peking University, China(计算机科学学院,北京大学,中国)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ICON通过潜在空间轨迹探测和修正器实现对代理间接提示注入攻击的防御,有效提升任务连续性和安全性,同时保持高检测率和任务效用。

Comments 11 pages,

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20333 2026-02-25 cs.AI 77%

DMCD: Semantic-Statistical Framework for Causal Discovery

DMCD:基于语义-统计的因果发现框架

Samarth KaPatel, Sofia Nikiforova, Giacinto Paolo Saggese, Paul Smith

机构 * Causify AI

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 DMCD通过结合语义引导的先验和统计验证,实现了在因果发现任务中的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18337 2026-02-25 cs.CL 77%

Towards Efficient Agents: A Co-Design of Inference Architecture and System

迈向高效代理:推理架构与系统的一体化设计

Weizhe Lin, Hui-Ling Zhen, Shuai Yang, Xian Wang, Renxi Liu, Hanting Chen, Wangze Zhang, Chuansai Zhou, Yiming Li, Chen Chen, Xing Li, Zhiyuan Yang, Xiaosong Li, Xianzhi Yu, Zhenhua Dong, Mingxuan Yuan, Yunhe Wang

机构 * Huawei(华为)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出AgentInfer框架,通过整合推理架构与系统设计,提升代理的效率与稳定性,减少无效token消耗,实现速度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23502 2026-02-25 cs.NI 75%

Hierarchical Decision Mamba Meets Agentic AI: A Novel Approach for RAN Slicing in 6G

分层决策Mamba遇见代理AI:一种用于6G RAN切片的新方法

Md Arafat Habib, Medhat Elsayed, Majid Bavand, Pedro Enrique Iturria Rivera, Yigit Ozcan, Melike Erol-Kantarci

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种基于分层决策Mamba和大型语言模型的代理AI框架,用于6G RAN切片,通过整合自然语言理解与协调决策,提升切片性能。

Comments Accepted for publication in IEEE Networking Letters (Author's copy). Copyright belongs to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20732 2026-02-25 cs.AI 74%

CHESS: Context-aware Hierarchical Efficient Semantic Selection for Long-Context LLM Inference

基于上下文的分层高效语义选择:长上下文LLM推理

Chao Fei, Guozhong Li, Chenxi Liu, Panos Kalnis

机构 * King Abdullah University of Science Centre for Artificial Intelligence Robotics, Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences, Hong Kong, China

专题命中 效率与部署 :LLM(title);分类 cs.AI

AI总结 CHESS通过上下文感知的分层选择策略和系统级优化,实现长上下文LLM推理的高效缓存管理,以1%的缓存使用率获得4.56倍的吞吐量提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15763 2026-02-25 cs.LG cs.CL 73%

GLM-5: from Vibe Coding to Agentic Engineering

GLM-5:从振动编码到代理工程

GLM-5-Team, :, Aohan Zeng, Xin Lv, Zhenyu Hou, Zhengxiao Du, Qinkai Zheng, Bin Chen, Da Yin, Chendi Ge, Chenghua Huang, Chengxing Xie, Chenzheng Zhu, Congfeng Yin, Cunxiang Wang, Gengzheng Pan, Hao Zeng, Haoke Zhang, Haoran Wang, Huilong Chen, Jiajie Zhang, Jian Jiao, Jiaqi Guo, Jingsen Wang, Jingzhao Du, Jinzhu Wu, Kedong Wang, Lei Li, Lin Fan, Lucen Zhong, Mingdao Liu, Mingming Zhao, Pengfan Du, Qian Dong, Rui Lu, Shuang-Li, Shulin Cao, Song Liu, Ting Jiang, Xiaodong Chen, Xiaohan Zhang, Xuancheng Huang, Xuezhen Dong, Yabo Xu, Yao Wei, Yifan An, Yilin Niu, Yitong Zhu, Yuanhao Wen, Yukuo Cen, Yushi Bai, Zhongpei Qiao, Zihan Wang, Zikang Wang, Zilin Zhu, Ziqiang Liu, Zixuan Li, Bojie Wang, Bosi Wen, Can Huang, Changpeng Cai, Chao Yu, Chen Li, Chengwei Hu, Chenhui Zhang, Dan Zhang, Daoyan Lin, Dayong Yang, Di Wang, Ding Ai, Erle Zhu, Fangzhou Yi, Feiyu Chen, Guohong Wen, Hailong Sun, Haisha Zhao, Haiyi Hu, Hanchen Zhang, Hanrui Liu, Hanyu Zhang, Hao Peng, Hao Tai, Haobo Zhang, He Liu, Hongwei Wang, Hongxi Yan, Hongyu Ge, Huan Liu, Huanpeng Chu, Jia'ni Zhao, Jiachen Wang, Jiajing Zhao, Jiamin Ren, Jiapeng Wang, Jiaxin Zhang, Jiayi Gui, Jiayue Zhao, Jijie Li, Jing An, Jing Li, Jingwei Yuan, Jinhua Du, Jinxin Liu, Junkai Zhi, Junwen Duan, Kaiyue Zhou, Kangjian Wei, Ke Wang, Keyun Luo, Laiqiang Zhang, Leigang Sha, Liang Xu, Lindong Wu, Lintao Ding, Lu Chen, Minghao Li, Nianyi Lin, Pan Ta, Qiang Zou, Rongjun Song, Ruiqi Yang, Shangqing Tu, Shangtong Yang, Shaoxiang Wu, Shengyan Zhang, Shijie Li, Shuang Li, Shuyi Fan, Wei Qin, Wei Tian, Weining Zhang, Wenbo Yu, Wenjie Liang, Xiang Kuang, Xiangmeng Cheng, Xiangyang Li, Xiaoquan Yan, Xiaowei Hu, Xiaoying Ling, Xing Fan, Xingye Xia, Xinyuan Zhang, Xinze Zhang, Xirui Pan, Xu Zou, Xunkai Zhang, Yadi Liu, Yandong Wu, Yanfu Li, Yidong Wang, Yifan Zhu, Yijun Tan, Yilin Zhou, Yiming Pan, Ying Zhang, Yinpei Su, Yipeng Geng, Yong Yan, Yonglin Tan, Yuean Bi, Yuhan Shen, Yuhao Yang, Yujiang Li, Yunan Liu, Yunqing Wang, Yuntao Li, Yurong Wu, Yutao Zhang, Yuxi Duan, Yuxuan Zhang, Zezhen Liu, Zhengtao Jiang, Zhenhe Yan, Zheyu Zhang, Zhixiang Wei, Zhuo Chen, Zhuoer Feng, Zijun Yao, Ziwei Chai, Ziyuan Wang, Zuzhou Zhang, Bin Xu, Minlie Huang, Hongning Wang, Juanzi Li, Yuxiao Dong, Jie Tang

机构 * GLM-5 Team(GLM-5团队) Zhipu AI(智谱AI) Tsinghua University(清华大学)

专题命中 效率与部署 :foundation model(abstract);post-training(abstract);分类 cs.CL、cs.LG

AI总结 GLM-5通过异步强化学习和DSA技术实现高效训练与推理,展现卓越的软件工程能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21144 2026-02-25 cs.DC cs.LG 70%

Scaling State-Space Models on Multiple GPUs with Tensor Parallelism

通过张量并行性在多个GPU上扩展状态空间模型

Anurag Dutt, Nimit Shah, Hazem Masarani, Anshul Gandhi

机构 * Stony Brook University(石溪大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种通信高效的张量并行设计,用于在多GPU上加速选择性状态空间模型推理,通过状态缓存、参数分区和量化AllReduce减少通信开销,提升吞吐量。

Comments Submitted to 46th IEEE International Conference on Distributed Computing Systems (ICDCS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏