arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-27 至 2026-02-27 共收录 5 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 5 篇

2602.22402 2026-02-27 cs.SE cs.AI cs.HC cs.OS 86%

Contextual Memory Virtualisation: DAG-Based State Management and Structurally Lossless Trimming for LLM Agents

上下文记忆虚拟化:基于DAG的状态管理和结构无损修剪用于LLM代理

Cosmo Santoni

机构 * Imperial College London(伦敦帝国学院)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 上下文记忆虚拟化通过DAG结构管理和无损修剪技术,提升LLM代理在长期推理任务中的上下文重用效率和经济性。

Comments 11 pages. 6 figures. Introduces a DAG-based state management system for LLM agents. Evaluation on 76 coding sessions shows up to 86% token reduction (mean 20%) while remaining economically viable under prompt caching. Includes reference implementation for Claude Code

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12064 2026-02-27 cs.NI 82%

GeoPipe: a Geo-distributed LLM Training Framework with enhanced Pipeline Parallelism in a Lossless RDMA-enabled Datacenter Optical Transport Network

GeoPipe:一种具有增强流水线并行性的地理分布式LLM训练框架,在无损RDMA启用的数据中心光传送网络中

Jun Dai, Xiaorun Wang, Kexiong Fang, Zheng Yang, Yuefeng Ji, Jiawei Zhang

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract)

AI总结 GeoPipe提出了一种基于无损RDMA的数据中心光传送网络的地理分布式LLM训练框架,通过增强的流水线并行技术显著降低计算气泡比率。

Comments 6 pages, 4 figures

Journal ref 2025 Asia Communications and Photonics Conference (ACP), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11094 2026-02-27 cs.NI 75%

SHIFT: Exploring the Boundary of RDMA Network Fault Tolerance

SHIFT:探索RDMA网络容错的边界

Shengkai Lin, Kairui Zhou, Hongtao Zhang, Yibo Wu, Yi Pan, Yihan Yang, Qinwei Yang, Wei Zhang, Arvind Krishnamurthy, Shizhen Zhao

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 SHIFT通过用户空间RDMA层实现跨NIC容错,保持正确内存语义,有效应对NIC故障和链路异常,减少训练重启成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10585 2026-02-27 cs.GR 67%

D3MAS: Decompose, Deduce, and Distribute for Enhanced Knowledge Sharing in Multi-Agent Systems

D3MAS:分解、推断与分配以增强多智能体系统中的知识共享

Heng Zhang, Yuling Shi, Xiaodong Gu, Haochen You, Zijian Zhang, Lubin Gan, Yilei Yuan, Jin Huang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 D3MAS通过分层协调框架减少多智能体系统中的知识冗余,提升推理准确性。

Comments This submission has been withdrawn by the authors due to a fundamental error in the methodology that affects the validity of the main results

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22406 2026-02-27 cs.AI 57%

Towards Autonomous Memory Agents

朝向自主记忆代理

Xinle Wu, Rui Zhang, Mustafa Anis Hussain, Yao Lu

机构 * National University of Singapore(新加坡国立大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI

AI总结 U-Mem通过自主获取、验证和整理知识的方法,在记忆代理领域实现了优于现有基线和强化学习优化的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏