arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12698 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 665 篇

2606.24896 2026-06-25 cs.DL cs.CY 新提交 67%

Why Memory Components Fail: Eight Years of License and Sustainability Events in Open-Source Data Infrastructure

为什么内存组件会失败:开源数据基础设施中八年的许可和可持续性事件

Dmitrii Dmitrenko

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 本文通过分析105个开源数据基础设施项目,发现24%的项目遭遇许可或可持续性事件,其中单一供应商风投支持项目的发生率是基金会治理项目的19倍,并提出六字段决策工具。

Comments 14 pages, 6 tables. Supplementary dataset (105 projects, 39 events) on Zenodo: https://doi.org/10.5281/zenodo.20562988

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23565 2026-06-23 cs.RO cs.CV 新提交 67%

HoloAgent-0: A Unified Embodied Agent Framework with 3D Spatial Memory

HoloAgent-0:具有3D空间记忆的统一具身智能体框架

Xiaolin Zhou, Liu Liu, Tingyang Xiao, Wei Feng, Fa Fu, Xinrui Meng, Xinjie Wang, Jialiang Han, Boyang Yu, Yun Du, Wei Sui, Zhizhong Su

机构 * Horizon Robotics D-Robotics Robotics

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 提出HoloAgent-0统一框架,通过三层耦合结构(具身AgentOS、3D空间记忆、具身技能)实现真实机器人闭环执行,在长程导航、跨机器人协调等任务上验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22237 2026-06-23 cs.CR 新提交 67%

Investigating The Security of Modern AI and Cloud Infrastructure

调查现代AI和云基础设施的安全性

Andrew Adiletta

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 本文通过物理内存共置到远程服务接口的交互层次分类法,系统解构AI和现代云基础设施的安全假设,并展示利用各抽象层假设的实际攻击。

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21661 2026-06-23 cs.CV 新提交 67%

UnityShots: Memory-Driven Multi-Shot Audio-Video Generation with Boundary-Aware Gating

UnityShots: 基于记忆的多镜头音视频生成与边界感知门控

Jiehui Huang, Yuechen Zhang, Bin Xia, Jiahao Wang, Xu He, Zhenchao Tang, Meng Chu, Xin Tao, Pengfei Wan, Jiaya Jia

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Kling Team, Kuaishou Technology(Kling团队,快手科技) Tsinghua University(清华大学) Sun Yat-sen University(中山大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 提出UnityShots,一种基于记忆的多镜头音视频生成系统,通过固定大小的长期和短期记忆槽及边界条件门控实现跨镜头连贯性,在多种条件模式下超越开源基线。

Comments https://jackailab.github.io/Projects/UnityShots

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18294 2026-06-18 physics.ins-det nucl-ex physics.app-ph 新提交 67%

Vision AI Agent for Continuous Material Monitoring of LEGEND-1000 LoFi Reentrant Tube

用于LEGEND-1000 LoFi回旋管连续材料监测的视觉AI智能体

Sonata Simonaitis-Boyd, Soonhong Lee, Lauren N. O'Brien, Brandon T. Turner, Ralph Massarczyk, Steven R. Elliott, Aobo Li, Alexander F. Leder

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 提出基于LangChain和Claude Haiku 4.5的视觉AI智能体流水线,通过SAM2分割和混合OCR验证从静水压测试视频中自动提取OFHC铜圆柱的直径和应变,计算屈服强度并与模拟对比。

Comments 27 pages, 8 figures, 5 tables, submitted to PRX Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17518 2026-06-17 cs.DC 新提交 67%

SpecGen: Accelerating Agentic Kernel Optimization with Speculative Generation

SpecGen: 利用推测生成加速智能体内核优化

Jihu Guo, Sitian Lu, Tenghui Ma, Wei Gao, Zhisheng Ye, Xingcheng Zhang, Dahua Lin

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 针对智能体内核优化中生成延迟长、反馈不足和资源利用率低的问题,提出SpecGen系统,通过推测生成在推理过程中提前产生候选内核,并行验证剖析,动态调整资源,并利用远程KV缓存减少前缀重计算,显著降低端到端时间并提升内核加速比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15045 2026-06-16 cs.DC 新提交 67%

NEURON-Fabric: CXL-Side Low-Bit Gradient Aggregation for Distributed Training

NEURON-Fabric: 面向分布式训练的CXL侧低比特梯度聚合

Ziqiang Wang, Changcheng Huang, Chung-Horng Lung

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 提出NEURON-Fabric架构,在CXL内存控制器中实现低比特梯度聚合,通过G-Binary和G-Ternary方法减少通信量,同时保留FP32路径,在CIFAR-10/ResNet-18等任务上接近FP32精度,梯度流量降至3.6-5.4%。

Comments Preprint. 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14047 2026-06-15 cs.IR cs.AI cs.CL cs.LG 新提交 67%

Knowledge Graph Enhanced Memory-Augmented Retrieval for Long Context Modeling

知识图谱增强的记忆增强检索用于长上下文建模

Ghadir Alselwi, Basem Suleiman, Hao Xue, Shoaib Jameel, Hakim Hacid, Flora D. Salim, Imran Razzak

机构 * University of New South Wales(新南威尔士大学) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Southampton(南安普顿大学) Technology Innovation Institute(技术创新研究所) Mohamed Bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出KGERMAR框架,通过动态构建上下文知识图谱并融合多组件记忆架构,在长上下文建模中降低困惑度达8.5%,提升记忆效率2-2.5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13708 2026-06-15 cs.AR cs.NI 新提交 67%

Tiara: A Programmable Line-Rate ISA for Remote Memory Access

Tiara: 一种用于远程内存访问的可编程线速指令集架构

Bojie Li

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 针对远程内存访问中因间接寻址导致的多次往返延迟问题,提出Tiara指令集架构,在内存端网卡上执行预注册程序,将多跳依赖链压缩为单次往返,显著降低延迟并提升吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09110 2026-06-09 cs.CV 新提交 67%

HDRAgent: An Agentic Framework for Multi-Exposure HDR Imaging

HDRAgent: 一种用于多曝光HDR成像的智能体框架

Weiyu Zhou, Tao Hu, Yijian Wang, Xiaogang Xu, Ruixing Wang, Qingsen Yan

机构 * School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院) Shenzhen Research Institute, Northwestern Polytechnical University(西北工业大学深圳研究院) Zhejiang University(浙江大学) Camera Group, DJI(大疆相机部门)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 提出首个智能体驱动的HDR成像框架HDRAgent,通过细粒度上下文知识匹配、感知-失真反馈机制和智能体引导的生成对齐策略,自适应选择重建策略,减少复杂动态场景中的鬼影和局部伪影。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23296 2026-08-25 cs.LG cs.AI 新提交 66%

Sigmoid Attention as a Better Substrate for Learned KV Cache Eviction

Sigmoid注意力作为学习型KV缓存驱逐的更优基础

Isaac, Li

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG;foundation model(comments)

AI总结 本文探究注意力基础对学习型KV缓存驱逐软-硬转换的影响,通过2×2×2对比实验发现,Sigmoid注意力经学习型硬驱逐后,其门控模型删除KV条目时PPL变化可忽略,且比H₂O、KeyDiff等方法表现更优。

Comments Accepted at the ICML 2026 Workshop on Resource-Adaptive Foundation Model Inference (AdaptFM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20427 2026-08-24 cs.LG cs.AI 新提交 62%

BF1: A Causal Dyadic Sparse-Attention Retrofit for Efficient Long-Context Transformers

BF1:一种用于高效长上下文Transformer的因果二元稀疏注意力改造方案

Hina Dixit

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出BF1,一种结合局部邻域、全局首块与对数间隔历史块的稀疏注意力方案,改造Qwen3-0.6B部分注意力层后,在长上下文场景下显著降低模型延迟,且语言建模性能优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19013 2026-08-20 cs.LG cs.AI 新提交 62%

Harness Continual Learning: Continual Adaptation Beyond Model Parameters

利用工具链持续学习:超越模型参数的持续适应

Borui Kang, Jinrui Gu, Junhan Lv, Wenbin Li, Lei Wang, Yang Gao

机构 * University of Wollongong(卧龙岗大学) Nanjing University(南京大学)

专题命中 长上下文与记忆 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出工具链持续学习(HCL)范式,围绕冻结基础模型演化工具链,通过受保护演化机制缓解工具链级遗忘,在多任务实验中相对基准增益超10%,可调整稳定性-可塑性权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12597 2026-08-14 cs.LG cs.AI 新提交 62%

Predicting When Random Low-Dimensional Reparameterizations Train Neural Networks

预测随机低维重参数化何时能训练神经网络

Andrew Cheng, Ali Eslamian, Jie Cheng, Mehdi Zargham, Qiang Cheng

机构 * Tsinghua University(清华大学) The University of Manchester(曼彻斯特大学) University of Kentucky(肯塔基大学) Miami University(迈阿密大学) University of Dayton(代顿大学) Institute for Biomedical Informatics, University of Kentucky(肯塔基大学生物医学信息学研究所)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对随机低维重参数化训练神经网络的潜在空间规模问题,提出取向分辨二次主公式,引入RaMaN模型,实现内存优化,实验验证其预测与转换跟踪性能优于取向无关近似。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11701 2026-08-13 cs.LG cs.AI 新提交 62%

Consolidator: Learning Persistent Routed Memory Across Context Boundaries

Consolidator:学习跨上下文边界的持久路由记忆

Sungwoo Goo, Hwi-yeol Yun, Sangkeun Jung

机构 * College of Pharmacy, Chungnam National University(忠南国立大学药学院) Department of Computer Science & Engineering, Chungnam National University(忠南国立大学计算机科学与工程学院)

专题命中 长上下文与记忆 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出Consolidator算子,在冻结骨干与记忆接口的情况下,通过少量可训练参数实现跨上下文边界的持久路由记忆,在两段式模10映射任务中显著提升了更新后映射的召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00009 2026-08-04 cs.CL cs.AI 新提交 62%

AgentMemBench: A Systematic Benchmark for Evaluating Long-Term Memory Management Strategies in Conversational AI Agents

AgentMemBench:用于评估对话AI智能体长期记忆管理策略的系统基准

Ahmed Cherif

机构 * Sofrecom(索弗雷科姆)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 该研究构建了AgentMemBench基准,评估五种记忆策略及两款现有系统,发现外部键值存储(EKV)在长程对话记忆任务中表现最优,但存在内存占用成本,同时公开了全部可复现资源。

Comments 22 pages, 3 figures submitted on Neural Computing and Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29459 2026-08-03 cs.LG cs.AI 新提交 62%

TFGformer: Multivariate Time Series Forecasting via Time-Frequency Graph Learning and Covariate Fusion

TFGformer:基于时频图学习与协变量融合的多变量时间序列预测

Yu Sun, Yuan Chang, Xiaohou Shi, Yan Sun

专题命中 长上下文与记忆 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 针对异构IoT传感器多变量时间序列预测问题,提出CrossRAG框架,结合SAM、FCC学习与CATF,在7个基准上性能优于仅参数化基线及现有检索增强预测方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26523 2026-07-30 cs.LG cs.AI 新提交 62%

The Art of Not Forgetting A Local Learning Architecture for Continual Learning

不遗忘的艺术:面向持续学习的局部学习架构

Ashmith Atmuri, Yashaswini Rao Bhogarajula

机构 * Arkadhi Research(阿卡迪研究机构)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出持续学习架构CMP,采用稀疏关系编码、两层竞争记忆与局部更新,在语言建模实验中较参数匹配的Transformer基线表现出更低的灾难性遗忘,为持续学习提供了新方向。

Comments 28 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25066 2026-07-29 cs.AI cs.CL 新提交 62%

Addressable Recall Compaction for Long Context-Window Control in AI Agents

用于人工智能代理中长上下文窗口控制的可寻址召回压缩

Thang Dang, Yuma Ichikawa, Sakina Fatima, Koichi Shirahata

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究针对长时程语言模型代理上下文窗口超界问题,提出ARC框架,将存档与活动上下文分离,以ID可寻址日志存储工具观察结果,压缩时替换旧观察结果。实验表明该方法能提高信息保留和服务效率。

Comments 20 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17564 2026-07-21 cs.AI cs.LG 新提交 62%

ZifaMem: Structured Memory for Persona, Preference, and Emotional Continuity in AI Companions

ZifaMem:人工智能伴侣中用于人物形象、偏好和情感连续性的结构化记忆

Jingzhe Fang, Guozhi Xu, Yunfan Cui, Xiaochen Yang, Zhangyu Hua

机构 * ZifaCorp(紫发公司) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 研究针对人工智能伴侣情感连续性问题,提出结构化记忆系统ZifaMem,通过组织对话形成多种记忆模型。实验表明其能提升情商得分、改善人物形象基础等,多种记忆系统均有改善,且ZifaMem与Mem0在主要偏好端点统计等效,相关工具已开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15524 2026-07-20 cs.LG cs.AI 新提交 62%

Recursive Harness Self-Improvement

递归工具自我改进

Hyunin Lee, Jinglue Xu, Jeffrey Seely, Donghyun Lee, Matei Zaharia, Yujin Tang

专题命中 长上下文与记忆 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究在模型-工具协同进化中,通过递归工具自我改进(RHI)优化用户构建工具,以提高执行轨迹质量和智能体性能。RHI将工具表示为提示级规范,经成对反馈迭代改进,在多任务中提升了低推理能力智能体性能,降低推理成本。

Comments This work addresses the first half of the model-harness coevolution loop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14530 2026-07-17 cs.LG cs.CL 新提交 62%

xHC: Expanded Hyper-Connections

xHC:扩展超连接

Xiangdong Zhang, Xiaohan Qin, Sunan Zou, Tuo Dai, Xiaoming Shi, Huaijin Wu, Yebin Yang, Zhuo Xia, Shaofeng Zhang, Lin Yao, Yuliang Liu, Yu Cheng, Junchi Yan

机构 * School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院) Dots Studio, Xiaohongshu Inc.(小红书公司点点工作室) University of Science and Technology of China(中国科学技术大学) School of CS, Peking University(北京大学计算机科学学院) The Chinese University of Hong Kong(香港中文大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.LG

AI总结 研究针对超连接(HC)扩展残差流时的性能瓶颈,提出xHC方法,结合时间特征增强与稀疏残差流架构,实现超越N = 4的有效扩展,在MoE模型上有下游改进,还介绍xHC - Flash减少内存流量,让大N残差流扩展用于语言模型预训练更有效实用。

Comments Technical report. Project page: https://github.com/aHapBean/xHC

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14159 2026-07-17 cs.AI cs.CL 新提交 62%

MemoHarness: Agent Harnesses That Learn from Experience

MemoHarness:从经验中学习的智能体控制层

Yue Huang, Wenjie Wang, Han Bao, Yuchen Ma, Xiaonan Luo, Yi Nian, Haomin Zhuang, Zheyuan Liu, Yue Zhao, Xiangliang Zhang

机构 * University of Notre Dame(圣母大学) LMU Munich(慕尼黑大学) University of Southern California(南加州大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究针对智能体控制层设计影响行为但改进方法窄且多重用单一全局控制层的问题,提出自适应框架MemoHarness,通过分解控制层、存储经验并检索应用,在多基准测试中优于固定控制层,证明执行经验可构建更具适应性的控制层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12893 2026-07-15 cs.AI cs.CL 新提交 62%

MemOps: Benchmarking Lifecycle Memory Operations in Long-Horizon Conversations

MemOps:在长期对话中对生命周期内存操作进行基准测试

Xixuan Hao, Zeyu Zhang, Zehao Lin, Yihang Sun, Ziliang Guo, Xichong Zhang, Yuxuan Liang, Feiyu Xiong, Zhiyu Li

机构 * MemTensor (Shanghai) Technology Co., Ltd.(墨天轮(上海)科技有限公司) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Renmin University of China(中国人民大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究针对长期对话中内存操作评估,引入MemOps基准测试,将对话内存视为操作生命周期,通过可控管道嵌入操作并评估,揭示了当前系统内存操作的问题,推动评估从答案评分转向操作级诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09822 2026-07-14 cs.CV cs.AI cs.CL cs.HC cs.IR 新提交 62%

Memory-Conditioned Tool Calling for Camera-First Visual Agents

用于相机优先视觉智能体的内存条件工具调用

Xiaofan Wu, Xi Zeng, Miaoxia Chen, Peishan Chen, Shuyan Li, Jiyun Yao, Hanyong Zhong, Jiahao Zhu

机构 * Chance AI(机遇人工智能公司)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究在相机优先视觉智能体中个人视觉记忆对工具选择等的影响,采用三层视觉记忆调节大语言模型工具调用循环,通过对800张图像与合成内存块实验发现,移除三层内存块会降低工具查询相关性和端到端效用。

Comments 13 pages, 3 figures, 4 tables. Equal contribution: Xiaofan Wu, Xi Zeng. Corresponding author: xiaofan@chance.vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31495 2026-07-01 cs.AI cs.LG 新提交 62%

Surprise as a Signal for Plasticity and Metacognition

惊喜作为可塑性和元认知的信号

Louis Mouchon

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出预测误差信号可作为可塑性门控和元认知基础,在冻结编码器上实现持续学习与视觉语言模型自适应,实验证明其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30788 2026-07-01 cs.LG cs.CL cs.CR 新提交 62%

Revocable Learned State via Process Sidecars

通过过程侧边栏实现可撤销的学习记忆

John Sweeney

机构 * Sideplane AI

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.LG

AI总结 提出过程侧边栏方法,通过两系数编辑族修正安全训练后的记忆方向,实现记忆撤销,理论证明其二阶精度优于任务算术编辑。

Comments 23 pages, 2 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26749 2026-06-26 cs.LG cs.CL 新提交 62%

Structure Before Collapse: Transient semantic geometry in next-token prediction

坍塌前的结构:下一词预测中的瞬态语义几何

Yize Zhao, Isabel Papadimitriou, Christos Thrampoulidis

机构 * The University of British Columbia(不列颠哥伦比亚大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.LG

AI总结 研究下一词预测语言模型在独热标签训练下如何学习语义结构,发现早期训练出现语义聚类但最终会过渡到对称态,通过Gram矩阵分析提出改进模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25361 2026-06-25 cs.CL cs.AI cs.IR 新提交 62%

Memory Makes the Difference: Evaluating How Different Memory Roles Shape Conversational Agents

记忆决定差异:评估不同记忆角色如何塑造对话代理

Yuxin Wang, Paul Thomas, Zhiwei Yu, Yuan Gao, Saeed Hassanpour, Soroush Vosoughi, Robert Sim, Nick Craswell

机构 * Dartmouth College(达特茅斯学院) Microsoft(微软公司)

专题命中 长上下文与记忆 :LLM(abstract_cn);分类 cs.CL、cs.AI

AI总结 本研究提出对话记忆细粒度分类法,通过用户中心评估框架,揭示不同类型记忆(如澄清记忆、无关记忆)对RAG对话系统响应准确性、个性化及主题相关性的差异化影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24040 2026-06-24 cs.CL cs.AI cs.SC 新提交 62%

Towards Version-aware Operations and Transaction Memories for Multi-layer MeMo

面向多层MeMo的版本感知操作与事务记忆

Peiran Li

机构 * Freie Universität Berlin(柏林自由大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI

AI总结 提出版本感知操作层,将替换、回滚等高级操作编译为MeMo原生原语调用,通过版本CMM和事务CMM支持知识更新,减少重训练需求。

Comments Accepted by MeMo Workshop on Mechanistic Interpretability & Neuro-symbolic Approaches by-design, Rome (Italy), 24/6/2026

详情

展开后加载摘要…

URL PDF HTML 收藏