arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4766 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4766 篇

2604.11364 2026-06-16 cs.AI 版本更新 79%

The Missing Knowledge Layer in Cognitive Architectures for AI Agents

AI智能体认知架构中缺失的知识层

Michaël Roynard

机构 * Independent Researcher(独立研究者)

专题命中 记忆与上下文管理 :AI agent(title,abstract);分类 cs.AI

AI总结 针对现有AI智能体认知架构(如CoALA和JEPA)缺乏独立知识层的问题,提出四层分解架构(知识、记忆、智慧、智能),各层具有不同的持久性语义,并通过Python和Rust实现验证了架构分离的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12372 2026-06-11 cs.RO cs.LG 新提交 79%

UniIntervene: Agentic Intervention for Efficient Real-World Reinforcement Learning

UniIntervene:用于高效现实世界强化学习的智能干预

Haoyuan Deng, Yitong Gao, Yudong Lin, Haichao Liu, Zhenyu Wu, Ziwei Wang

机构 * Nanyang Technological University(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.LG

AI总结 提出UniIntervene智能干预模型,通过检测低效探索并自主恢复策略至高价值状态,在真实机器人操作任务中平均成功率提升8.6%,人类干预减少57%。

Comments Project page: https://denghaoyuan123.github.io/UniIntervene-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11559 2026-06-11 cs.AI 新提交 79%

HERO: Hindsight-Enhanced Reflection from Environment Observations for Agentic Self-Distillation

HERO: 基于环境观察的后见增强反思的智能体自蒸馏

Haoran Liu, Yuwei Zhang, Xiyao Li, Bohan Lyu, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校) Independent Researcher(独立研究员) University of California, Berkeley(加州大学伯克利分校)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI

AI总结 提出HERO框架,利用环境观察作为局部对齐反馈进行自蒸馏,解决多轮设置中特权反馈与当前决策上下文不对齐导致的性能下降问题,在TauBench和WebShop上提升任务成功率并减少冗余轮次。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11290 2026-06-11 cs.AI cs.HC 79%

Evolution in Simulation: AI-Agent School with Dual Memory for High-Fidelity Educational Dynamics

模拟中的进化:具有双记忆的AI代理学校用于高保真的教育动态

Sheng Jin, Haoming Wang, Zhiqi Gao, Yongbo Yang, Bao Chunjia, Chengliang Wang

机构 * Guanghua Law School, Zhejiang University(浙江大学法学院) Faculty of Education, East China Normal University(华东师范大学教育学院) School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院) Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电子与计算机工程系) Institute of Systems Science, National University of Singapore(新加坡国立大学系统科学研究所)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文提出AI代理学校系统,通过自演化机制模拟复杂教育动态,采用双记忆结构提升代理认知能力,实验证实其在高保真模拟中的有效性。

Comments 9 pages, 7 figures, EMNLP conference

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10299 2026-06-10 cs.AI cs.CV cs.MA 新提交 79%

What Spatial Memory Must Store: Occlusion as the Test for Language-Agent Memory

空间记忆必须存储什么:遮挡作为语言-智能体记忆的测试

Doeon Kwon, Junho Bang

机构 * Space Zero, Inc.(Space Zero公司)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文通过实验证明,在空间查询场景中,几何信息必须主导记忆召回,而可见性判断需要独立于记忆召回,并提出了基于射线-体素DDA的可见性谓词计算方法。

Comments 23 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23232 2026-06-10 cs.AI 79%

ReCoN-Ipsundrum: An Inspectable Recurrent Persistence Loop Agent with Affect-Coupled Control and Mechanism-Linked Consciousness Indicator Assays

ReCoN-Ipsundrum:一个可检验的循环持续性代理,具有情感耦合控制和机制关联的意识指标测试

Aishik Sanyal

机构 * Aishik Sanyal

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文提出ReCoN-Ipsundrum代理,通过情感耦合控制和机制关联意识指标测试,探讨意识指标与行为之间的关系,发现情感耦合能提高探索和谨慎行为。

Comments Accepted at AAAI 2026 Spring Symposium - Machine Consciousness: Integrating Theory, Technology, and Philosophy

Journal ref Proceedings of the AAAI Symposium Series, 8(1):352-360, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07402 2026-06-08 cs.CL 新提交 79%

M$^3$Exam: Benchmarking Multimodal Memory for Realistic User-Agent Interactions

M$^3$Exam: 面向真实用户-智能体交互的多模态记忆基准

Zhengjun Huang, Wenxuan Liu, Zhoujin Tian, Wei Chen, Junle Chen, Yuqian Wu, Fangyuan Zhang, Qintian Guo, Xiaofang Zhou

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Beijing University of Chemical Technology(北京化工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Beijing Institute of Technology (Zhuhai)(北京理工大学(珠海)) Tencent Hy(腾讯(深圳)) Peng Cheng Laboratory(鹏城实验室)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 提出M$^3$Exam基准,用于评估多模态大语言模型在真实用户-智能体交互中的跨模态推理和隐式信息推断能力,并设计M$^3$Proctor方法通过按需处理视觉源提升准确率13%,同时降低索引构建时间和检索token超70%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06240 2026-06-05 cs.DB cs.AI 79%

TOKI: A Bitemporal Operator Algebra for Contradiction Resolution in LLM-Agent Persistent Memory

TOKI: 用于LLM智能体持久化记忆中矛盾消解的双时态算子代数

Ziming Wang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 提出TOKI代数,将四种矛盾消解启发式统一为双时态算子,通过隔离性、模式与溯源三个正确性定理提供写时并发控制契约,并证明审计行防御在LoCoMo任务上的有效性。

Comments 43 pages including full appendices (proofs, protocols, and reproducibility ledger). Code, data, and reproducibility artifact: https://github.com/ZenAlexa/toki-bitemporal-memory

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06212 2026-06-05 cs.AI 79%

Evaluating Agentic Configuration Repair for Computer Networks

评估计算机网络中的代理配置修复

Rufat Asadli, Benjamin Hoffman, Ioannis Protogeros, Laurent Vanbever

机构 * Department of Information Technology(信息科技系) Electrical Engineering, ETH Zurich(电子工程,苏黎世联邦理工学院)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 本研究通过结合形式化网络验证和上下文检索工具,评估了开源和闭源大语言模型在代理架构下的配置修复能力,发现代理架构在修复效果和安全性上分别平均提升12%和17%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05743 2026-06-05 cs.CR cs.CL 79%

Membrane: A Self-Evolving Contrastive Safety Memory for LLM Agent Defense

Membrane: 一种用于LLM智能体防御的自演化对比安全记忆

Minseok Choi, Seungbin Yang, Dongjin Kim, Subin Kim, Jungmin Son, Yunseung Lee, Jaegul Choo, Youngjun Kwak

机构 * KAIST AI(韩国科学技术院人工智能实验室) Financial Tech Lab, KakaoBank Corp(Kakao银行金融科技实验室)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 提出Membrane,一种基于对比安全记忆(CSM)的自演化护栏,通过将有害交互及其良性对应物蒸馏为对比单元来防御不断演化的越狱攻击,无需重新训练即可实现高F1和低良性拒绝率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04628 2026-06-04 cs.CL cs.MA 79%

RAMPART: Registry-based Agentic Memory with Priority-Aware Runtime Transformation

RAMPART: 基于注册表的代理记忆与优先级感知运行时转换

Nikodem Tomczak

机构 * Nikodem Tomczak

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.CL

AI总结 提出RAMPART编译时记忆模型和纯内存块注册表,通过可编程运行时操作和五种原语实现上下文组装,实验表明块位置和分组显著影响任务成功率,并实现零提示令牌成本的共享注册表协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27762 2026-06-03 cs.AI 79%

PEAM: Parametric Embodied Agent Memory through Contrastive Internalization of Experience in Minecraft

PEAM: 通过经验对比内化的参数化具身智能体记忆在Minecraft中的应用

Yuchen Guo, Junli Gong, Weicheng Wang, Hongmin Cai, Yiu-ming Cheung, Weifeng Su

机构 * Northwestern University(西北大学) Northeastern University(东北大学) South China University of Technology(华南理工大学) Hong Kong Baptist University(香港 Baptist大学) Beijing Normal - Hong Kong Baptist University(北京师范大学-香港 Baptist大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 提出PEAM框架,通过对比内化失败-纠正轨迹对,将经验转化为参数化技能,实现Minecraft中具身智能体的持续学习与高效执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26197 2026-06-02 cs.IR cs.LG 79%

Hierarchical Long-Term Semantic Memory for LinkedIn's Hiring Agent

面向LinkedIn招聘代理的分层长期语义记忆

Zhentao Xu, Shangjin Zhang, Emir Poyraz, Yvonne Li, Ye Jin, Xie Lu, Xiaoyang Gu, Karthik Ramgopal, Praveen Kumar Bodigutla, Xiaofeng Wang

机构 * LinkedIn Corporation(LinkedIn公司)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.LG

AI总结 提出分层长期语义记忆(HLTM)框架,通过构建模式对齐的记忆树,实现可扩展的语义知识摄入、隐私感知存储、低延迟检索和透明溯源,在LinkedIn招聘助手应用中使答案正确率提升超5%、检索F1提升超10%。

Comments Accepted to the Applied Data Science (ADS) track at the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03588 2026-06-02 cs.AI 79%

Rashomon Memory: Towards Argumentation-Driven Retrieval for Multi-Perspective Agent Memory

Rashomon记忆:面向多视角智能体记忆的论证驱动检索

Albert Sadowski, Jarosław A. Chudziak

机构 * Warsaw University of Technology(华沙技术大学)

专题命中 记忆与上下文管理 :agent(title);AI agent(abstract);分类 cs.AI

AI总结 提出Rashomon记忆架构,通过并行目标条件化智能体以各自优先级编码经验,并在查询时通过论证协商,利用Dung的论证语义选择解释,支持冲突呈现模式。

Comments Presented at EXTRAAMAS workshop at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30771 2026-06-01 cs.CL 79%

Eywa: Provenance-Grounded Long-Term Memory for AI Agents

Eywa:基于溯源的人工智能智能体长期记忆

Resham Joshi

机构 * Eywa

专题命中 记忆与上下文管理 :AI agent(title,abstract);分类 cs.CL

AI总结 提出Eywa架构,通过先存储证据再推导事实、验证记忆并采用确定性多路径读取(零LLM调用)实现可审计的长期记忆,在多个基准测试中取得高准确率。

Comments 29 pages, 3 figures, 16 tables. Benchmark artifacts available at https://eywa.to/research

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29421 2026-05-29 cs.CL 79%

Learning Design Skills as Memory Policies for Agentic Photonic Inverse Design

将设计技能学习为记忆策略用于智能光子逆向设计

Shengchao Chen, Ting Shu, Sufen Ren

机构 * AAII, University of Technology Sydney(AAII,悉尼技术大学) School of Artificial Intelligence, Shenzhen University(人工智能学院,深圳大学) School of Information and Communication Engineering, Hainan University(信息与通信工程学院,海南大学)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.CL

AI总结 提出SkillPCF闭环智能体框架,通过物理引导的记忆技能库、强化学习技能选择和模拟器接地技能演化,解决光子晶体光纤逆向设计中的知识积累问题,在真实数据集上实现更优的设计质量与效率权衡。

Comments AI4Physics@ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15374 2026-05-29 cs.AI 79%

SCOPE: Prompt Evolution for Enhancing Agent Effectiveness

SCOPE: 通过提示进化增强智能体效能

Zehua Pei, Hui-Ling Zhen, Shixiong Kai, Sinno Jialin Pan, Yunhe Wang, Mingxuan Yuan, Bei Yu

机构 * The Chinese University of Hong Kong(香港中文大学) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 针对LLM智能体静态提示无法有效管理动态上下文导致失败的问题,提出SCOPE框架,将上下文管理建模为在线优化问题,通过双流记忆机制和视角驱动探索自动进化提示,在HLE基准上将任务成功率从14.23%提升至38.64%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27760 2026-05-28 cs.AI 79%

SkillGrad: Optimizing Agent Skills Like Gradient Descent

SkillGrad: 像梯度下降一样优化智能体技能

Hanyu Wang, Yifan Lan, Bochuan Cao, Lu Lin, Jinghui Chen

机构 * College of Information Sciences and Technology(信息科学与技术学院) The Pennsylvania State University(宾夕法尼亚州立大学) University Park, PA, USA

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 提出SkillGrad框架,将技能包视为结构化参数,通过轨迹级损失、文本梯度诊断和动量记忆覆盖进行类梯度下降优化,在表格问答任务上平均提升6.7个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23771 2026-05-25 cs.CV cs.AI cs.MA 79%

PhotoFlow: Agentic 3D Virtual Photography Missions

PhotoFlow: 智能体式3D虚拟摄影任务

Jiarui Guo, Haojia Wei, Yiming Zhang, Yifei Liu, Yuning Gong, Hongjie Zhang, Xue Yang, Zhihang Zhong

机构 * Shanghai Jiao Tong University(上海交通大学) Northeastern University(东北大学) University of California, Los Angeles(加州大学洛杉矶分校) Cornell University(康奈尔大学) Shanghai AI Laboratory(上海人工智能实验室) Sichuan University(四川大学)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI

AI总结 提出PhotoFlow智能体框架,通过导演-评审-反思闭环搜索机制,在任意Blender场景中根据语言指令自动完成虚拟摄影,并引入VPhotoBench基准,实验表明其在外观质量对齐和成功率上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23723 2026-05-25 cs.AI 79%

MemAudit: Post-hoc Auditing of Poisoned Agent Memory via Causal Attribution and Structural Anomaly Detection

MemAudit:通过因果归因和结构异常检测对中毒代理记忆进行事后审计

Zhewen Tan, Yilun Yao, Huiyan Jin, Wenhan Yu, Guoan Wang, Mengyuan Fan, liang lu, Feng Liu, Xiangzheng Zhang, Duohe Ma, Tong Yang, Lin Sun

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Qiyuan Tech(齐元科技) Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机科学学院多媒体信息处理实验室) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 提出MemAudit框架,结合反事实记忆影响评分和记忆一致性图,对记忆增强型LLM代理中的恶意注入记忆进行事后因果审计,显著降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23559 2026-05-25 cs.CV cs.AI 79%

PathNavigate: A Training-Free Pathology Agent with Surprise-Guided Scan and Shared Slide Memory for Whole-Slide Image VQA

PathNavigate: 一种无需训练的病理学代理,具有惊喜引导扫描和共享幻灯片记忆用于全切片图像VQA

Chunze Yang, Qidong Liu, Wenjie Zhao, Yue Tang, Jiusong Ge, Di Zhang, Jiashuai Liu, Lei Wu, Junbo Lu, Ni Zhang, Xian Wu, Zeyu Gao, Chen Li

机构 * School of Comp. Science & Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Tencent Jarvis Lab(腾讯Jarvis实验室) University of Cambridge(剑桥大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 提出PathNavigate,一种无需训练的病理学代理,通过惊喜引导扫描和共享幻灯片记忆,在严格检查预算下高效定位证据并回答临床查询。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14498 2026-05-19 cs.CL 79%

GroupMemBench: Benchmarking LLM Agent Memory in Multi-Party Conversations

GroupMemBench: 多方对话中LLM代理记忆的基准测试

Jingbo Yang, Kwei-Herng Lai, Xiaowen Wang, Shiyu Chang, Yaar Harari, Evgeniy Gabrilovich

机构 * UC Santa Barbara(加州大学圣芭芭拉分校) Microsoft(微软)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 本文提出GroupMemBench,用于评估多方对话中LLM代理的记忆能力,揭示现有记忆系统在群体动态、信念跟踪和语言适应方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15128 2026-05-15 cs.CV cs.CL cs.IR 79%

MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory

MemEye:一种以视觉为中心的多模态代理记忆评估框架

Minghao Guo, Qingyue Jiao, Zeru Shi, Yihao Quan, Boxuan Zhang, Danrui Li, Liwei Che, Wujiang Xu, Shilong Liu, Zirui Liu, Mubbasir Kapadia, Vladimir Pavlovic, Jiang Liu, Mengdi Wang, Yiyu Shi, Dimitris N. Metaxas, Ruixiang Tang

机构 * Rutgers(罗格斯大学) Notre Dame(圣母大学) Princeton(普林斯顿大学) UMN(明尼苏达大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 MemEye框架从视觉证据的粒度和证据使用的复杂性两个维度评估多模态代理记忆,通过8个生活场景任务构建新基准,验证记忆方法在细粒度视觉细节保留和时间状态推理上的不足。

Comments 46 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24273 2026-05-15 cs.AI 79%

A Minimal Agent for Automated Theorem Proving

一个用于自动定理证明的最小代理

Borja Requena, Austin Letson, Krystian Nowakowski, Izan Beltran-Ferreiro, Leopoldo Sarra

专题命中 记忆与上下文管理 :agent(title);agentic(abstract);分类 cs.AI

AI总结 本文提出一个最小代理基准,用于比较不同AI定理证明器架构。通过迭代证明细化、库搜索和上下文管理核心功能,展示了与前沿方法相媲美的性能,同时架构更简单且成本更低。

Comments Accepted for publication at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14421 2026-05-15 cs.CR cs.AI 79%

MemLineage: Lineage-Guided Enforcement for LLM Agent Memory

MemLineage: 为LLM代理内存提供指导性强制措施

Ciyan Ouyang, Rui Hou

机构 * State Key Laboratory of Cyberspace Security Defense(网络空间安全防御国家重点实验室) Institute of Information Engineering, CAS(信息工程研究所,中国科学院) Beijing, China(北京,中国)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 MemLineage通过结合加密溯源和LLM中介推导链,解决LLM代理内存中不可信内容的持久化问题,通过链式 custody 机制防止敏感操作,实验显示其能有效降低攻击成功率。

Comments 24 pages, 8 figures. Rui Hou is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06132 2026-05-15 cs.CL 79%

MemReranker: Reasoning-Aware Reranking for Agent Memory Retrieval

MemReranker:面向智能体记忆检索的推理增强重排序

Chunyu Li, Mengyuan Zhang, Jingyi Kang, Ding Chen, Jiajun Shen, Bo Tang, Xuanhe Zhou, Feiyu Xiong, Zhiyu Li

机构 * China Telecom Research Institute(中国电信研究院) Shanghai Jiao Tong University(上海交通大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 MemReranker通过多阶段LLM知识蒸馏构建,解决记忆检索中语义相关但缺乏关键信息的问题,提升重排序模型的推理能力与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13335 2026-05-14 cs.AI cs.CV 79%

Ego2World: Compiling Egocentric Cooking Videos into Executable Worlds for Belief-State Planning

Ego2World:将第一人称视角烹饪视频编译为可执行世界以支持信念状态规划

Qinchuan Cheng, Zhantao Gong, Pengzhan Sun, Angela Yao, Xulei Yang, Shijie Li

机构 * Xi’an Jiaotong University(西安交通大学) Nankai University(南开大学) National University of Singapore(新加坡国立大学) A*STAR

专题命中 记忆与上下文管理 :planning(title);agent(abstract);分类 cs.AI

AI总结 本文提出Ego2World基准,通过编译第一人称视角烹饪视频为可执行符号世界,支持信念状态规划。实验表明,信念维护对任务完成至关重要。

Comments Project page: https://sj-li.com/PROJ/Ego2World/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11814 2026-05-13 cs.AI 79%

MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare

MedMemoryBench:个性化医疗中智能体记忆的基准测试

Yihao Wang, Haoran Xu, Renjie Gu, Yixuan Ye, Xinyi Chen, Xinyu Mu, Yuan Gao, Chunxiao Guo, Peng Wei, Jinjie Gu, Huan Li, Ke Chen, Lidan Shou

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Alibaba Group(阿里巴巴集团) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文提出MedMemoryBench,通过合成真实医疗场景数据,评估智能体长期记忆能力,并揭示主流架构在复杂医疗推理中的缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10870 2026-05-12 cs.AI 79%

Remember the Decision, Not the Description: A Rate-Distortion Framework for Agent Memory

记住决策,而非描述:一种面向代理记忆的速率-失真框架

Mingxi Zou, Zhihan Guo, Langzhang Liang, Zhuo Wang, Qifan Wang, Qingsong Wen, Irwin King, Lizhen Qu, Zenglin Xu

机构 * Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学) Meta AI AI Research Institute, Squirrel Ai Learning(Squirrel Ai Learning人工智能研究院) Monash University(墨尔本大学) Shanghai Academy of AI for Science(上海人工智能科学研究院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文提出一种以决策为核心的速率-失真框架,用于代理记忆管理,通过优化内存预算与决策质量的权衡,提出DeMem算法在合成数据和对话任务中提升了决策性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09942 2026-05-12 cs.AI 79%

HAGE: Harnessing Agentic Memory via RL-Driven Weighted Graph Evolution

HAGE: 通过RL驱动的加权图进化利用代理记忆

Dongming Jiang, Yi Li, Guanpeng Li, Qiannan Li, Bingzhe Li

机构 * Department of Computer Science, The University of Texas at Dallas(德克萨斯大学达拉斯分校计算机科学系) Department of Electrical and Computer Engineering, University of Florida(佛罗里达大学电气与计算机工程系) University of California, Davis(加州大学戴维斯分校)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 HAGE提出了一种加权多关系记忆框架,通过RL驱动的训练框架优化路由行为和边表示,提升长周期推理准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏