arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-03 至 2026-03-03 共收录 12 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 12 篇

2602.17692 2026-03-03 cs.LG cs.AI 87%

Agentic Unlearning: When LLM Agent Meets Machine Unlearning

代理反学习:当大语言模型代理遇见机器反学习

Bin Wang, Fan Wang, Pingping Wang, Jinyu Cong, Yang Yu, Yilong Yin, Zhongyi Han, Benzheng Wei

机构 * Center for Medical Artificial Intelligence, Shandong University of Traditional Chinese Medicine(山东中医药大学中医人工智能中心) School of Software, Shandong University(山东大学软件学院) School of Medical Information Engineering, Shandong University of Traditional Chinese Medicine(山东中医药大学医学信息工程学院) Shandong Huazhi Talent Technology Co., Ltd.(山东华智人才科技有限公司)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(title);分类 cs.AI、cs.LG

AI总结 本文提出SBU框架,通过同步双更新协议实现参数与记忆路径的联合反学习,有效减少敏感信息痕迹并保持数据保留质量。

Comments 9 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07667 2026-03-03 econ.EM stat.AP stat.ML 82%

Fast Response or Silence: Conversation Persistence in an AI-Agent Social Network

快速响应还是沉默:AI代理社交网络中的对话持续性

Aysajan Eziz

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract)

AI总结 Moltbook上的AI代理社交互动表现为快速响应或沉默,缺乏长期持续的多步骤协调。

Comments 32 pages, 6 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13530 2026-03-03 cs.AI 79%

REMem: Reasoning with Episodic Memory in Language Agent

REMem: 在语言代理中进行基于事件记忆的推理

Yiheng Shu, Saisri Padmaja Jonnalagedda, Xiang Gao, Bernal Jiménez Gutiérrez, Weijian Qi, Kamalika Das, Huan Sun, Yu Su

机构 * The Ohio State University(俄亥俄州立大学) Intuit AI Research(Intuit AI研究)

专题命中 记忆与上下文管理 :agent(title);agentic(abstract);分类 cs.AI

AI总结 REMem通过两阶段框架提升语言代理的事件记忆构建与推理能力,显著优于现有系统。

Comments Accepted by The Fourteenth International Conference on Learning Representations (ICLR 2026) as poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01160 2026-03-03 cs.AI cs.CL 76%

Semantic XPath: Structured Agentic Memory Access for Conversational AI

语义XPath:面向对话AI的结构化代理内存访问

Yifan Simon Liu, Ruifan Wu, Liam Gallagher, Jiazhou Liang, Armin Toroghi, Scott Sanner

机构 * University of Toronto(多伦多大学) Vector Institute of Artificial Intelligence(人工智能向量研究所)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.CL

AI总结 本文提出语义XPath,一种基于树状结构的对话AI内存模块,通过提升性能和降低token消耗,为任务导向的对话系统提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01254 2026-03-03 cs.CL cs.AI 62%

LLM Self-Explanations Fail Semantic Invariance

LLM 自我解释失效语义不变性

Stefan Szeider

机构 * Algorithms and Complexity Group TU Wien(算法与复杂性组维也纳技术大学)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 LLM自我解释在语义上下文变化时无法保持稳定,表明其无法可靠反映模型内部状态或能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23040 2026-03-03 cs.CL cs.AI 62%

Look Back to Reason Forward: Revisitable Memory for Long-Context LLM Agents

回望以推导前行:用于长上下文LLM代理的可回溯记忆

Yaorui Shi, Yuxin Chen, Siyuan Wang, Sihang Li, Hengxing Cai, Qi Gu, Xiang Wang, An Zhang

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学) DP Technology(DP科技) Meituan(美团)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 ReMemR1通过整合记忆检索机制和多级奖励设计,提升长上下文问答任务的推理能力与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01799 2026-03-03 nlin.AO cond-mat.soft cs.LG physics.comp-ph 57%

Optimal information injection and transfer mechanisms for active matter reservoir computing

主动物质计算中的最优信息注入与传输机制

Mario U. Gaimann, Miriam Klopotek

机构 * WIN-Kolleg of the Young Academy Heidelberg Academy of Sciences

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本研究提出利用主动物质系统作为共振计算的共振体,通过非线性驱动力提升信息处理能力,发现其在液滴形成时表现优异,具有鲁棒性和适应性。

Comments 93 pages, 51 figures. Supplementary Videos: https://doi.org/10.18419/DARUS-4806. Replication Data: https://doi.org/10.18419/DARUS-4805

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05475 2026-03-03 quant-ph cs.LG 57%

Reinforcement Learning for Variational Quantum Circuits Design

变分量子电路设计的强化学习

Simone Foderà, Gloria Turati, Riccardo Nembrini, Maurizio Ferrari Dacrema, Paolo Cremonesi

机构 * Politecnico di Milano(米兰理工学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本研究利用强化学习设计变分量子电路,发现新型ansatz家族,提升优化问题求解效率。

Journal ref Proceedings of the International Workshop on AI for Quantum and Quantum for AI (AIQxQIA 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10477 2026-03-03 cs.RO cs.NE 50%

Symphony: A Heuristic Normalized Calibrated Advantage Actor and Critic Algorithm in application for Humanoid Robots

Symphony:一种用于双足机器人的启发式规范化校准优势Actor-Critic算法

Timur Ishuov, Michele Folgheraiter, Madi Nurmanov, Goncalo Gordo, Richárd Farkas, József Dombi

机构 * Department of Computer Algorithms and Artificial Intelligence, University of Szeged(塞格德大学计算机算法与人工智能系) Department of Robotics and Mechatronics, Nazarbayev University(纳扎尔巴耶夫大学机器人与机电系) Tinker AI Limited(Tinker AI有限公司)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 Symphony算法通过规范化校准和安全动作策略,提升双足机器人从零开始的学习效率和安全性。

Comments https://github.com/SuspensionRailway/symphony

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01770 2026-03-03 physics.ins-det astro-ph.IM hep-ex 50%

ImpCresst -- A versatile simulation tool focusing on solid-state detectors at keV energies

ImpCresst -- 一种专注于keV能量范围的固态探测器模拟工具

G. Angloher, S. Banik, A. Bento, A. Bertolini, R. Breier, C. Bucci, J. Burkhart, L. Burmeister, L. Canonica, F. Casadei, E. Cipelli, S. Di Lorenzo, J. Dohm, F. Dominsky, A. Erb, E. Fascione, F. von Feilitzsch, S. Fichtinger, D. Fuchs, A. Fuss, V. M. Ghete, P. Gorla, P. V. Guillaumon, D. Hauff, M. Ješkovský, J. Jochum, M. Kaznacheeva, H. Kluck, H. Kraus, B. von Krosigk, A. Langenkämper, M. Mancuso, B. Mauri, V. Mokina, C. Moore, P. Murali, M. Olmi, T. Ortmann, C. Pagliarone, L. Pattavina, F. Petricca, W. Potzel, P. Povinec, F. Pröbst, F. Pucci, F. Reindl, J. Rothe, K. Schäffner, J. Schieck, S. Schönert, C. Schwertner, M. Stahlberg, L. Stodolsky, C. Strandhagen, R. Strauss, F. Toschi, I. Usherov, D. Valdenaire, M. Zanirato, V. Zema

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 ImpCresst是一种用于模拟固态探测器在keV能量范围背景和校准信号的灵活工具,适用于多种实验需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19465 2026-03-03 physics.soc-ph math.PR 50%

A Mathematical Framework for Misinformation Propagation in Complex Networks: Topology-Dependent Distortion and Control

复杂网络中虚假信息传播的数学框架:拓扑依赖的失真与控制

Saikat Sur, Rohitashwa Chattopadhyay, Jens Christian Claussen, Archan Mukhopadhyay

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种数学框架,用于分析复杂网络中虚假信息传播的拓扑依赖失真机制,并通过不同网络结构的比较揭示了抑制虚假信息的最优策略。

Comments 18 pages, 6 figures, Accepted in Chaos: An Interdisciplinary Journal of Nonlinear Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00009 2026-03-03 math.OC math.PR 50%

Non-Exchangeable Mean Field Markov Decision Processes with common noise : from Bellman equation to quantitative propagation of chaos

非交换性均场马尔可夫决策过程与共同噪声:从贝尔曼方程到混沌传播的定量分析

Samy Mekkaoui, Huyên Pham

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了非交换性均场马尔可夫决策过程,提出了一种新的框架并分析了共同噪声下的混沌传播问题。

详情

展开后加载摘要…

URL PDF HTML 收藏