arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4766 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4766 篇

2607.24756 2026-07-29 cs.HC cs.AI 新提交 77%

What Gets Lost When Memory Becomes Media? Evaluating AI-Generated Oral History Visualization

当记忆成为媒介时会失去什么?评估人工智能生成的口述历史可视化

Kwangsuk Park, Jaehyun Koo, Jiyeon Lee, Anjung Tan, Hyoungchul Park

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究散居海外者口述历史可视化中记忆变媒介时的问题,基于口述历史理论设计指标,比较两种管道,发现场景规划与叙事保留冲突,提出基于失败模式的评估框架、冲突分析及系统选择路由协议。

Comments Accepted at ICML 2026 Workshop on Culture x AI: Evaluating AI as a Cultural Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29030 2026-06-30 cs.AI cs.ET 77%

Memory as an Attack Surface in LLM Agents: A Study on Multiple-Choice Question Answering

LLM代理中的记忆作为攻击面:多项选择题回答研究

Shahnewaz Karim Sakib, Anindya Bijoy Das

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);tool use(abstract);分类 cs.AI

AI总结 研究LLM代理中外部记忆组件在多项选择题回答中的脆弱性,通过插入误导记忆进行攻击,实验表明简单记忆操纵即可显著影响答案准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05107 2026-06-18 cs.AI 版本更新 77%

Structured Cognitive Loop for Behavioral Intelligence in Large Language Model Agents (Extended Revision: From Behavioral Architecture to Epistemic Accountability)

大型语言模型代理中行为智能的结构化认知循环(扩展修订:从行为架构到认知问责)

Myung Ho Kim

机构 * JEI University(JEI大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);planning(abstract);分类 cs.AI

AI总结 提出结构化认知循环(SCL)架构,通过分离认知、记忆、控制和行动模块,实现LLM代理的可问责行为,在360个任务中成功率86.3%,优于基线方法。

Comments This revised version extends the original SCL framework from a behavioral architecture for reliable LLM agents into a broader architecture of epistemic accountability, integrating context-aware Human-in-the-Loop control, Pool-Gated Retrieval, and the Horizon-Warrant-Commitment structure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08782 2026-06-03 cs.CL 77%

MT-OSC: Path for LLMs that Get Lost in Multi-Turn Conversation

MT-OSC:解决大语言模型在多轮对话中迷失的路径

Jyotika Singh, Fang Tu, Miguel Ballesteros, Weiyi Sun, Sandip Ghoshal, Michelle Yuan, Yassine Benajiba, Sujith Ravi, Dan Roth

机构 * Oracle AI

专题命中 记忆与上下文管理 :agent(summary_cn,abstract);分类 cs.CL

AI总结 提出MT-OSC框架,通过后台自动压缩对话历史(Condenser Agent)减少token量,提升多轮对话性能,在13个LLM上验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30842 2026-06-01 cs.LG 77%

CoMem: Context Management with A Decoupled Long-Context Model

CoMem: 基于解耦长上下文模型的上下文管理

Yuwei Zhang, Chengyu Dong, Shuowei Jin, Changlong Yu, Hejie Cui, Hongye Jin, Xinyang Zhang, Hamed Bonab, Colin Lockard, Jianshu Chen, Zhenyu Shi, Jingbo Shang, Xian Li, Bing Yin

机构 * Halıcıoğlu Data Science Institute, University of California, San Diego(哈里卡卢斯数据科学研究所,加州大学圣地亚哥分校) Amazon(亚马逊)

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.LG

AI总结 提出CoMem框架,通过将记忆管理与智能体工作流解耦并采用k步偏移异步流水线,利用奖励驱动训练策略,在SWE-Bench-Verified上实现1.4倍延迟改进且保持大部分性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25971 2026-05-27 cs.CL cs.IR cs.MA 77%

Anticipate and Learn: Unleashing Idle-Time Compute in Proactive Agents

预见与学习:在主动智能体中释放空闲时间计算

Haoyi Hu, Qirong Lyu, Xianghan Kong, Weiwen Liu, Jianghao Lin, Zixuan Guo, Yan Xu, Yasheng Wang, Weinan Zhang, Yong Yu

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent(腾讯)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);tool use(abstract);分类 cs.CL

AI总结 提出ProAct主动智能体架构,利用空闲时间计算预测并满足用户未来需求,通过ProActEval基准测试验证其在任务加速、减少用户努力和降低幻觉率方面的显著优势。

Comments 26 pages, 4 figures; code available at https://github.com/AgentACE-AI/ProAct

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05550 2026-05-26 cs.CL cs.CE 77%

AutoSOTA: An End-to-End Automated Research System for State-of-the-Art AI Model Discovery

AutoSOTA:面向最先进AI模型发现的端到端自动化研究系统

Yu Li, Chenyang Shao, Xinyang Liu, Ruotong Zhao, Peijie Liu, Hongyuan Su, Zhibin Chen, Qinglong Yang, Anjie Xu, Yi Fang, Qingbin Zeng, Tianxing Li, Jingbo Xu, Fengli Xu, Yong Li, Tie-Yan Liu

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,北京理工大学,清华大学) Zhongguancun Academy(中关村学院) Peking University(北京大学) University of Science and Technology of China(中国科学技术大学)

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.CL

AI总结 提出AutoSOTA系统,采用多智能体架构实现从论文复现到模型优化的全自动化,成功发现105个超越原始方法的新SOTA模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22085 2026-04-27 cs.AI 77%

Memanto: Typed Semantic Memory with Information-Theoretic Retrieval for Long-Horizon Agents

Memanto:基于信息论检索的类型语义记忆用于长周期智能体

Seyed Moein Abtahi, Rasa Rahnema, Hetkumar Patel, Neel Patel, Majid Fekri, Tara Khani

机构 * Moorcheh

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 Memanto通过信息论检索引擎实现高效持久记忆,无需复杂知识图谱,提升长周期智能体性能,实现89.8%和87.1%的高准确率。

Comments 13 Pages, 10 Tables, 8 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07670 2026-03-10 cs.AI 77%

Memory for Autonomous LLM Agents:Mechanisms, Evaluation, and Emerging Frontiers

自主LLM代理的记忆:机制、评估与新兴前沿

Pengfei Du

机构 * Hong Kong Research Institute of Technology(香港理工大学)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文探讨了自主LLM代理中记忆的机制、评估及未来发展方向,分析了五种核心机制及评估挑战,强调记忆对代理适应性和应用的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05860 2026-03-09 cs.AI cs.CV 77%

Evolving Medical Imaging Agents via Experience-driven Self-skill Discovery

通过经验驱动的自我技能发现进化医疗影像代理

Lin Fan, Pengyu Dai, Zhipeng Deng, Haolin Wang, Xun Gong, Yefeng Zheng, Yafei Ou

机构 * Southwest Jiaotong University, China(西南交通大学) The University of Tokyo, Japan(东京大学) RIKEN, Japan(日本理化学研究所) Westlake University, China(西湖大学) Hokkaido University, Japan(北海道大学)

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 MACRO通过经验驱动的自我技能发现,实现医疗影像代理的自我进化,提升多步骤协调精度和跨领域泛化能力。

Comments 18 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14142 2025-12-17 cs.CL 77%

Astraea: A State-Aware Scheduling Engine for LLM-Powered Agents

Astraea:一种面向LLM代理的基于状态的调度引擎

Hongqiu Ni, Jiabao Zhang, Guopeng Li, Zilong Wang, Ruiqi Wu, Chi Zhang, Haisheng Tan

机构 * University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学)

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.CL

AI总结 Astraea通过基于状态的分层调度算法优化LLM代理的全局作业完成时间,减少端到端延迟并提升系统效率与公平性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14881 2025-10-17 cs.AI cs.IT math.IT 77%

The Gatekeeper Knows Enough

Fikresilase Wondmeneh Abebayew

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);autonomous agent(abstract);分类 cs.AI

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18597 2025-07-25 cs.LG 77%

Linear Memory SE(2) Invariant Attention

Ethan Pronovost, Neha Boloor, Peter Schleede, Noureldin Hendy, Andres Morales, Nicholas Roy

机构 * Zoox

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.LG

Comments Best paper award, Equivariant Systems Workshop at RSS

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14457 2025-06-03 cs.AI 77%

Large Model Based Agents: State-of-the-Art, Cooperation Paradigms, Security and Privacy, and Future Trends

Yuntao Wang, Yanghe Pan, Zhou Su, Yi Deng, Quan Zhao, Linkang Du, Tom H. Luan, Jiawen Kang, Dusit Niyato

机构 * School of Cyber Science and Engineering, Xi’an Jiaotong University(网络科学与工程学院,西安交通大学) School of Automation, Guangdong University of Technology(自动化学院,广东工业大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI

Comments Accepted by IEEE Communications Surveys & Tutorials in May 2025. 41 pages, 36 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04363 2025-05-16 cs.AI 77%

AriGraph: Learning Knowledge Graph World Models with Episodic Memory for LLM Agents

Petr Anokhin, Nikita Semenov, Artyom Sorokin, Dmitry Evseev, Andrey Kravchenko, Mikhail Burtsev, Evgeny Burnaev

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI

Comments Code for this work is avaliable at https://github.com/AIRI-Institute/AriGraph

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09283 2025-04-15 cs.HC cs.AI 77%

Semantic Commit: Helping Users Update Intent Specifications for AI Memory at Scale

Priyan Vaithilingam, Munyeong Kim, Frida-Cecilia Acosta-Parenteau, Daniel Lee, Amine Mhedhbi, Elena L. Glassman, Ian Arawjo

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);workflow(abstract);分类 cs.AI

Comments 22 pages; 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12077 2025-03-18 cs.CV cs.AI 77%

V-Stylist: Video Stylization via Collaboration and Reflection of MLLM Agents

Zhengrong Yue, Shaobin Zhuang, Kunchang Li, Yanbo Ding, Yali Wang

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.12374 2019-08-20 cs.CV cs.LG cs.RO 77%

Dynamic Environment Prediction in Urban Scenes using Recurrent Representation Learning

Masha Itkina, Katherine Driggs-Campbell, Mykel J. Kochenderfer

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);planning(abstract);分类 cs.LG

Comments 8 pages, updated final draft, accepted into Intelligent Transportation Systems Conference (ITSC) 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22815 2026-06-12 cs.HC 版本更新 76%

Memory as a Service (MaaS): Purpose-Bound Memory Mediation for Cooperative Agents

记忆即服务 (MaaS):面向合作智能体的目的绑定记忆中介

Haichang Li

专题命中 记忆与上下文管理 :agentic(abstract,comments);agent(abstract);workflow(abstract)

AI总结 提出记忆即服务 (MaaS) 框架,通过目的绑定的记忆中介机制,在合作编程智能体间平衡记忆共享效用与隐私泄露风险,实验表明现有检索方法存在严重隐私泄露。

Comments Accepted to the KDD 2026 Workshop on Agentic Software Engineering (AgenticSE @ KDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19652 2026-08-21 cs.AI cs.CL 新提交 76%

Can Agent Memory Systems Track Evolving State?

智能体记忆系统能否追踪演化状态?

Xinyi Fan, Miri Liu, Ruozhen Yang, Siru Ouyang, Jiawei Han

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI、cs.CL

AI总结 该研究针对LLM智能体记忆系统的状态追踪能力不足问题,构建StateMemBench基准,提出StateMem方法,可显著提升当前状态准确率,且作为轻量包装器适配现有系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08859 2026-08-11 cs.LG cs.AI 新提交 76%

Agentic Anomaly Detection with ORCA-Style Dynamic Inductive Bias Adaptation in Multimodal Wearable Time Series Data

基于ORCA风格动态归纳偏差自适应的多模态可穿戴时间序列智能体异常检测

Anushka Roy, Jyotirmoy Singh, Shreea Bose, Chittaranjan Hota

机构 * BITS Pilani(皮尔尼理工学院)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.LG

AI总结 该研究针对资源受限的非平稳生理时间序列异常检测问题,提出ORCA框架,通过监督控制器动态调整时间感受野,在WBAN和MIMIC-IV数据集上实现稳健性能,无需预调时间范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27834 2026-07-31 cs.AI cs.CL 新提交 76%

MemTxn: A Transaction Boundary for Source-Supported Updates and Complete-State Recovery in Agent Memory

MemTxn:智能体记忆中源支持更新与完整状态恢复的事务边界

Hanshuai Cui, Zhiqing Tang, Zhi Yao, Fanshuai Meng, Qianli Ma, Weijia Jia

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI、cs.CL

AI总结 针对大语言模型智能体持久内存错误问题,提出MemTxn治理层,通过Ordered PatchTest等组件实现可靠更新与恢复,在多个基准测试中性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20954 2026-06-23 cs.CL cs.AI 新提交 76%

Learning What Not to Forget: Long-Horizon Agent Memory from a Few Kilobytes of Learning

学习不忘:从几KB学习的长时程智能体记忆

Nusrat Jahan Lia, Aritra Mazumder

机构 * University of Utah(犹他大学)

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI、cs.CL

AI总结 提出LRE(学习相关性驱逐)方法,通过轻量级评分器保留历史中的关键信息,在匹配预算下精度优于无驱逐基线,减少峰值上下文大小52%,并解决循环任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19988 2026-05-20 cs.SE cs.AI cs.DB cs.PF 76%

A Case for Agentic Tuning: From Documentation to Action in PostgreSQL

为代理调优辩护:从文档到PostgreSQL中的行动

Hongyu Lin, Mingyu Li, Weichen Zhang, Yihang Lou, Mingjie Xing, Yanjun Wu, Haibo Chen

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of System Software (Chinese Academy of Sciences)(中国科学院系统软件重点实验室) Beihang University(北航) Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.SE

AI总结 本文提出通过动态行动替代静态文档进行系统调优,引入PerfEvolve工具,利用LLM代理实现版本一致性验证、工作负载特定分析和多参数联合优化,实验表明其在PostgreSQL上比现有文档驱动调优方法提升35.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19077 2026-05-20 cs.CL cs.AI 76%

ReacTOD: Bounded Neuro-Symbolic Agentic NLU for Zero-Shot Dialogue State Tracking

ReacTOD:用于零样本对话状态跟踪的受限神经符号代理NLU

Yanjun Lin, Zimo Xiao, Kartik Natarajan, Mahesh Sankaranarayanan, Niraj Nawanit, Rakshit Parashar, Austin Zhang, Karthik Konaraddi, Rishita Mote, Wei Niu

机构 * Amazon(亚马逊)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.CL

AI总结 该研究提出ReacTOD,一种受限神经符号架构,通过在自我纠正的ReAct循环中将NLU重新表述为离散工具调用来解决零样本对话状态跟踪问题,其核心方法是确定性验证,主要贡献是实现了新的零样本状态-of-the-art结果。

Comments Accepted at TrustNLP Workshop at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19785 2026-04-23 cs.CL cs.AI cs.CR cs.CY 76%

Can LLMs Infer Conversational Agent Users' Personality Traits from Chat History?

大语言模型能否从聊天记录中推断出对话代理用户的人格特质?

Derya Cögendez, Verena Zimmermann, Noé Zufferey

机构 * ETH Zurich, Switzerland(苏黎世联邦理工学院,瑞士)

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI、cs.CL

AI总结 研究探讨了大语言模型能否从用户与对话代理的交互中推断出人格特质,通过分析ChatGPT日志数据,发现模型在多个案例中能以高于随机水平的准确率推断出性格特质,揭示了与对话代理交互带来的隐私风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11048 2026-03-12 cs.CV cs.AI cs.CL cs.MA cs.NE 76%

COMIC: Agentic Sketch Comedy Generation

COMIC:基于代理的即兴喜剧生成

Susung Hong, Brian Curless, Ira Kemelmacher-Shlizerman, Steve Seitz

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.CL

AI总结 COMIC提出了一种基于代理的自动化系统,通过LLM评论家和迭代优化生成高质量喜剧视频。

Comments Project page: https://susunghong.github.io/COMIC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01160 2026-03-03 cs.AI cs.CL 76%

Semantic XPath: Structured Agentic Memory Access for Conversational AI

语义XPath:面向对话AI的结构化代理内存访问

Yifan Simon Liu, Ruifan Wu, Liam Gallagher, Jiazhou Liang, Armin Toroghi, Scott Sanner

机构 * University of Toronto(多伦多大学) Vector Institute of Artificial Intelligence(人工智能向量研究所)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.CL

AI总结 本文提出语义XPath,一种基于树状结构的对话AI内存模块,通过提升性能和降低token消耗,为任务导向的对话系统提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02369 2026-02-03 cs.AI cs.LG 76%

Live-Evo: Online Evolution of Agentic Memory from Continuous Feedback

Live-Evo: 从连续反馈中在线进化智能记忆

Yaolun Zhang, Yiran Wu, Yijiong Yu, Qingyun Wu, Huazheng Wang

机构 * Oregon State University(俄勒冈州立大学) AG2 AI(AG2人工智能) Penn State University(宾夕法尼亚州立大学)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.LG

AI总结 Live-Evo通过在线进化记忆系统,在连续反馈中提升任务性能和市场收益。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06037 2026-01-23 cs.CL cs.AI cs.CV 76%

TeleMem: Building Long-Term and Multimodal Memory for Agentic AI

TeleMem: 构建面向代理AI的长期和多模态记忆

Chunliang Chen, Ming Guan, Xiao Lin, Jiaxu Li, Luxi Lin, Qiyi Wang, Xiangyu Chen, Jixiang Luo, Changzhi Sun, Dell Zhang, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.CL

AI总结 TeleMem通过统一的长期和多模态记忆系统,提升代理AI在长对话和多模态任务中的表现,实现更高的准确率、更低的令牌使用和更快的操作速度。

详情

展开后加载摘要…

URL PDF HTML 收藏