arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-26 至 2026-08-26 共收录 10 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 10 篇

2608.23670 2026-08-26 cs.AI cs.CL cs.LG 新提交 88%

Automata from Agent Traces: Failure and Next-Step Prediction

基于智能体轨迹的自动机:失败与下一步预测

Seonglae Cho, Franklin Cardenoso Fernandez, Umar Mohammed, Zekun Wu, Kleyton Da Costa, Ilham Wicaksono, Adriano Koshiyama

机构 * Holistic AI(整体人工智能公司) PUC-Rio(里约热内卢天主教大学) University College London(伦敦大学学院)

专题命中 记忆与上下文管理 :agent(title,abstract);workflow(abstract,abstract_cn);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究提出将LLM智能体的轨迹语料库压缩为有限状态机(FSM),该模型在12个公开数据集上表现紧凑、准确且构建快速,可同时提升下一步预测与失败预测性能,为安全监控提供模型无关的结构基元。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23719 2026-08-26 cs.CL 新提交 83%

ADE: Agentic Data Evolution Framework for Human-Centered Objectives

ADE:面向以人为中心目标的智能体数据演化框架

Yang Yu, Yilin Jiang, Zexuan Fei, Yiming Luo, Xingkai Song, Kaiyi Huang, Aimin Zhou, Xin Lin, Fei Tan

机构 * East China Normal University(华东师范大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Shanghai Innovation Institute(上海创新研究院)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.CL

AI总结 针对大语言模型与以人为中心目标对齐的难题,提出以数据为中心的ADE框架,通过OVS流程与稳态准入机制提升数据质量,在多基准及不同场景下均实现性能提升。

Comments accepted by EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24876 2026-08-26 cs.AI cs.CL 新提交 81%

Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses

面向长 horizon 智能体利用的递归经验-工作记忆演化

Zhaochen Yu, Yingcheng Wu, Zhenfei Yin, Kaiyuan Chen, Zhe Zhao, Mengdi Wang, Shuicheng Yan, Ling Yang

机构 * Princeton University(普林斯顿大学) Stanford University(斯坦福大学) University of Oxford(牛津大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 针对长 horizon 智能体的递归自我改进难题,提出 Recuris 架构,通过递归记忆演化提升任务成功率,在多个基准和模型上实现显著性能提升,为 RSI 提供可扩展基础。

Comments Code: this https URL (https://github.com/Gen-Verse/Recuris)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08253 2026-08-26 cs.AI cs.IR 版本更新 79%

SuperLocalMemory 4.0: The Governed Memory Operating System for AI Agents

SuperLocalMemory 4.0:面向AI智能体的受管控内存操作系统

Varun Pratap Bhardwaj, Garima Singh, Arun Pratap Bhardwaj

机构 * Qualixar(奎利克萨)

专题命中 记忆与上下文管理 :AI agent(title,abstract);分类 cs.AI

AI总结 本文提出SuperLocalMemory 4.0,一款面向AI智能体的受管控本地优先内存操作系统,整合多类型检索与管控功能,经测试其可靠性达标,为AI智能体提供持久化内存解决方案。

Comments 54 pages, 15 figures, 8 tables. Substantially revised: retracts two claims from v1 and adds two controlled experiments. Code: this https URL (https://github.com/qualixar/superlocalmemory) Zenodo DOI: https://doi.org/10.5281/zenodo.21853302. Code: this https URL (https://github.com/qualixar/superlocalmemory/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25002 2026-08-26 cs.CR 版本更新 78%

MemMark: State-Evolution Attribution Watermarking for Agent Long-Term Memory Systems

MemMark: 面向智能体长期记忆系统的状态演化归属水印

Haobo Zhang, Xutao Mao, Guangyuan Dong, Ziwei Li, Xuanbo Su, Kaijie Chen, Jing Yang, Zheng Lin

专题命中 记忆与上下文管理 :agent(title,abstract)

AI总结 提出MemMark水印方法,通过嵌入所有者控制的信号到潜在记忆写入决策中,实现无需日志、可见输出或可信元数据的快照归属,并在多个基准上保持记忆效用。

Comments Accepted to findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24569 2026-08-26 cs.AI cs.MA 新提交 74%

When "Must" Becomes "Maybe": Constraint Weakening in LLM Agent Workflows

当“必须”变为“可能”:LLM智能体工作流中的约束弱化

Yiheng Sun, Huifei Wang, Yancheng Zhu, Zhenyu Li, Zebin Zhao, Yifan Yuan

机构 * Shenzhen University(深圳大学)

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI

AI总结 该研究针对LLM智能体工作流中交接转换弱化状态约束的问题,通过1296个受控合成场景实验,发现常规交接压缩会导致高失活和禁止动作率,恢复全部状态字段可解决该问题。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24040 2026-08-26 cs.LG 新提交 72%

PinSieve: Production Selective VLM Serving and a Governed Memory Flywheel for Enterprise Content-Quality Triage

PinSieve:面向企业内容质量分类的生产级选择性VLM服务及受控内存飞轮

Chuqing Gao, Yuanfang Song, Jonathan Zhang, Yifan Wu, Vishwakarma Singh, Qinglong Zeng, Andrey Gusev

专题命中 记忆与上下文管理 :AI agent(abstract,comments);agent(abstract);分类 cs.LG

AI总结 本文提出PinSieve,即面向企业内容质量分类的选择性VLM服务智能体,结合受控内存飞轮维护机制,提升审核效率、降低成本并改善信号交付,具有任务可迁移性。

Comments Accepted at the KDD 2026 workshop "Enterprise AI Agents: From Prototypes to Production."

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23915 2026-08-26 q-fin.TR 新提交 50%

Equilibrium in closed constant-function market maker economies

封闭式常函数做市商经济中的均衡

Muqiao Huang, Ruodu Wang, Yiyun Wang

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究针对含两资产两交易者的无费用封闭式CFMM经济,推导了单边均衡的帕累托最优性、代表性代理人存在条件,证明交易可收敛至帕累托最优均衡,并给出首轮交易先动优势的相关条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23669 2026-08-26 quant-ph 新提交 50%

Single-shot online sequence classification with unbounded quantum memory advantage

具有无界量子记忆优势的单次在线序列分类

Keith K. Ng, Haochen Jay Li, Mile Gu, Jayne Thompson

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文针对在线多分类序列分类问题,证明精确经典智能体需无界记忆,而量子智能体仅需有界记忆即可解决所有任务,且量子方案是记忆最小化的,确立了二者的无界记忆成本分离

Comments 6 page main body, 22 page appendix and 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23050 2026-08-26 cs.HC 版本更新 50%

What Makes an Initial Reaction Ready for Discussion?: Multi-Persona AI Support for Stance Reflection and Writing

是什么让初始反应适合讨论?:用于立场反思与写作的多角色AI支持

Sky Shih-Kai Hong, Mu-Tien Kuo, Wei-Ji Chen, Dennis Wang

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本研究提出多角色AI工具StanceLab,通过对比三角色模式与独立LLM模式的试点,明确了设计需求并规划了未来工作流,助力用户准备讨论立场。

Comments 5 pages, 3 figures, 2 tables. Accepted to TAICHI 2026 ( this https URL (https://taichi2026.taiwanchi.org/program) )

详情

展开后加载摘要…

URL PDF HTML 收藏