arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-31 至 2026-08-31 共收录 13 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 13 篇

2608.27924 2026-08-31 cs.CL 新提交 89%

What Makes Agent Memory Useful for Reliable Unanswerable Question Handling?

是什么让智能体记忆对可靠的无答案问题处理有用?

Chuanyuan Tan, Junjie Yu, Yuxin Wang, Yining Zheng, Xipeng Qiu, Wenliang Chen

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Suzhou City University(苏州城市学院) Shanghai Key Lab of Intelligent Information Processing(上海智能信息处理重点实验室) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学技术与人工智能学院) Shanghai Innovation Institute(上海创新研究院)

专题命中 记忆与上下文管理 :agentic(summary_cn,abstract);agent(title,abstract);分类 cs.CL

AI总结 该研究在agentic RAG框架下,评估不同记忆方法对UAQ处理的作用,发现记忆提升UAQ性能具选择性,程序与规则类记忆结合互补信号效果最优,可靠UAQ记忆依赖保留可迁移行为指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26403 2026-08-31 cs.CL 版本更新 86%

ProfileFoundry: A Synthetic Person-Object Substrate for Privacy, Memory, and Tool-Use Evaluation in LLM Agent

ProfileFoundry: 用于LLM智能体隐私、记忆和工具使用评估的合成人物-对象基底

Sriram Selvam, Anneswa Ghosh

机构 * NVIDIA Corporation(英伟达公司)

专题命中 记忆与上下文管理 :agent(title,abstract);tool-use(title);分类 cs.CL

AI总结 提出ProfileFoundry,一个确定性生成器,发布10万个合成成人人物对象,包含快照、家庭、雇主等字段及事件、关系边,用于下游基础模型评估中的记忆、隐私等任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26263 2026-08-31 cs.AI cs.MA 版本更新 83%

SKILL.state: Scalable Long-Horizon Agent Skills

SKILL.state:可扩展的长程智能体技能

Sanket Badhe, Priyanka Tiwari, Jonghyun Chung

机构 * Google LLC(谷歌公司) Purdue University(普渡大学)

专题命中 记忆与上下文管理 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 针对现有智能体运行时的长程延迟与上下文污染问题,提出SKILL.state架构,用显式可变执行状态替代追加式对话历史,提升任务准确率并降低令牌消耗。

Comments accepted at EMNLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27141 2026-08-31 cs.CR cs.AI 版本更新 81%

Safety Does Not Compose: Non-Decaying Loop State for Autonomous LLM Agents

安全性无法组合:自主大型语言模型智能体的非衰减循环状态

Chenhao Wu, Haoxuan Jia, Yang Liu, Yingguang Yang, Yuhan Lin, Chongyang Zhang, Hao Zheng, Yulin Huang, Jianshen Zhang, Yongzhi Qi, Shang Luo, Kefu Xu, Jifeng Zhu, Bin Chong

机构 * University of Chinese Academy of Sciences(中国科学院大学) Nanyang Technological University(南洋理工大学) Supply Chain Tech Team Y, JD.com(京东Y供应链技术团队) Peking University(北京大学) Fudan University(复旦大学) Fullive-AI(Fullive人工智能)

专题命中 记忆与上下文管理 :agent(summary_cn,abstract);分类 cs.AI

AI总结 该研究发现自主LLM智能体的轨迹级安全保障存在组合性缺陷,提出非衰减循环安全状态的LoopHarness方案,可限制未授权不可逆操作数量,通过Agent-SafetyBench等评估验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25553 2026-08-31 cs.IR cs.AI cs.CL 版本更新 81%

When Stale Constraints Go Unchecked: Budgeted Verification Failures in Inherited Agent Memory

当过时约束未被核查:智能体继承记忆中的带预算验证失败

Kazuki Nakayashiki

机构 * Glasp

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 该研究针对智能体继承记忆中过时约束未被核查的问题,建模替代机制,发现重新分配预算槽位给关键路径可显著提升当前记录一致的决策,为记忆系统设计提供了参考。

Comments 41 pages, 3 figures, 18 tables. v3: adds four prospectively frozen, externally deposited experiments (interleaved replication with a repaired control; content-free freshness cue; ten-model cross-organisation panel; budget sweep and target-blind allocation rules); abstract, figures and limitations rewritten; the four original runs unchanged. Data and code at Zenodo: doi: https://doi.org/10.5281/zenodo.22147784

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28363 2026-08-31 cs.AI 新提交 79%

EvoUndo: Recoverability-Constrained Self-Evolution for LLM Agent Harnesses

EvoUndo:面向大语言模型智能体执行框架的可恢复性约束自进化

Tanmay Sah, Dolly Sah, Harshul Jain, Tanya Sah

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本研究针对LLM智能体自进化的可恢复性问题,提出EvoUndo框架,通过协同设计验证、状态落地等,在600个任务中实现高比例的失败变更恢复,且效应存在模型依赖性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28158 2026-08-31 cs.LG cs.DC 新提交 79%

HARTS: Efficient Agentic Reinforcement Learning for Hybrid-Attention Models over Arbitrary Rollout Trees

HARTS:基于任意展开树的混合注意力模型的高效智能体强化学习

Boyuan Meng (1), Peihua Bao (1), Hong Liu (1), Xiaowei Zhu (1), Chao Wang (1), Gen Li (1), Zhenxuan Pan (1) ((1) Ant Group, China)

机构 * Ant Group(蚂蚁集团)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.LG

AI总结 HARTS是首个针对任意展开树前缀共享的混合注意力模型智能体RL系统,通过分块线性注意力算法等技术实现了4.81-4.87倍的训练加速,数值与奖励表现与基线相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28476 2026-08-31 cs.CL 新提交 70%

ContextPilot: Teaching Agents for Proactive Context Management via Fine-grained RL

ContextPilot:通过细粒度强化学习为智能体教授主动上下文管理

Zhuoshi Pan, Qizhi Pei, Junru Lu, Honglin Lin, H. Vicky Zhao, Di Yin, Xing Sun

机构 * Tsinghua University(清华大学) Tencent(腾讯) Shanghai AI Lab(上海人工智能实验室)

专题命中 记忆与上下文管理 :planning(abstract);agentic(abstract);分类 cs.CL

AI总结 本研究针对现有主动上下文管理方法的局限,提出ContextPilot框架,通过扩充工具集并设计细粒度RL方法,在长程智能体任务中实现更紧凑上下文下的更优性能,优于现有基线。

Comments 10 pages, 6 figures, 5 tables, accepted to EMNLP 2026 (Main Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28165 2026-08-31 cs.AI cs.HC cs.OS 新提交 70%

CrabOS: An Operating System for Human-AI Co-inhabitation

CrabOS:面向人类与AI共存的操作系统

Qi Yang, Yun Ma

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 该研究提出人类-AI共存概念,设计实现CrabOS操作系统,以共享文本对象为工作状态,实现人类与AI无缝交替主导任务,为AI智能体开发运行提供新基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22149 2026-08-31 cs.RO cs.AI 版本更新 70%

Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints

Meta-Ctrl:通过分离句法与语义约束实现带保证的规划生成

Gwen Yidou-Weng, Edward Sun, Tianyi Ma, Metin Alp Dogan, Benjie Wang, Allen Peng, Guy Van den Broeck, Yuchen Cui

机构 * Michigan State University(密歇根州立大学) University of California Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 Meta-Ctrl是一种约束解码框架,通过引入元标记分离句法与语义约束,在保证规划满足约束的同时保留语言模型的规划质量,在WAH-NL数据集和真实桌面机器人上均取得优于GPT-4的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27629 2026-08-31 cs.IR cs.AI physics.geo-ph 新提交 57%

LitCurate: A Configuration-Driven AI-Assisted Framework for Scientific Database Construction with an Application to Lower-Mantle Equation-of-State Data

LitCurate:一种配置驱动的AI辅助科学数据库构建框架及在下地幔状态方程数据中的应用

Abin Shakya, Wilson Samuels, Dominica Wilson, Gioia A. Marchi, Israa Draz, Chenxing Luo, Renata M. Wentzcovitch

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI

AI总结 本文提出开源框架LitCurate,整合大语言模型与可审计分阶段工作流构建科学数据库,并将其应用于构建含1334条条目的下地幔高压矿物相状态方程数据库,实现文献到可追溯数据的转化。

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28391 2026-08-31 cs.LO cs.FL cs.GT 新提交 50%

Adaptive Strategies for GR(1) Games

GR(1)博弈的自适应策略

S. Krishna, Kaushik Mallik, Abhilasha Sharma Suman

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究针对GR(1)博弈提出自适应框架,将环境玩家视为非对抗智能体,通过监控活性属性调整策略,解决传统静态策略的保守性问题,其随机策略可渐近收敛至最优确定性策略,原型性能优于现有技术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28492 2026-08-31 cond-mat.mtrl-sci 新提交 50%

Wyckoff-Resolved Oxidation-State Atlas and Anion-Conditioned Priors for Materials Discovery

用于材料发现的Wyckoff分辨氧化态图集与阴离子条件先验

Boris Kiefer

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本研究构建Wyckoff分辨氧化态图集及阴离子条件先验,提升材料氧化态分配覆盖度,为材料发现相关工作流提供可复现的先验支持。

Comments 19 pages (main & SI) and 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏