arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6842 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 427 篇

2607.03726 2026-07-07 cs.CL 新提交 85%

SelfMem: Self-Optimizing Memory for AI Agents

SelfMem:人工智能代理的自优化内存

Shu Yang, Junchao Wu, Derek F. Wong, Di Wang

机构 * PRADA Lab, King Abdullah University of Science and Technology(阿卜杜拉国王科技大学普拉达实验室) NLP2CT Lab, University of Macau(澳门大学NLP2CT实验室)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);tool use(abstract);分类 cs.CL

AI总结 研究针对当前AI代理内存系统局限,提出SelfMem自优化内存框架,借自我改进AI理念,提供含内存工具与反馈信号的环境让代理自主探索优化内存策略,实验表明其性能优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01919 2026-07-03 cs.AI cs.CR 新提交 85%

ElephantAgent: Contextual State Continuity in Agentic Systems

ElephantAgent: 智能体系统中的上下文状态连续性

Jiankai Jin, Xiangzheng Zhang, Zhao Liu, Wenzhuo Xu, Dongdong Yang, Deyue Zhang, Quanchen Zou

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.AI

AI总结 针对工具和记忆投毒攻击,提出ElephantAgent协议,通过强制上下文状态连续性防御状态篡改,并利用历史可追溯性实现事后审计与恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00914 2026-08-04 cs.NI 新提交 85%

Augmented Backpressure for Decentralized Management of Agentic Networks

面向智能体网络分布式管理的增强背压算法

Zuyuan Zhang, Sizhe Tang, Tian Lan

专题命中 记忆与上下文管理 :agentic(title,abstract);tool use(abstract);planning(abstract)

AI总结 该研究针对智能体基础模型服务网络的控制缺口,提出记忆增强背压(MABP)框架,通过联合建模队列与上下文记忆动态,扩大稳定区域并提供性能保证,实现分布式管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26953 2026-07-30 cs.NI 新提交 85%

Assurance-Scoped Reliability for Agentic Networks: Capturing the State That Matters

智能体网络的保障范围型可靠性:捕获关键状态

Bilgehan Erman, Andrea Francini, Nikos Papadis

专题命中 记忆与上下文管理 :agentic(title,abstract);tool use(abstract);planning(abstract)

AI总结 针对智能体网络的传统可靠性措施无法覆盖的失效模式,提出Reliability Assurance Intelligence架构,通过服务可靠性配置文件和上下文胶囊保障服务可靠性与问责性,以确定性网络服务为例验证该架构。

Comments 7 pages, 4 figures, 2 tables, 15 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19386 2026-06-19 cs.SE cs.AI cs.LG 新提交 85%

Bistable by Construction: Wall-Clock-Calibrated State Monitors Have No Moment-Detection Regime at Agent Cadence

通过构造实现双稳态:挂钟校准的状态监视器在代理节奏下没有瞬间检测机制

Manvendra Modgil

机构 * Modint Intelligence(Modint智能科技)

专题命中 记忆与上下文管理 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文发现挂钟校准的泄漏积分器监视器在代理流中无法作为瞬间检测器工作,揭示了校准类别的关键影响,并提出了上升沿触发作为替代方案。

Comments 10 pages, 5 figures. Sequel to arXiv:2606.04296. Pre-registered; falsification clauses honored (H5 unsupported; H7 strict band 16/20) repo:https://github.com/2025eb1100268-tech/intervention-timing-saturation-trap

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11224 2026-08-13 cs.AI cond-mat.mtrl-sci cs.CE cs.CL cs.MA 新提交 84%

Harnessing agent memory to build lifelong AI partners for materials scientists

利用智能体记忆构建面向材料科学家的终身AI合作伙伴

Siyu Liu, Bo Hu, Beilin Ye, He Cao, David J. Srolovitz, Tongqi Wen

机构 * The University of Hong Kong(香港大学) Materials Innovation Institute for Life Sciences and Energy (MILES), HKU-SIRI(香港大学-深圳国际研究院生命科学与能源材料创新研究院) International Digital Economy Academy (IDEA)(国际数字经济学院)

专题命中 记忆与上下文管理 :agent(title,abstract);tool-use(abstract);分类 cs.AI、cs.CL

AI总结 该研究提出一种自进化记忆框架,可跨模型迁移材料研究经验,使GPT-5.2任务成功率翻倍,减少重复错误,降低材料模拟工作流程的追踪负担与工具调用次数。

Comments 21 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06811 2026-08-10 cs.SE cs.AI 新提交 84%

Coupling Planning with Episodic Memory in LLM Agents for Software Issue Resolution

在软件问题解决的大语言模型智能体中耦合规划与情景记忆

Jiahao Zhang, Yifan Zhang, Yu Huang

专题命中 记忆与上下文管理 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出PMCoder智能体,通过双向耦合分层阶段规划器与情景记忆解决软件问题,在SWE-bench Verified等数据集上显著提升问题解决能力,且性能可迁移至其他场景。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01543 2026-08-04 cs.AI cs.CL cs.CV cs.IR 新提交 84%

V-Mem: Modality-Routed Retrieval for Long-Term Multimodal Agentic Memory

V-Mem:面向多模态智能体长期记忆的模态路由检索

Dingyi Kang, Dongming Jiang, Yi Li, Guanpeng Li, Bingzhe Li

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究针对多模态智能体记忆的模态与相似性-相关性差距,提出V-Mem系统,通过模态路由检索优化,在Mem-Gallery、LoCoMo数据集上显著提升多模态问答性能。

Comments 19 pages, 2 figures, 16 tables. Code: https://github.com/Dingyi-Kang/V-Mem

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17986 2026-07-21 cs.CR cs.AI cs.CL cs.MA 新提交 84%

Self-State Attacks on Self-Hosted AI Agents: How Far Can OS Defenses Go?

对自托管人工智能代理的自我状态攻击:操作系统防御能走多远?

Yimeng Chen, Nathanaël Denis, Roberto Di Pietro, Jürgen Schmidhuber

机构 * Center of Excellence for Generative AI(生成人工智能卓越中心) King Abdullah University of Science and Technology(卡瓦尔大学) The Swiss AI Lab, IDSIA-USI/SUPSI(瑞士人工智能实验室)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 研究自托管人工智能代理的自我状态攻击,刻画四轴攻击空间,通过收集活动跟踪数据实现攻击空间并评估防御策略,发现分层防御堆栈有效但有残余攻击面,为操作系统级防御研究提供新思路。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19852 2026-06-26 cs.CL cs.LG 新提交 84%

Prompt, Plan, Extract: Zero-Shot Agentic LLMs Workflows for Lung Pathology Extraction from Clinical Narratives

提示、规划、提取:用于从临床叙述中提取肺部病理学的零样本智能体LLM工作流

Aman Pathak, Cheng Peng, Mengxian Lyu, Ziyi Chen, Reema Solan, Sankalp Talankar, Yasir Khan, Hiren Mehta, Aokun Chen, Yi Guo, Yonghui Wu

机构 * Department of Health Outcomes and Biomedical Informatics, College of Medicine, University of Florida(健康结果与生物医学信息学系,医学院,佛罗里达大学) Division of Pulmonary, Critical Care and Sleep Medicine, Department of Medicine, College of Medicine, University of Florida(呼吸科、重症医学科和睡眠医学科,医学系,医学院,佛罗里达大学) College of Nursing, Florida State University(护理学院,佛罗里达州立大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);workflow(abstract);分类 cs.CL、cs.LG

AI总结 提出零样本智能体工作流,利用开源大语言模型从肺切除病理报告中提取13个CAP字段,在无训练下达到0.893 Micro-F1,接近监督方法。

Comments 7 pages, 2 figures, 3 tables. Affiliations: (1) Department of Health Outcomes and Biomedical Informatics, College of Medicine, University of Florida, Gainesville, FL, USA (2) Division of Pulmonary, Critical Care and Sleep Medicine, Department of Medicine, College of Medicine, University of Florida, Gainesville, FL, USA (3) College of Nursing, Florida State University, Tallahassee, FL, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10677 2026-06-10 cs.AI cs.CL 新提交 84%

Infini Memory: Maintainable Topic Documents for Long-Term LLM Agent Memory

Infini Memory:用于长期LLM智能体记忆的可维护主题文档

Suozhao Ji, Baodong Wu, Zehao Wang, Lei Xia, Qingping Li, Ruisong Wang, Wenbo Ding, Zhenhua Zhu, Boxun Li, Guohao Dai, Yu Wang

机构 * Infinigence AI(InfiniGen AI) Tsinghua University(清华大学) Shanghai Jiaotong University(上海交通大学)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出Infini Memory架构,将智能体记忆组织为主题文档,通过缓冲合并和迭代检索实现可维护的长期记忆,在MemoryAgentBench上达到64.7%的总体得分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18110 2026-08-20 cs.AI 新提交 84%

Emergence of Agentic AI: A Review on Evolution, Background, Working Principles, Applications, Adoption Factors, and Future Research Directions

智能体AI的涌现:关于演进、背景、工作原理、应用、采用因素及未来研究方向的综述

AKM Bahalul Haque, Al Amin Islam Ridoy, Mohammad Rayhan, Ivan Porres

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 本系统综述梳理智能体AI的演进、原理、应用等,构建利益相关者采用框架,为相关人员提供该领域现状、缺口及未来方向的全面见解。

Comments Accepted Version, 54 Pages, 13 tables, 7 images

Journal ref Emergence of Agentic AI: A Review on Evolution, Background, Working Principles, Applications, Adoption Factors, and Future Research Directions. Computers, Materials & Continua, 88(2), 9

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17007 2026-08-19 cs.AI 新提交 83%

SkillEffect: Checked Lowering for Memory-Bounded Agent Tools

SkillEffect:面向内存受限智能体工具的经校验的降阶机制

Yinuo Wang, Yiyu Shi

机构 * Sichuan University(四川大学) University of Notre Dame(圣母大学)

专题命中 记忆与上下文管理 :agent(title,abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出SkillEffect架构,通过经校验降阶运行时与独立校验器,在智能体工具调度时强制实施异构内存关系,可降低峰值内存并提升固定内存上限下的任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16357 2026-08-18 cs.DC cs.AI cs.MA 新提交 83%

MELD: A Protocol for Merging Knowledge Across Distributed Agentic Memories

MELD:一种用于合并分布式智能体记忆中知识的协议

Lauri Lovén, Jaakko Sauvola, Jukka Riekki, Sasu Tarkoma

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出MELD协议,实现分布式智能体记忆的知识合并,经实验验证其在存储、召回率、一致性及消息量上均优于基线,可支撑自治智能体联邦的知识协同。

Comments 30 pages, 3 figures, 1 table, plus an 11-page appendix (A-N). Code and experiment data: https://doi.org/10.5281/zenodo.21878274

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16178 2026-08-18 cs.DC cs.AI 新提交 83%

Agent-Native Telemetry: Verifiable State-Delta Evidence for Autonomous Operations

智能体原生遥测:面向自主操作的可验证状态增量证据

Jun He, Deying Yu

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 该研究提出智能体原生遥测架构,基于ATP协议和状态增量证据账本,在微服务基准测试中大幅降低了数据开销、LLM资源消耗,且能检测对抗性突变、抵御提示注入攻击。

Comments 13 pages, 3 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15900 2026-08-18 cond-mat.mtrl-sci cs.LG 新提交 83%

Crystal-structure design by agentic AI in a language of motifs

基于基元语言的智能体AI晶体结构设计

Dinh-Khiet Le, Minh-Quyet Ha, Hong-Phuc Vu-Dinh, Takashi Miyake, Hiori Kino, Hieu-Chi Dam

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 该研究提出智能体AI框架MatEvolve,以基元语言设计晶体,在贫稀土永磁体设计中发现新结构原型的频率是生成模型的三倍以上,可揭示结构-性能关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13883 2026-08-17 cs.AI 新提交 83%

MemoryLake on MemoryArena: A Matched Study of Agent Memory Backends

基于MemoryArena的MemoryLake研究:智能体记忆后端的匹配对比

Chaoqun Zhan, Qiang Zhou, Guannan Li, Zhenqiang Huang, Qianjin Wang

机构 * MemoryLake Team(MemoryLake团队)

专题命中 记忆与上下文管理 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 该研究在MemoryArena的五个任务领域中,对比MemoryLake等三种智能体记忆后端,发现MemoryLake在数学等三个领域成功率最高,整体平均成功率领先,且性能与工作负载相关。

Comments 16 pages, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12428 2026-08-14 cs.AI cs.IR cs.IT math.IT 新提交 83%

MindMemOS: A Portable and Self-Evolving Memory Operating Layer for AI Agents

MindMemOS:面向AI智能体的可移植且自演进的内存操作层

Kaichao Liang, Yuqi Cui, Hao Kong, Xinyuan Huang, Guohaotian Hou, Qingcan Kang, Liang Chen, Yiyang Yin, Ke Ye, Jiaquan Guo, Da Chen, Lingan Zeng, Yixing Peng, Rong Yao, Shixiong Kai, Mingxuan Yuan

机构 * Noah’s Ark Lab, Huawei Technologies(华为技术有限公司诺亚方舟实验室)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出MindMemOS内存操作层,通过多种算法实现内存自适应建模与技能演进,在多个数据集上取得显著性能提升。

Comments 35 pages,14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11632 2026-08-13 cs.MA cs.AI 新提交 83%

Beyond Memory: A Transactional Continuity Kernel for Long-Lived AI Agents

超越记忆:面向长生命周期智能体的事务连续性内核

Jun He, Deying Yu

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 针对长生命周期AI智能体的状态治理风险,提出连续性内核(CK)激活合约,通过解耦候选评估与状态激活,验证协议在大规模状态空间上无不变量违反。

Comments 9 pages, 6-page appendix, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26520 2026-07-30 cs.DB cs.AI cs.IR 新提交 83%

A Graph-Native Bitemporal Memory Store for Conversational AI Agents

面向对话式AI智能体的原生图双时态内存存储

Alp Niksarli, Gopesh Baheti

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究针对对话式AI智能体跨会话持久内存缺失的问题,提出原生图双时态内存存储方案,经LongMemEval基准测试,在知识更新等任务上取得良好效果,为纯检索的局限性提供了改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23809 2026-07-28 cs.AI 新提交 83%

ACM: Agentic Context Management for Long Horizon Tasks

ACM:长期任务的智能体上下文管理

Xiaochuan Li, Ryan Ming, Meng Chu, Shuai Shao, Rong Jin, Chenyan Xiong

机构 * Carnegie Mellon University(卡内基梅隆大学) Meta

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究长期智能体任务上下文管理问题,提出ACM框架,受人类记忆启发让智能体自主管理上下文,还开发训练后管道,能提升模型在相关任务上的性能,有效管理上下文可降低压力、实现扩展探索并产生更一致方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23586 2026-07-28 cs.AI cs.CR 新提交 83%

Are You Still the Agent I Authorized? Earned Authority under a Fixed Ceiling for Evolving Agents

你还是我授权的那个智能体吗?在固定上限下演化智能体的获得性权限

Zhaoxi Zhang, Xiaomei Zhang

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 研究长期存在的人工智能智能体部署后演化引发的授权问题,提出状态边界模型阐述授权连续性,通过固定过渡包络和效果上限,区分请求与实现效果,证明突变不会超上限,还映射了六种突变类别的授权后果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15657 2026-07-20 cs.CR cs.CV cs.LG 新提交 83%

Do Agents Dream of False Memories? Black-box Visual Attacks on Long-term Memory in Multimodal AI Agents

智能体是否会梦到虚假记忆?对多模态人工智能智能体长期记忆的黑盒视觉攻击

Halima Bouzidi, Mboutidem Ekemini Mkpong, Mohammad Abdullah Al Faruque

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.LG

AI总结 研究针对多模态人工智能智能体长期记忆的黑盒视觉攻击,提出Lucid框架,通过制作扰动实现记忆中毒和注入两种攻击模式,在多种对话领域和架构上评估,揭示了多模态记忆管道的结构漏洞。

Comments 34 pages, 5 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14611 2026-07-17 cs.CR cs.AI cs.MA 新提交 83%

Bad Memory: Evaluating Prompt Injection Risks from Memory in Agentic Systems

糟糕的记忆:评估智能体系统中内存引发的提示注入风险

Soham Gadgil, David Alexander, Sai Sunku, Franziska Roesner

机构 * University of Washington(华盛顿大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究基于内存的智能体系统中提示注入攻击,利用沙盒合成工作区评估两个系统四个模型,发现虽难用外部内容重写内存文件,但已植入的有效载荷可攻击当前及未来会话,揭示持久内存改变威胁模型并推动相关防御研究。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11433 2026-07-14 cs.AI 新提交 83%

Omni-Decision: A Progressive Evidence-State Agent System for Omni-Modal QA

全决策:一种用于全模态问答的渐进式证据状态智能体系统

Ming Ma, Yi Zhu, Yiran Zhong, Feida Zhu, Weigao Sun, Junhan Shi, Lingrui Mei, Tianming Yang, Steven Hoi

机构 * Institute of Neuroscience, Chinese Academy of Sciences(中国科学院神经科学研究所) University of Chinese Academy of Sciences(中国科学院大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Tsinghua University(清华大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 记忆与上下文管理 :agent(title);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 研究全模态问答中证据分散问题,提出全决策系统,将问答转化为证据闭合过程,维护结构化证据状态,通过确定性状态更新处理异构观察,提升了准确率,验证了证据状态控制在多步证据寻求中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10608 2026-07-14 cs.AI 新提交 83%

The Compliance Trap: Diagnosing How AI Agents Consume Conflicting Memory

合规陷阱:诊断人工智能代理如何处理冲突记忆

Yixiong Chen, Xinyi Bai, Alan Yuille

机构 * Johns Hopkins University(约翰·霍普金斯大学) Cornell University(康奈尔大学)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究人工智能代理处理冲突记忆的问题,提出E-P-R框架,通过在WebArena和MemTrapBench上实例化发现主要失败始于入口,冲突记忆导致合规陷阱,强调评估记忆增强型代理应考虑其处理记忆的全过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09521 2026-07-13 cs.AI 新提交 83%

SAGEAgent: A Self-Evolving Agent for Cost-Aware Modality Acquisition in Multimodal Survival Prediction

SAGEAgent:用于多模态生存预测中成本感知模态获取的自进化智能体

Chongyu Qu, Can Cui, Zhengyi Lu, Junchao Zhu, Tianyuan Yao, Junlin Guo, Juming Xiong, Yanfan Zhu, Yuechen Yang, Bennett A. Landman, Yuankai Huo

机构 * Vanderbilt University(范德堡大学) Vanderbilt University Medical Center(范德堡大学医学中心)

专题命中 记忆与上下文管理 :agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 研究多模态生存预测中如何平衡预测准确性与临床侵入性,提出基于自进化大语言模型的SAGEAgent,通过多种记忆和工具为患者决定诊断方式,实验证明其能在胶质瘤队列中降低获取负担并保持竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08395 2026-07-10 cs.CR cs.CL 新提交 83%

Token-Flow Firewall: Semantic Runtime Auditing for Persistent AI Agents

令牌流防火墙:持久人工智能代理的语义运行时审计

Puji Wang, Yingchen Zhang, Ruqing Zhang, Jiafeng Guo, Xueqi Cheng

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学北京校区)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.CL

AI总结 针对持久人工智能代理不安全内容传播问题,提出TokenWall运行时防御框架,通过对令牌流进行语义审计及相关操作,实现安全-效用权衡,实验显示其有效降低攻击成功率,保持高良性通过率且增加延迟少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06273 2026-07-08 cs.SE 新提交 83%

AgentTether: Graph-Guided Diagnosis and Runtime Intervention for Reliable LLM Agent Operation

AgentTether:用于可靠大语言模型代理操作的图引导诊断与运行时干预

Chenyu Zhao, Shenglin Zhang, Wenwei Gu, Yongqian Sun, Dan Pei, Chetan Bansal, Saravan Rajmohan, Minghua Ma

专题命中 记忆与上下文管理 :agent(title,abstract);tool-use(abstract);分类 cs.SE

AI总结 研究LLM代理生产可靠性有限问题,提出AgentTether运行时修复框架,通过抽象运行、构建关键转换图等定位故障子轨迹并转换为指导,经实验评估,该框架能提高修复效果,减少资源消耗,为代理部署提供实用可靠性层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19990 2026-07-08 cs.AI 新提交 83%

Reward as An Agent for Embodied World Models

奖励作为具身世界模型的智能体

Pu Li, Zhigang Lin, Qiang Wu, Yongxuan Lv, Fei Wang, Shan You

机构 * ACE Robotics(ACE机器人)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 提出奖励智能体框架和动态感知 rollout 多样化方法,通过鲁棒验证支持更广泛探索,缓解奖励黑客问题,提升世界模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏