arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-11 至 2026-08-11 共收录 427 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 25 篇

2607.04425 2026-08-11 cs.CL cs.AI cs.CV cs.LG cs.MM 版本更新 67%

UI-MOPD: Multi-Platform On-Policy Distillation for Unified GUI Agents

UI-MOPD:用于持续GUI智能体学习的多平台策略蒸馏

Niu Lian, Tongbo Chen, Zhehao Yu, Chengzhen Duan, Fazhan Liu, Hui Liu, Pei Fu, Jian Luan, Heng Qu, Shu-Tao Xia, Jinpeng Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Xiaomi(小米) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Zhejiang University(浙江大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对构建多平台GUI智能体的挑战,构建高质量数据集Uni-GUI,提出UI-MOPD方法,通过多教师策略蒸馏实现持续学习,动态选教师并转移行为先验,实验证明其能平衡跨平台能力保留与新平台适应。

Comments Technical report. 27 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04412 2026-08-11 cs.AI cs.CL cs.HC 版本更新 62%

Beyond Pixels: Exploring DOM Downsampling for LLM-Based Web Agents

超越像素:探索面向基于大语言模型的智能体的DOM下采样

Thassilo M. Schiepanski, Nicholas Piël

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出D2Snap算法对DOM下采样,解决原始DOM令牌占用过大的问题,经评估其在GPT-4o智能体上的成功率达73%,接近基于GUI快照的基线性能。

Comments 21 pages, LaTeX, print version; enhanced algorithm, settled on non-inferiority claim, added downsampling monotonicity and linearity results

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09467 2026-08-11 cs.CV cs.AI 新提交 57%

RecoverFly: A Failure-Aware Reinforcement Learning Post-Training Framework for Aerial Vision-Language Navigation

RecoverFly:面向空中视觉语言导航的故障感知强化学习后训练框架

Boxiong Wang, Hui Kang, Geng Sun, Jiahui Li, Chao Yu, Daxin Tian

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 RecoverFly是面向端到端无人机视觉-语言-动作策略的故障感知强化学习后训练框架,在TravelUAV基准上实现了优于AerialVLA的性能,提升了导航成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09121 2026-08-11 cs.AI 新提交 57%

MELLON - Multimodal Enhanced LLM for Online Navigation

MELLON——面向在线导航的多模态增强型大语言模型

Ruiyu Li, Haoyang Cai, Zhitong Guo, Tong Hu

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 针对网页导航智能体现有模型的不足,本文以WebShop为基准,提出MELLON等三项多模态增强方案,训练1个epoch后MELLON任务完成准确率提升9.26%,验证了多模态方法的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08617 2026-08-11 cs.AI cs.HC 新提交 57%

Walking through Discussions: A Mobile Visual Analytics System for In-Situ Group Discussion Analysis

穿行于讨论间:用于现场小组讨论分析的移动视觉分析系统

Yiping Sun, Ziyao Kang, Wei Zeng, Minli Wu, Jiazhi Xia

机构 * Central South University(中南大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Hong Kong University of Science and Technology(香港科技大学)

专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.AI

AI总结 本研究提出移动视觉分析系统MobileGroupVis,适配小屏幕触控交互,用于现场分析课堂小组讨论,可辅助教师监控小组、诊断异常并开展课堂干预。

Comments Accepted by IEEE VIS'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08545 2026-08-11 cs.RO cs.LG 新提交 57%

Curriculum Generation under Structured Parametric Environments for Robust Navigation Policies

结构化参数环境下用于鲁棒导航策略的课程生成

Prishita Ray

机构 * Cornell University(康奈尔大学)

专题命中 GUI与网页智能体 :autonomous agent(abstract);分类 cs.LG

AI总结 本文针对结构化参数环境提出重参数化课程生成框架,结合分布偏移正则化,在OpenAI Gym的两类连续控制环境中,显著优于多种基线方法,提升了导航策略的鲁棒性。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07775 2026-08-11 cs.AI 新提交 57%

AndroidReality: How Far Are Mobile Agents from the Real World?

AndroidReality:移动智能体距离真实世界还有多远?

Xiaoou Liu, Longchao Da, Hanyang Chen, Yuan Ling, Hua Wei

机构 * Arizona State University(亚利桑那州立大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本研究提出基于扰动的框架AndroidReality,构建含可控扰动的移动基准测试,揭示移动智能体的鲁棒性差距,提出TTIR机制缓解故障,确立基准扰动的实用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07751 2026-08-11 cs.RO cs.LG 新提交 57%

CoCoNav: Conformal Control for Safe Robot Navigation in Crowds

CoCoNav:面向人群环境中安全机器人导航的保形控制

Cheng Guo, Mingzhe Ni, Zheng Liang, Yihu Ling, Yuan Hu, Michele Caprio, Daniele Pucci, Wei Pan

机构 * The University of Manchester(曼彻斯特大学) Italian Institute of Technology(意大利技术研究院) Genisom AI University of Warwick(华威大学) Newcastle University(纽卡斯尔大学)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.LG

AI总结 本文提出CoCoNav框架,结合在线保形校准与“先松弛再验证”规划器,在人群环境机器人导航中实现了避碰、任务成功与效率的良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07557 2026-08-11 cs.RO cs.AI cs.CV 新提交 57%

AeroDPO: Unleashing Lightweight UAV Navigation with High-Fidelity Perception and Automated Preference Optimization

AeroDPO:释放具备高保真感知与自动偏好优化的轻量级无人机导航能力

Peng Xu, Chengcheng Wang, Shaohua Wan

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出AeroDPO,通过高保真感知与自动偏好优化,使20亿参数轻量级无人机导航模型达到70亿参数模型的成功率,同时降低分布外场景碰撞率,成为自主空中智能体新SOTA。

Comments 7 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08005 2026-08-11 cs.LG 版本更新 57%

Preference Redirection via Attention Concentration: An Attack on Computer Use Agents

通过注意力集中进行偏好重定向:对计算机使用代理的一种攻击

Dominik Seip, Matthias Hein

机构 * Tübingen AI Center, University of Tübingen(图宾根大学图宾根人工智能中心)

专题命中 GUI与网页智能体 :agentic(abstract);分类 cs.LG

AI总结 本文提出PRAC攻击,通过重定向模型注意力操纵CUA选择过程,揭示了视觉模态的漏洞,威胁到基于开放权重模型的CUA安全。

Journal ref Conference on Language Modeling (COLM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09196 2026-08-11 cs.RO 新提交 50%

SAIN: Structure-Aware Interactive Navigation with Active Dialogue Grounding for Mobile Robot

SAIN:面向移动机器人的、结合主动对话 grounding 的结构感知交互式导航

Yuhao Cao, Xiao Liu, Yang Xie, Lu Liu, Haoyao Chen

机构 * School of Mechanical Engineering and Automation, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机械工程与自动化学院) Department of Mechanical Engineering, City University of Hong Kong(香港城市大学机械工程系)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出SAIN零样本框架,将主动对话转化为持久导航状态,在VL-LN IIGN基准上提升了导航成功率与加权成功率,无需特定任务策略训练,验证了对话转状态机制的有效性。

Comments 8 pages, 4 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08981 2026-08-11 cs.DC 新提交 50%

Universal Rendezvous of Anonymous Agents with Footprints

带足迹的匿名智能体的通用会合算法

Bibhuti Das

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文针对带足迹模型中所有连通(有限或可数无限)底层图的会合实例,提出通用会合算法,解决了Das和Pelc提出的开放问题,给出该模型所有实例存在通用算法的肯定答案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08596 2026-08-11 cs.CV 新提交 50%

Goal-oriented Navigation Instruction Generation with Tour Video Priors

基于旅游视频先验的面向目标的导航指令生成

Fangdi Li, Juncheng Liao, Changxu Cheng, Jiazhi Wang, Senda Chen, Tao Wang, Wuyue Zhao

机构 * Uni-Ubi AI(优必爱人工智能) Zhejiang University(浙江大学) Tongji University(同济大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本研究提出面向目标的视频 grounding 导航指令生成任务VideoNIG,设计两阶段课程学习框架解决该任务,实验表明其可提升指令质量,集成VLN智能体后可实现端到端导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07797 2026-08-11 cs.RO cs.CV 新提交 50%

Drone-Assisted UAV-UGV Collaboration for Autonomous Navigation in Snow-Covered Terrain

无人机辅助的无人机-无人车协同积雪覆盖地形自主导航

Shreyam Gupta, P. Agrawal, Priyam Gupta, R. Gautam

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 针对积雪覆盖地形传统导航方法失效的问题,提出无人机-无人车协同导航框架,采用定制U-Net、EKF、YOLOv5等技术实现高分割精度与低定位误差,可在遮挡环境中完成自主导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06833 2026-08-11 cs.RO 版本更新 50%

Unordered Landmark Visual Navigation

无序地标视觉导航

Hao Ren, Junzhe Zhu, Yihan Li, Zetong Bi, Le Zheng, Zhi Li, Yiqing Yuan, Zhaoliang Wan, Dizhe Zhang, Lu Qi, Hui Cheng

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 针对无序图像导航的挑战,本文提出无需时间与里程计先验的ULVN框架,通过整合建图、定位与规划,在仿真和真实场景中性能优于现有最优方法。

Comments ECCV2026 Oral & Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04276 2026-08-11 econ.TH 版本更新 50%

The Fallback as Signal: Preserved Human Skill, Liability, and Competence Signaling in Credence-Good Markets under Improving AI

作为信号的弃权:AI不断改进下的信任品市场中保留的人类技能、责任与能力信号

Andreas Bauer

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 该研究针对AI改进但仍不完善时企业的人类员工参与决策问题,构建基于主体的市场模型再现相关分析阈值,揭示信任品市场中人类技能等信号的保留机制。

Comments v2: Corrects the author first names in the Singh, Ghosh and Dai reference (verified against the arXiv listing). Typography: Latin Modern replaces bitmap-rendered T1 Computer Modern and all figures are re-exported without Type-3 fonts; no content changes, no number changes. 49 pages, 7 figures. Replication code and seeds in the ancillary files. Also SSRN 7198738. JEL: D82, D86, J24, K13, L15, O33

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29029 2026-08-11 cond-mat.mtrl-sci 50%

Geometry-based Discovery of Calcium Battery Cathodes Accelerated by Foundational Machine-Learned Models

基于几何学的钙电池正极发现加速于基础机器学习模型

Dereje Bekele Tekliye, Achinthya Krishna Bheemaguli, Gopalakrishnan Sai Gautam

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 通过几何和化学设计原则,结合机器学习模型,从材料项目数据库中筛选出37种有前景的钙电池正极候选材料,其中两种具有极低的Ca²⁺迁移势垒,四种具有热力学稳定的充电态。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 记忆与上下文管理 25 篇

2608.08253 2026-08-11 cs.AI cs.IR 新提交 85%

SuperLocalMemory 4.0: The Governed Memory Operating System for AI Agents

SuperLocalMemory 4.0:面向AI智能体的受管控内存操作系统

Varun Pratap Bhardwaj, Garima Singh, Arun Pratap Bhardwaj

机构 * Qualixar(奎利克萨)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出SuperLocalMemory 4.0,一款面向AI智能体的受管控本地优先内存操作系统,整合多类型检索与管控功能,经测试其可靠性达标,为AI智能体提供持久化内存解决方案。

Comments 35 pages, 17 figures, 4 tables. Zenodo DOI: 10.5281/zenodo.21853302. Code: https://github.com/qualixar/superlocalmemory/releases/tag/v4.0.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28533 2026-08-11 cs.CL 版本更新 83%

GraphWalker: Agentic Knowledge Graph Question Answering via Synthetic Trajectory Curriculum

GraphWalker: 通过合成轨迹课程实现基于知识图谱的代理问答

Shuwen Xu, Yao Xu, Jiaxiang Liu, Chenhao Yuan, Wenshuo Peng, Jun Zhao, Kang Liu

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 GraphWalker通过自动化轨迹合成和分阶段微调解决知识图谱问答中的探索与泛化问题,提升轻量强化学习性能,在CWQ和WebQSP上取得最优效果。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02508 2026-08-11 cs.LG cs.CL 版本更新 81%

RoMeRL: Balancing Feedback Coverage and the Memory-Reward Trap in Self-Evolving Agent Memory via Reduced-Order Utility States

RoMeRL:通过降阶效用状态平衡自进化智能体记忆中的反馈覆盖与记忆-奖励陷阱

Yi Yang, Zhennan Chen, Yihong Zhuang, Tiehan Fan, Yinan Chen, Jian Li, Jian Yang, Ying Tai

机构 * Nanjing University(南京大学) Xiamen University(厦门大学) Zhejiang University(浙江大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL、cs.LG

AI总结 RoMeRL通过降阶效用状态解决自进化LLM智能体记忆的反馈分散与记忆-奖励陷阱问题,在ALFWorld等基准上显著提升任务性能、降低记忆规模与LLM调用

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09184 2026-08-11 cs.AI 新提交 79%

Agentic Router: An Execution-Grounded Continual Learning Approach With Memory

智能体路由器:一种基于执行的带记忆的持续学习方法

Yuxuan Chen, Rongpeng Li, Zhifeng Zhao, Yuntao Liu, Xing Xu, Honggang Zhang

机构 * Zhejiang University(浙江大学) Zhejiang Lab(之江实验室) State Grid Hebei Electric Power Co., Ltd.(国网河北省电力有限公司) Macau University of Science and Technology(澳门科技大学)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI

AI总结 该研究针对CLI-based SONiC操作,提出基于执行的双路径后果感知智能体,通过生成动作、预测后果、重排序选择,提升可行动作覆盖度与执行成功率,两条路径互补增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08612 2026-08-11 cs.CV cs.AI 新提交 79%

REVEAL: A Rubric-Guided Agent for Explicit Evidence Sufficiency Verificationin Long-Video Question Answering

REVEAL:用于长视频问答的基于 rubric(评分标准)的显式证据充分性验证智能体

Caijun Yan, Yang Zhou, Meixing Shi, Haoran Sun, Yichen Li, Yuxiang Cai, Yankai Jiang

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 该研究针对长视频问答中现有方法割裂事件、忽略证据充分性的问题,提出REVEAL框架,通过自适应分块的结构化记忆与rubric引导的证据验证,实现更可靠的推理且性能优于现有SOTA方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08131 2026-08-11 cs.CR cs.AI cs.MA 新提交 79%

Compositional Threat Analysis of Latent Compromise in LLM Agent Systems: The Order 66 Scenario

LLM智能体系统中潜在入侵的组合式威胁分析:66号指令场景

Satoshi Matsuoka

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文以66号指令为场景,提出组合模型分析LLM智能体系统的潜在入侵威胁,分离三类传播路径,指出现有防御无法封闭所有路径,最强防御为能力调解等四项措施,暂未发现完整场景的公开观测。

Comments Version 11.3, 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02704 2026-08-11 cs.CL 版本更新 79%

InfMem: Learning System-2 Memory Control for Long-Context Agent

InfMem: 面向长上下文智能体的系统2记忆控制

Xinyu Wang, Mingze Li, Peng Lu, Xiao-Wen Chang, Lifeng Shang, Jinping Li, Fei Mi, Prasanna Parthasarathi, Yufei Cui

机构 * McGill University(麦吉尔大学) Noah's Ark Lab(诺亚实验室)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 InfMem通过预思考-检索-写作协议实现系统2风格的控制,有效提升超长文档推理的准确率并减少推理时间。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07527 2026-08-11 cs.CL cs.AI 新提交 79%

DocAtlas: Long-Document Understanding as Mutable-State Interaction

DocAtlas:将长文档理解视为可变状态交互

Hongchen Wei, Yuanzhe Wang, Bei Liu, Yifan Yang, Qi Dai, Kai Qiu, Yunsheng Li, Dongdong Chen, Chong Luo, Zhenzhong Chen, Baining Guo

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 本研究提出DocAtlas系统,将长文档理解视为可变状态交互,通过可变文档工具结合自改进检索等技术,在MMLongBench-Doc上用GPT-5.4达71.4%,还可提升紧凑型VLM智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07810 2026-08-11 cs.MA cs.SI 新提交 78%

Mobility, Memory, and Network Structure in Agent-Based Models of Convention Tipping and Convergence

基于智能体的惯例颠覆与收敛模型中的流动性、记忆与网络结构

Joe Shymanski, Garrick Springer, Sandip Sen

专题命中 记忆与上下文管理 :agent(title,abstract)

AI总结 该研究构建智能体基模型,探究流动性、记忆、网络拓扑对惯例颠覆阈值的影响,发现多数配置下颠覆必然发生,还建立预测模型估计收敛时间,拓展了经典颠覆点研究。

Comments Under review at the Journal of Artificial Societies and Social Simulation (JASSS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08859 2026-08-11 cs.LG cs.AI 新提交 76%

Agentic Anomaly Detection with ORCA-Style Dynamic Inductive Bias Adaptation in Multimodal Wearable Time Series Data

基于ORCA风格动态归纳偏差自适应的多模态可穿戴时间序列智能体异常检测

Anushka Roy, Jyotirmoy Singh, Shreea Bose, Chittaranjan Hota

机构 * BITS Pilani(皮尔尼理工学院)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.LG

AI总结 该研究针对资源受限的非平稳生理时间序列异常检测问题,提出ORCA框架,通过监督控制器动态调整时间感受野,在WBAN和MIMIC-IV数据集上实现稳健性能,无需预调时间范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07622 2026-08-11 cs.AI cs.IR cs.LG 新提交 73%

Controlled Memory Interference in Continual LLM Agents

持续大型语言模型智能体中的可控记忆干扰

Ao Ding, Hongzong LI, Shiqin Tang, Li Zhang, Liang Chen, Xuyang Chen, Zi Liang

机构 * China University of Geosciences (Beijing)(中国地质大学(北京)) Northwestern Polytechnical University(西北工业大学) The Hong Kong University of Science and Technology(香港科技大学) Chinese Academy of Sciences(中国科学院) The Hong Kong Polytechnic University(香港理工大学) École polytechnique fédérale de Lausanne(洛桑联邦理工学院) National University of Singapore(新加坡国立大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出可控记忆干扰(CMI)框架,揭示记忆进化受经验相互作用影响,为持续大型语言模型智能体的记忆系统提供诊断与学习方法,提升记忆更新区分度与任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08795 2026-08-11 cs.CR cs.CL 新提交 70%

Toward Metacognitive One-Shot Indirect Prompt Injection: Strategy Abstraction Via Outcome-Conditioned Reflection

迈向元认知少样本间接提示注入:基于结果条件反射的策略抽象

Sihan Hou, Xinmeng Hou, Zhijun Zhang, Zehao Wang, Xuhong Ren, Sibo Qin, Kuntharrgyal Khysru, Qing Guo

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出SAVOR方法,将攻击适配转向离线策略蒸馏,仅需一次目标智能体查询,在多基准与模型上攻击成功率显著优于现有方法,且记忆可跨防御迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08036 2026-08-11 cs.RO 新提交 67%

Compiling and Benchmarking Task-State Horizons for Embodied Agents

面向具身智能体的任务状态视界的编译与基准测试

Meiqi Wang, Shichao Li

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract)

AI总结 该研究定义任务状态视界(TSH),推出RoboGraph编译器并发布含588个情节的基准,发现多数先进智能体模型在高TSH下维护、更新任务相关状态存在差距。

Comments 32 pages, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏