arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-19 至 2026-08-19 共收录 194 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 16 篇

2502.03693 2026-08-19 econ.EM 版本更新 50%

Misspecification-Robust Shrinkage and Selection for VAR Forecasts and IRFs

针对VAR预测与脉冲响应函数(IRFs)的 misspecification 鲁棒收缩与选择方法

Oriol González-Casasús, Frank Schorfheide

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究针对 VAR 预测与 IRF 估计的 misspecification 问题,提出 PC 和 IRFC 准则,实现了候选估计量、贝叶斯收缩程度与滞后阶数的联合选择,为相关研究提供了 misspecification 鲁棒的工作流程。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 17 篇

2608.17170 2026-08-19 cs.AI 新提交 83%

Synthesizing Feature Extractors: An Agentic Approach for Algorithm Selection

合成特征提取器:一种用于算法选择的智能体方法

Hai Xia, Carlos Ansótegui, Stefan Szeider

机构 * TU Wien(维也纳技术大学) University of Lleida(莱里达大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究提出一种基于LLM的智能体方法,通过检查-修复-验证循环合成可解释的特定问题特征提取器,在三类组合问题上的算法选择性能优于现有专家设计特征与Transformer变体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16630 2026-08-19 cs.SE cs.AI cs.LG 交叉投稿 82%

The Working Set of a Coding Agent: Coherence Debt in Repository-Scale Tasks

编码智能体的工作集:仓库规模任务中的一致性债务

Bardia Mohammadi, Lars Klein, Aman Chadha, Akhil Arora, Laurent Bindschaedler

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 该研究针对仓库规模编码任务,建模一致性债务,通过7个模型和5个框架实验发现事实可用性决定编码结果,提出测试框架应核对编辑依赖事实可用性的建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17588 2026-08-19 cs.AI cs.SE 新提交 81%

TRUSS: Towards Task-Reliable and User-Safe Automated Agent Skill Generation

TRUSS:面向任务可靠且用户安全的自动化智能体技能生成

Zhibo Zhang, Zhen Ouyang, Ling Shi, Kailong Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Nanyang Technological University(南洋理工大学)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 TRUSS是一种证据引导框架,可生成安全可靠的智能体技能,在多基准测试中实现了漏洞检测100%的精度召回率,同时显著提升任务有效性与安全率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17075 2026-08-19 cs.CL cs.AI 新提交 81%

Foundation Agents Meet Agentic Deep Research: Evidence-Grounded Clinical Code Forecasting

基础智能体与智能型深度研究结合:基于证据的临床代码预测

Junda Wang, Meysam Ghaffari, Akshat Choube, Mohsen Sharifi Renani, Hong Yu, Carlos Morato

专题命中 软件智能体 :agentic(title);workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文提出ICD-Deepresearch工作流,结合EHR基础模型、语言基础模型与医学搜索工具,在MIMIC-III、MIMIC-IV数据集上实现ICD编码预测,其检索证据的医生有用性评分优于对比系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17504 2026-08-19 physics.comp-ph cs.SE 新提交 79%

Agentic Porting, Construction and Initial Verification and Validation of Libraries within the Open Source Unified TRAnsient Multi-Phase Advanced Reactor simulation Kit (Outram Park) Part I: Thermal Hydraulics

开源统一瞬态多相先进反应堆模拟工具包(Outram Park)中库的智能体迁移、构建及初步验证与确认 第一部分:热工水力

Theodore Kay Chen Ong, Ethan Yew Hoe Wong, Sicong Xiao

专题命中 软件智能体 :agentic(title,abstract);分类 cs.SE

AI总结 本研究将OpenFOAM库智能体迁移至Rust语言的Outram-Foam库,开发了两相HEM壅塞流求解器,验证显示其吻合度良好,智能体编码可提升开源库开发效率,人类专业知识仍为关键。

Comments 78 pages, 21 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16951 2026-08-19 q-bio.QM cs.MA 新提交 78%

The Little Scientist: LLM Agent-Driven Discovery via the Scientific Method

小科学家:基于大语言模型智能体的科学方法驱动发现

Travis Smith

专题命中 软件智能体 :agent(title,abstract)

AI总结 该研究提出The Little Scientist框架,让LLM智能体遵循科学方法迭代探索,在蛋白质适应性预测、DNA基序发现问题上发现了优于现有方案的新算法与集成策略。

Comments Code: https://github.com/travis42/little-scientist-dale and https://github.com/travis42/little-scientist-delta-v (Apache 2.0)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18050 2026-08-19 cs.AI 新提交 77%

StagedWorkspace: A Versioned Workspace for Knowledge-Work Agents

StagedWorkspace:面向知识工作智能体的版本化工作空间

Yining Hua, Hongbin Na, Yifan Zhou, Akshay Kalose, Cyrus Ayubcha, Levi Lian

机构 * Harvard University(哈佛大学) Raycaster AI(雷caster人工智能公司) University of Technology Sydney(悉尼科技大学) University of Washington(华盛顿大学) Stanford University(斯坦福大学)

专题命中 软件智能体 :agent(abstract,abstract_cn);AI agent(abstract);分类 cs.AI

AI总结 该研究针对知识工作智能体的版本化工作空间问题,提出StagedWorkspace方案,通过绑定解析记录与原生文件内容哈希提升性能,在OfficeQA Pro等数据集上取得显著优于基准的效果,为相关基准构建提供了新方向。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17550 2026-08-19 cs.CV cs.CL 新提交 77%

Code as Representation: A Compilable Parsing Paradigm for Academic Documents

代码作为表示:学术文档的可编译解析范式

Rihui Jin, Jun Wang, chengyuan zhu, Liang Mingyu, Yue Gao, Li Yunxuan, Kuicai Dong, Guilin Qi, Lin Ren, Yongrui Chen, Xinbang Dai, Jiaqi Li, Tongtong Wu, Gholamreza Haffari

机构 * Southeast University(东南大学) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学)

专题命中 软件智能体 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.CL

AI总结 针对学术PDF难以被机器处理的问题,提出CADP可编译解析范式,构建CADP-Bench基准并测试SOTA MLLMs,发现前沿模型仍难生成高保真可执行重构,该基准已开放供研究。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14048 2026-08-19 astro-ph.IM 版本更新 67%

$\texttt{Aether.jl}$ : A High-Performance 3D MHD and Multifluid Dust Code Written in a Dynamic Language with an Interactive Human-AI Development Framework

Aether.jl:一种用动态语言编写、具备人机交互开发框架的高性能三维磁流体与多流体尘埃代码

Ka Wai Ho

专题命中 软件智能体 :agent(abstract);workflow(abstract)

AI总结 Aether.jl是一款用Julia编写的高性能三维磁流体与多流体尘埃代码,采用交互式人机开发框架,单GPU性能优于C++代码,在Frontier超算4096个GCD上并行效率超93%,支持CPU、GPU运行,已公开。

Comments 25 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01839 2026-08-19 cs.SE cs.AI 62%

The Machine Learning Canvas: Empirical Findings on Why Strategy Matters More Than AI Code Generation

机器学习画布:关于为何策略比AI代码生成更重要的实证发现

Martin Prause

专题命中 软件智能体 :planning(abstract);分类 cs.AI、cs.SE

AI总结 本研究通过实证分析揭示了机器学习项目成功的关键因素,强调策略比AI代码生成更重要,提出了机器学习画布框架,指出组织支持、策略规划、流程管理和生态系统是决定项目成败的核心要素。

Comments Dataset available: https://ieee-dataport.org/documents/machine-learning-canvas-success-determinants

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17393 2026-08-19 cs.AI 新提交 57%

LEGO-RL: Harness-Native Reinforcement Learning for Coding Agents

LEGO-RL:利用原生强化学习实现编码智能体

Yiming Du, Yuxin Jiang, Tao Yuan, Jianbo Dai, Shaowei Wang, Jierun Chen, Chaofan Tao, Xianzhi Yu, Lifeng Shang, Kam-Fai Wong, Xiaohui Li, Haoli Bai

机构 * Huawei Technologies Co., Ltd(华为技术有限公司) The Chinese University of Hong Kong(香港中文大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 LEGO-RL 是桥接原生编码智能体 harness 与策略梯度优化的框架,通过三大支柱解决训练不匹配问题,提升 Qwen3.5-35B-A3B 在三个编码基准上的性能,且保持高概率相关性。

Comments Webpage: https://lego-rl.pages.dev

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17018 2026-08-19 cs.SE 新提交 57%

ORCA: Observability-Grounded Program Repair for Microservice Incidents

ORCA:基于可观测性的微服务故障程序修复

Yuanchen Gao, Yifang Tian, Yiran Li, Charles Zhang, Hans-Arno Jacobsen

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 ORCA是基于可观测性的微服务故障修复流水线,通过遥测数据提炼故障特征定位候选位置,经多智能体生成补丁并通过遥测验证器评估,在575案例基准中成本效益优于所有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31281 2026-08-19 cs.CL 版本更新 57%

Wind Turbine Maintenance Log Labelling Framework: LLM-Driven Data Correction and Enrichment via Semantic Extraction of Reliability Intelligence

风力涡轮机维护日志标注框架:基于LLM驱动的数据校正与语义提取的可靠性智能增强

Max Malyi, Jonathan Shek, Alasdair McDonald, Andre Biscaya

机构 * Institute for Energy Systems, School of Engineering, The University of Edinburgh(能源系统研究所,工程学院,爱丁堡大学) Nadara, Lisbon, Portugal(纳达拉,里斯本,葡萄牙)

专题命中 软件智能体 :workflow(abstract);分类 cs.CL

AI总结 提出一种利用大语言模型自动标准化和结构化风力涡轮机维护日志的方法,通过纠正系统代码、提取故障模式与维护动作分类,将非结构化文本转化为定量可靠性指标。

Comments An adjustable template containing the Python script architecture, applied dynamic prompts, and data schemas is hosted in an open-source GitHub repository: https://github.com/mvmalyi/llm-driven-wind-turbine-maintenance-log-labelling

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16961 2026-08-19 cs.CR cs.NI cs.PF 新提交 50%

Quantum-Safe Web Service Architecture Using Time-Based One-Time Passwords

使用基于时间的一次性密码的量子安全Web服务架构

Abel C. H. Chen

专题命中 软件智能体 :agent(abstract)

AI总结 本研究开发了一种量子安全Web服务架构,采用基于后量子密码学的TLS与HTTPS保障传输安全,通过HMAC驱动的TOTP保障服务安全,并实验对比了四种哈希算法的性能以支撑部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17257 2026-08-19 astro-ph.IM astro-ph.EP 新提交 50%

The Roman Coronagraph Community Participation Program: corgisim - a simulation suite for the Nancy Grace Roman Space Telescope Coronagraph Instrument

罗马日冕仪社区参与计划:corgisim——南希·格蕾丝·罗马空间望远镜日冕仪的模拟套件

Jingwen Zhang, Sophie Noiret, Maxwell A. Millar Blanchaer, Jason Wang, Alexis Lau, Neil Zimmerman, Jessica Gersh-Range, Eric Shen, Kevin Ludwick, Taichi Uyama, Chen Xie, Vanessa P. Bailey, John Krist, Elodie Choquet, Julien Girard, Alexis Bidot, Arthur Vigan

专题命中 软件智能体 :planning(abstract)

AI总结 该研究开发了开源模拟包corgisim,作为罗马日冕仪社区参与计划的一部分,用于南希·格蕾丝·罗马空间望远镜日冕仪观测的端到端模拟,为相关任务提供数据支持与应用指导。

Comments Proceedings of SPIE Astronomical Telescopes + Instrumentation 2026 (Paper No.14145-182)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17152 2026-08-19 astro-ph.IM 新提交 50%

The Roman Coronagraph Community Participation Program: target database and tools

罗曼日冕仪社区参与计划:目标数据库与工具

Dmitry Savransky, Rifah Tasnim, Saanika Choudhary, Hovik Grigoryan, Justin Hom, Bijan Nemati, Neil Zimmerman, Ramya Anche, Nicholas Phillips, Louie Donesa, Parth Mittal, Amira Razack, Savaas Iqbal, Javier Majumdar, Schuyler G. Wolff, Vanessa P. Bailey

专题命中 软件智能体 :planning(abstract)

AI总结 针对罗曼空间望远镜日冕仪的调试与观测需求,罗曼日冕仪社区参与计划开发了含多类目标的数据库及配套工具,用于观测规划与调度。

Comments Presented at SPIE Astronomical Telescopes + Instrumentation 2026. Paper Number 14145-183

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17077 2026-08-19 astro-ph.IM 新提交 50%

The Roman Coronagraph Community Participation Program: trials and triumphs of designing an observing program for a technology demonstration instrument

罗曼日冕仪社区参与计划:为技术演示仪器设计观测计划的试验与成功实践

Schuyler G. Wolff, Vanessa P. Bailey, Justin Hom, Beth Biller, Dmitry Savransky, Julien H. Girard, Ellis Bogat, Óscar Carrión-González, Clarissa R. Do Ó, Masayuki Kuzuhara, Chen Xie, Maxwell Millar-Blanchaer, Susan Redmond, Johan Mazoyer, Macarena Vega-Pallauta, Gael Chauvin, Matthieu Ravet, Alexandra Greenbaum, Eric Cady, Ramya Anche, James Ingalls, the Roman Coronagraph Community Participation Program Team

专题命中 软件智能体 :planning(abstract)

AI总结 该研究介绍罗曼日冕仪社区参与计划过去两年的活动,重点为罗曼望远镜初始在轨校验及观测首六个月做观测规划,还阐述了天文界后续参与公开数据研究的未来机会。

Comments Submitted to SPIE Astronomical Telescopes + Instrumentation 2026 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 8 篇

2608.17319 2026-08-19 cs.AI 新提交 91%

Wuying-Browser-Agent: Real-World Centric Fundamental Long-Horizon Browser Agents

Wuying-Browser-Agent:以真实场景为中心的基础长时程浏览器智能体

AIMAE Team, Tianxiang Chen, Yan Cheng, Zhangye Han, Xiaowei Li, Chang Liu, Cheng Liu, Zhongqiang Ma, Long Peng, Xiaobing Tu, Yinggui Wang, Hongliang Wei, Chen Wu, Daiping Xin, Kunyu Zhou, Pengyang Zhou, Peiyuan Chen, Ziyuan Chen, Yutao Deng, Chunyu Dong, Xiangyu Fu, Yicheng Feng, Ruian He, Haochen Li, Miancan Liu, Zhengqin Liu, Wei Peng, Jinkui Ren, Haoyu Tan, Dong Xiao, Rongkun Xue, Shujian Yang, Xianhang Ye, Ziqi Yuan, Ziyang Yu, Linghan Zhang, Xiantao Zhang, Xuanpu Zhao, Yinan Zhao, Zhenghui Zhao, Bin Zhu, Likai Zou

机构 * Alibaba Cloud(阿里云) End-User Intelligent Computing BU(终端用户智能计算业务部) AI Model Application & Engineering Team(AI模型应用与工程团队)

专题命中 GUI与网页智能体 :agent(title,title_cn);agentic(abstract);分类 cs.AI

AI总结 本文提出Wuying-Browser-Agent统一框架,通过多层面技术对齐解决浏览器智能体实际部署问题,在多项基准取得最优成绩,且具备通用智能体迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18046 2026-08-19 cs.LG 版本更新 79%

SEE: Structure-aware Exploring & Exploiting for Long-horizon GUI Agent Trajectory Synthesis

SEE:用于长视野GUI代理轨迹合成的结构感知探索与利用

Zhuohang Fan, Beichen Zhang, Yuanfa Li, Changqiao Wu, Wei Liu, Jian Luan, Weigang Zhang

机构 * Harbin Institute of Technology, Weihai(哈尔滨工业大学(威海)) Harbin Institute of Technology (Weihai) Qingdao Research Institute(哈尔滨工业大学(威海)青岛研究院)

专题命中 GUI与网页智能体 :agent(title);planning(abstract);分类 cs.LG

AI总结 针对GUI代理轨迹合成中缺乏高覆盖率长视野轨迹的问题,提出SEE两阶段数据合成框架,通过高效探索和基于图的合成,产生可重复可解释数据,避免虚假循环,提升代理任务成功率和泛化能力,还将发布代码和数据集。

Comments Accepted (Oral) by ACM International Conference on Multimedia 2026 (ACM MM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17659 2026-08-19 cs.CR cs.AI 新提交 74%

MobileWorldSafety: Benchmarking GUI Agent Safety Against Environmental Injection Attacks in Android Apps

MobileWorldSafety:针对安卓应用中环境注入攻击的GUI智能体安全基准

Sujin Chen, Lijun Li, Tianyi Du, Jing Shao

专题命中 GUI与网页智能体 :agent(title);分类 cs.AI

AI总结 该研究推出MobileWorldSafety基准,基于142个真实安卓应用风险任务评估6种GUI智能体,发现其对环境注入攻击的成功率达40.4%-66.9%,为相关研究奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07459 2026-08-19 cs.RO cs.CV 版本更新 71%

EmbodiedGen V2: An Agentic, Simulation-Ready 3D World Engine for Embodied AI

EmbodiedGen V2:用于具身人工智能的具有智能体特性、可用于模拟的3D世界引擎

Xinjie Wang, Liu Liu, Taojun Ding, Andrew Choi, Chaodong Huang, Mengao Zhao, Ziang Li, Jackson Jiang, Chunlei Yu, Shengxiang Liu, Wei Xu, Zhizhong Su

机构 * Horizon Robotics(地平线机器人) WuwenAI(悟文智能)

专题命中 GUI与网页智能体 :agentic(title)

AI总结 研究提出EmbodiedGen V2这个用于具身智能的3D世界引擎,通过统一表示解决资产组装问题。其生成环境支持多种任务,评估中资产管道表现良好,强化学习提升了模拟成功率,确立了它作为可扩展模拟基础设施的地位。

Comments Project page: horizonrobotics.github.io/EmbodiedGen

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17512 2026-08-19 cs.RO 新提交 67%

Embodied-Navigator: Point, Think, Memorize, and Align for Efficient Navigation

具身导航器:指向、思考、记忆与对齐以实现高效导航

Hongyan Feng, Sunlai Chen, Xuanyu Liu, Miao Pan, Yangfan Xie, Yuxiang Cui, Zhongxiang Zhou, Rong Xiong, Wenqi Zhang, Jianwei Yin, Yueting Zhuang, Xuhong Zhang

机构 * ZJU(浙江大学)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 本研究提出具身导航框架TAMP-Nav,通过像素转3D动作、选择性推理记忆与GRPO两级对齐,在R2R-CE数据集上实现66.2% SR,仅需90k训练轨迹,达成高效具身导航的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17703 2026-08-19 cs.RO cs.AI math.OC 新提交 57%

Dijkstra as an Oracle for Online Stochastic Shortest Path Navigation with Provable Guarantees

作为具有可证保证的在线随机最短路径导航的神谕的Dijkstra算法

Mansur M. Arief, Ali Akarma, Ahmad Alfan Alfian Irfan

机构 * King Fahd University of Petroleum and Minerals (KFUPM)(法赫德国王石油与矿产大学) Islamic University of Madinah(麦地那伊斯兰大学) Universitas Muhammadiyah Yogyakarta(日惹穆罕默迪亚大学)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 本研究提出DORA算法,基于Dijkstra算法的可证保证特性,实现高效安全的在线随机最短路径导航,性能与最优值迭代相当且规划工作量显著减少,接触率满足预算要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16024 2026-08-19 cs.AI 版本更新 57%

ScreenSearch: Uncertainty-Aware OS Exploration

ScreenSearch: 带有不确定性的操作系统探索

Michael Solodko, Justin Wagle

机构 * Microsoft(微软)

专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.AI

AI总结 ScreenSearch通过结合结构化屏幕检索与基于不确定性的PUCT图强化学习,在大规模桌面探索中有效平衡探索与承诺,生成具有跨应用多样性的探索语料库。

Comments 22 pages, 8 figures, 21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17318 2026-08-19 cs.CV cs.RO 新提交 50%

If, Then, Otherwise: Diagnosing Conditional Branching in Vision-Language Navigation

如果、那么、否则:诊断视觉-语言导航中的条件分支

Seoyoung Lee, Neel P. Bhatt, Pranay Samineni, Cong Liu, S P Sharan, Timothy Barclay, Gregory M. Wagner, Daniel Milan, Sandeep Chinchali, Ufuk Topcu, Atlas Wang

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Collins Aerospace(柯林斯航空航天公司)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 针对视觉-语言导航智能体的条件分支诊断需求,提出基于场景图的基准CondVLN及轻量级神经符号分支选择模型,可暴露智能体的逻辑决策失败并提升性能2倍。

Comments 11 pages, 1 figure, 3 tables. Project page: https://condvln.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 13 篇

2606.03895 2026-08-19 cs.OS cs.AI cs.CR 版本更新 90%

Agent libOS: A Runtime Substrate for Capability-Controlled Self-Evolving LLM Agents

Agent libOS: 一种受库操作系统启发的运行时,用于长时间运行、能力受控的LLM智能体

Yingqi Zhang

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 记忆与上下文管理 :agent(title,title_cn);分类 cs.AI

AI总结 提出Agent libOS运行时,将LLM智能体建模为具有进程标识、生命周期、能力控制和审计记录的AgentProcess,通过类似libc的工具包装和运行时原语边界实现安全调度与资源控制。

Comments 20 pages, 3 figures, 7 tables. Project page: https://github.com/yingqi-z20/Agent-libOS

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17007 2026-08-19 cs.AI 新提交 83%

SkillEffect: Checked Lowering for Memory-Bounded Agent Tools

SkillEffect:面向内存受限智能体工具的经校验的降阶机制

Yinuo Wang, Yiyu Shi

机构 * Sichuan University(四川大学) University of Notre Dame(圣母大学)

专题命中 记忆与上下文管理 :agent(title,abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出SkillEffect架构,通过经校验降阶运行时与独立校验器,在智能体工具调度时强制实施异构内存关系,可降低峰值内存并提升固定内存上限下的任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17684 2026-08-19 cs.AI 新提交 81%

Auditing Self-Evolution in Financial Agents: Capability Gains, Security Drift, and Execution-Interface Mismatch

金融智能体的自我进化审计:能力提升、安全漂移与执行接口不匹配

Jialong Li, Jialing Zhu

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);workflow(abstract,abstract_cn);分类 cs.AI

AI总结 该研究通过模拟电子银行环境审计SkillOpt、AWM、ReasoningBank等自我进化金融智能体,发现仅靠准确率评估不足,需跟踪退化、攻击面接触等指标,且AWM存在执行接口不匹配的评估风险。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17209 2026-08-19 cs.RO cs.AI cs.CV cs.LG 新提交 81%

Teach and Grow: An Agent-Centered Architecture for General Robot Learning

教学与成长:面向通用机器人学习的智能体中心架构

Chang Nie, Zhe Liu, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究提出TGL智能体中心架构,通过将演示转化为可复用技能块,无需特定任务再训练即可实现通用机器人学习,在LIBERO评估中达SOTA性能,还提出相关缩放定律假设。

详情

展开后加载摘要…

URL PDF HTML 收藏