arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-17 至 2026-02-17 共收录 211 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 9 篇

2602.13653 2026-02-17 cs.AI cs.CL cs.CV cs.HC 84%

Building Autonomous GUI Navigation via Agentic-Q Estimation and Step-Wise Policy Optimization

通过代理-Q估计和分步策略优化构建自主GUI导航

Yibo Wang, Guangda Huzhang, Yuwei Hu, Yu Xia, Shiyin Lu, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang, Lijun Zhang

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Ovis Team, Alibaba Group(阿里团队,阿里巴巴集团)

专题命中 GUI与网页智能体 :agentic(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出基于代理-Q估计和分步策略优化的GUI自主导航框架,通过强化学习提升GUI交互能力,实验证明其在导航和基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13516 2026-02-17 cs.AI 83%

SPILLage: Agentic Oversharing on the Web

SPILLage:网络上的代理过度分享

Jaechul Roh, Eugene Bagdasarian, Hamed Haddadi, Ali Shahin Shamsabadi

专题命中 GUI与网页智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 SPILLage研究网络代理在执行任务时无意泄露用户信息的问题,通过分析行为和内容两个维度揭示过度分享现象,并通过实验验证减少过度分享可提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14093 2026-02-17 cs.AI cs.LG 81%

GUI-GENESIS: Automated Synthesis of Efficient Environments with Verifiable Rewards for GUI Agent Post-Training

GUI-GENESIS: 自动合成具有可验证奖励的高效环境以实现GUI代理训练

Yuan Cao, Dezhi Ran, Mengzhou Wu, Yuzhe Guo, Xin Chen, Ang Li, Gang Cao, Gong Zhi, Hao Yu, Linyi Li, Wei Yang, Tao Xie

机构 * Key Lab of HCST (PKU), MOE SCS, Peking University, Beijing, China Tencent Inc., Shenzheng, China Hong Kong University of Science Department of Computer Science, University of Texas at Dallas, Richardson, USA School of Computing Science, Simon Fraser University, Burnaby, BC, Canada

专题命中 GUI与网页智能体 :agent(title);planning(abstract);分类 cs.AI、cs.LG

AI总结 GUI-GENESIS通过自动合成高效GUI训练环境并提供可验证奖励,显著提升了GUI代理的训练效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14721 2026-02-17 cs.AI 74%

WebWorld: A Large-Scale World Model for Web Agent Training

WebWorld: 一个大规模的世界模型用于网络代理训练

Zikai Xiao, Jianhong Tu, Chuhang Zou, Yuxin Zuo, Zhi Li, Peng Wang, Bowen Yu, Fei Huang, Junyang Lin, Zuozhu Liu

机构 * Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学)

专题命中 GUI与网页智能体 :agent(title);分类 cs.AI

AI总结 WebWorld是一个大规模开放网络模拟器,通过大规模训练实现网络代理的有效训练,展示了在多个领域中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14865 2026-02-17 cs.AI cs.SE 62%

EmbeWebAgent: Embedding Web Agents into Any Customized UI

EmbeWebAgent:将Web代理嵌入到任何定制的UI中

Chenyang Ma, Clyde Fare, Matthew Wilson, Dave Braines

机构 * IBM Research Europe(IBM欧洲研究院) University of Oxford(牛津大学)

专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 EmbeWebAgent通过轻量前端钩子和可重用后端工作流,将Web代理嵌入定制UI,支持混合粒度动作并实现鲁棒的多步骤行为。

Comments Technical Report; Live Demo: https://youtu.be/Cy06Ljee1JQ

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05354 2026-02-17 cs.AI 57%

PATHWAYS: Evaluating Investigation and Context Discovery in AI Web Agents

PATHWAYS:评估人工智能网络代理中的调查与上下文发现

Shifat E. Arman, Syed Nazmus Sakib, Tapodhir Karmakar Taton, Nafiul Haque, Shahrear Bin Amin

机构 * Robotics and Mechatronics Engineering, University of Dhaka, Dhaka, Bangladesh(机器人与机电工程系,达卡大学,达卡,孟加拉国)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 PATHWAYS评估了人工智能网络代理在多步骤任务中发现和利用隐藏上下文的能力,揭示了当前架构在适应性调查和判断覆盖方面的不足。

Comments 35 pages, 13 figures

Journal ref Under Review in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14831 2026-02-17 cs.HC 50%

Robot-Wearable Conversation Hand-off for Navigation

机器人可穿戴对话切换用于导航

Dániel Szabó, Aku Visuri, Benjamin Tag, Simo Hosio

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出通过对话切换实现多设备室内导航,发现可穿戴设备更受用户青睐,强调了具身AI在人机交互中的作用。

Comments To appear in Proceedings of Augmented Humans International Conference (AHs 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13277 2026-02-17 cs.NI cs.DC 50%

Intent-driven Diffusion-based Path for Mobile Data Collector in IoT-enabled Dense WSNs

基于意图的扩散路径:物联网密集WSN中的移动数据收集器路径规划

Uma Mahesh Boda, Mallikharjuna Rao Nuka

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出ID2P2框架,通过意图驱动的扩散路径规划,提升物联网密集WSN中移动数据收集器的能效、数据新鲜度和网络公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 记忆与上下文管理 13 篇

2602.13258 2026-02-17 cs.AI cs.CL cs.MA 87%

MAPLE: A Sub-Agent Architecture for Memory, Learning, and Personalization in Agentic AI Systems

MAPLE:一种用于代理AI系统中记忆、学习和个性化的核心架构

Deepak Babu Piskala

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(title);分类 cs.AI、cs.CL

AI总结 MAPLE通过分解记忆、学习和个性化为独立子代理,提升代理AI系统的个性化能力,实验显示在个性化得分和特征纳入率上有显著提升。

Comments 12 pages, 5 figures. Accepted to ALA Workshop at AAMAS 2026. Code: [](https://github.com/prdeepakbabu/maple-framework)<https://github.com/prdeepakbabu/maple-framework>

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13594 2026-02-17 cs.AI 79%

Hippocampus: An Efficient and Scalable Memory Module for Agentic AI

海马体:一种高效且可扩展的记忆模块用于代理AI

Yi Li, Lianjie Cao, Faraz Ahmed, Puneet Sharma, Bingzhe Li

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 海马体通过紧凑二进制签名和动态小波矩阵实现高效代理AI记忆管理,显著降低检索延迟和token足迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14951 2026-02-17 cs.CY cs.HC 75%

Sovereign Agents: Towards Infrastructural Sovereignty and Diffused Accountability in Decentralized AI

主权代理:迈向去中心化AI中的基础设施主权与扩散问责

Botao Amber Hu, Helena Rong

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);agentic(abstract)

AI总结 本文探讨去中心化AI中基础设施主权的概念,分析其与扩散问责的关系,并提出治理策略以应对非终止AI代理带来的挑战。

Comments Submitted to FAccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14457 2026-02-17 cs.AI cs.CL cs.CV cs.CY cs.LG 67%

Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report v1.5

实践中的前沿AI风险管理框架:一项风险分析技术报告v1.5

Dongrui Liu, Yi Yu, Jie Zhang, Guanxu Chen, Qihao Lin, Hanxi Zhu, Lige Huang, Yijin Zhou, Peng Wang, Shuai Shao, Boxuan Zhang, Zicheng Liu, Jingwei Sun, Yu Li, Yuejin Xie, Jiaxuan Guo, Jia Xu, Chaochao Lu, Bowen Zhou, Xia Hu, Jing Shao

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出实践中的前沿AI风险管理框架,评估五个关键风险维度并提出缓解策略,为安全部署前沿AI提供技术路径。

Comments 49 pages, 17 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14296 2026-02-17 cs.AI cs.SE 62%

AutoWebWorld: Synthesizing Infinite Verifiable Web Environments via Finite State Machines

AutoWebWorld: 通过有限状态机合成无限可验证的网页环境

Yifan Wu, Yiran Peng, Yiyu Chen, Jianhao Ruan, Zijie Zhuang, Cheng Yang, Jiayi Zhang, Man Chen, Yenchi Tseng, Zhaoyang Yu, Liang Chen, Yuyao Zhai, Bang Liu, Chenglin Wu, Yuyu Luo

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Peking University(北京大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.SE

AI总结 AutoWebWorld通过有限状态机合成可验证的网页环境,实现自动化搜索与验证流程,提升WebGUI代理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14293 2026-02-17 cs.LG cs.AI 62%

KernelBlaster: Continual Cross-Task CUDA Optimization via Memory-Augmented In-Context Reinforcement Learning

KernelBlaster: 通过记忆增强的上下文强化学习实现持续的跨任务CUDA优化

Kris Shengjun Dong, Sahil Modi, Dima Nikiforov, Sana Damani, Edward Lin, Siva Kumar Sastry Hari, Christos Kozyrakis

机构 * NVIDIA University of California, Berkeley(加州大学伯克利分校)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 KernelBlaster通过记忆增强的上下文强化学习框架提升CUDA代码优化性能,实现跨多个GPU架构世代的高效优化。

Comments 15 pages, 33 pages with appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14038 2026-02-17 cs.AI cs.LG 62%

Choosing How to Remember: Adaptive Memory Structures for LLM Agents

选择如何记忆:面向LLM代理的自适应记忆结构

Mingfei Lu, Mengjia Wu, Feng Liu, Jiawei Xu, Weikai Li, Haoyang Wang, Zhengdong Hu, Ying Ding, Yizhou Sun, Jie Lu, Yi Zhang

机构 * University of Technology Sydney(悉尼大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of California, Los Angeles(加州大学洛杉矶分校) The University of Melbourne(墨尔本大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出FluxMem框架,通过自适应记忆结构选择和三级记忆层次结构,提升LLM代理在长时间交互中的表现,实验显示平均提升9.18%和6.14%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16713 2026-02-17 cs.RO cs.AI cs.CL 62%

A Pragmatist Robot: Learning to Plan Tasks by Experiencing the Real World

务实型机器人:通过体验现实世界学习任务规划

Kaixian Qu, Guowei Lan, René Zurbrügg, Changan Chen, Christopher E. Mower, Haitham Bou-Ammar, Marco Hutter

机构 * Robotic Systems Lab, ETH Zürich(瑞士联邦理工学院机器人系统实验室) ETH AI Center, ETH Zürich(瑞士联邦理工学院人工智能中心) Huawei Noah’s Ark Lab, London, UK(华为诺亚实验室,伦敦,英国) UCL Centre for AI, London, UK(伦敦大学学院人工智能中心)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.CL

AI总结 PragmaBot 通过现实世界经验学习任务规划,利用 STM 自我反思和 RAG 提高任务成功率

Comments Accepted to RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02744 2026-02-17 cs.CL 57%

SYNAPSE: Empowering LLM Agents with Episodic-Semantic Memory via Spreading Activation

SYNAPSE:通过扩散激活实现LLM代理的片段语义记忆

Hanqi Jiang, Junhao Chen, Yi Pan, Ling Chen, Weihang You, Yifan Zhou, Ruidong Zhang, Andrea Sikora, Lin Zhao, Yohannes Abate, Tianming Liu

机构 * School of Computing, University of Georgia(佐治亚大学计算机学院) Department of Biosystems Engineering and Soil Science, University of Tennessee(田纳西大学生物系统工程与土壤科学系) Department of Biomedical Informatics, University of Colorado School of Medicine(科罗拉多医学院生物医学信息学系) Department of Biomedical Engineering, New Jersey Institute of Technology(新泽西理工学院生物医学工程系) Department of Physics and Astronomy, The University of Georgia(佐治亚大学物理与天文学系)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.CL

AI总结 SYNAPSE通过动态图与扩散激活机制,提升LLM在复杂时间序列和多跳推理任务中的性能,解决上下文隧道问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13398 2026-02-17 cs.LG q-bio.QM 57%

Accelerated Discovery of Cryoprotectant Cocktails via Multi-Objective Bayesian Optimization

通过多目标贝叶斯优化加速冻保护剂混合物的发现

Daniel Emerson, Nora Gaby-Biegel, Purva Joshi, Yoed Rabin, Rebecca D. Sandlin, Levent Burak Kara

机构 * Mechanical Engineering Department, Carnegie Mellon University(卡内基梅隆大学机械工程系) Center for Engineering in Medicine & Surgery, Department of Surgery, Massachusetts General Hospital, Harvard Medical School, and Shriners Children’s(医学与手术工程中心,外科部,麻省总医院,哈佛医学院,以及谢尔曼儿童医院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 通过多目标贝叶斯优化结合高通量筛选,高效发现同时具有高CPA浓度和高细胞存活率的冻保护剂混合物。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14390 2026-02-17 cs.NI 50%

A Q-Learning Approach for Dynamic Resource Management in Three-Tier Vehicular Fog Computing

一种用于三层车载雾计算动态资源管理的Q学习方法

Bahar Mojtabaei Ranani, Mahmood Ahmadi, Sajad Ahmadian

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出基于Q学习的动态资源管理方法,用于优化车载雾计算环境中的资源分配,通过强化学习提升系统性能和任务处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18387 2026-02-17 physics.med-ph eess.IV eess.SP q-bio.QM 50%

Quantification of dual-state 5-ALA-induced PpIX fluorescence: Methodology and validation in tissue-mimicking phantoms

双状态5-ALA诱导PpIX荧光的量化:方法学与在组织仿生假体中的验证

Silvère Ségaud, Charlie Budd, Matthew Elliot, Graeme Stasiuk, Jonathan Shapey, Yijing Xie, Tom Vercauteren

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本研究提出了一种用于量化胶质瘤中PpIX荧光的新方法,通过组织仿生假体验证,实现了高精度的PpIX荧光成像。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15335 2026-02-17 math.DS math.AP 50%

Impact of memory on clustering in spontaneous particle aggregation

记忆对自发粒子聚集中聚类的影响

Radek Erban, Jan Haskovec

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 研究发现记忆影响自发聚集中的聚类形态,短期记忆促进聚类形成,长期记忆抑制聚集并增加孤立个体比例。

Comments 27 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Agent评测 37 篇

2602.13999 2026-02-17 cs.RO 88%

It Takes Two to Tango: A Holistic Simulator for Joint Order Scheduling and Multi-Agent Path Finding in Robotic Warehouses

双人探戈也需要两人:一种综合模拟器用于机器人仓库中的联合订单调度和多智能体路径寻找

Haozheng Xu, Wenhao Li, Zifan Wei, Bo Jin, Hongxing Bai, Ben Yang, Xiangfeng Wang

机构 * East China Normal University(东华大学) Tongji University(同济大学) Zhejiang Galaxis Technology Group Co.,Ltd(浙江伽利西科技集团有限公司) Shenzhen Loop Area Institute (SLAI)(深圳环 area 研究院)

专题命中 Agent评测 :agent(title,abstract);multi-agent(title,abstract)

AI总结 WareRover是一种综合模拟器,通过闭环优化接口紧密耦合订单调度与多智能体路径寻找,为机器人仓库的鲁棒协调提供挑战性测试环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13808 2026-02-17 cs.AI cs.SE 81%

An end-to-end agentic pipeline for smart contract translation and quality evaluation

面向智能合约翻译和质量评估的端到端代理流程

Abhinav Goel, Chaitya Shah, Agostino Capponi, Alfio Gliozzo

机构 * Columbia University(哥伦比亚大学) IBM T.J. Watson Research Center(IBM T.J.沃森研究中心)

专题命中 Agent评测 :agentic(title);agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出端到端智能合约翻译与质量评估框架,通过代理团队实现结构化输出与多维度质量评估。

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14970 2026-02-17 cs.CL 79%

Counterfactual Fairness Evaluation of LLM-Based Contact Center Agent Quality Assurance System

基于大语言模型的客服代理质量保障系统的反事实公平性评估

Kawin Mayilvaghanan, Siddhant Gupta, Ayush Kumar

专题命中 Agent评测 :agent(title,abstract);分类 cs.CL

AI总结 本文研究了基于大语言模型的客服代理质量保障系统在公平性方面的表现,发现系统性偏见问题,指出需标准化的公平性审计流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16443 2026-02-17 cs.LG cs.CL 79%

Endless Terminals: Scaling RL Environments for Terminal Agents

无尽终端:为终端智能体扩展强化学习环境

Kanishk Gandhi, Shivam Garg, Noah D. Goodman, Dimitris Papailiopoulos

机构 * Stanford University(斯坦福大学) Microsoft Research(微软研究院) UW-Madison(威斯康星大学麦迪逊分校)

专题命中 Agent评测 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 Endless Terminals 通过自动化生成终端任务并训练智能体,显著提升了在终端基准测试和人工整理基准测试上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14391 2026-02-17 cs.NI 78%

ASA: Adaptive Smart Agent Federated Learning via Device-Aware Clustering for Heterogeneous IoT

ASA: 通过设备感知聚类实现异构物联网的自适应智能代理联邦学习

Ali Salimi, Saadat Izadi, Mahmood Ahmadi, Hadi Tabatabaee Malazi

专题命中 Agent评测 :agent(title,abstract)

AI总结 ASA通过设备感知聚类实现异构物联网的自适应智能代理联邦学习,提升效率、可扩展性和公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13832 2026-02-17 cs.CL 74%

Beyond Words: Evaluating and Bridging Epistemic Divergence in User-Agent Interaction via Theory of Mind

超越词语:通过心灵理论评估和弥合用户代理交互中的认知分歧

Minyuan Ruan, Ziyue Wang, Kaiming Liu, Yunghwei Lai, Peng Li, Yang Liu

机构 * Dept. of Comp. Sci. \& Tech., Institute for AI, Tsinghua University, Beijing, China Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China

专题命中 Agent评测 :agent(title);分类 cs.CL

AI总结 本文提出通过心灵理论评估和弥合用户代理交互中的认知分歧,通过强化学习提升模型对用户心理状态的推理能力,从而增强下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13275 2026-02-17 cs.AI cs.CL 73%

Artificial Organisations

人工组织

William Waites

机构 * University of Southampton(南安普顿大学)

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出通过机构设计实现多智能体AI系统可靠性的方法,通过信息隔离和对抗性审查,使不可靠个体组件产生可靠集体行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14364 2026-02-17 cs.CR cs.AI 70%

A Trajectory-Based Safety Audit of Clawdbot (OpenClaw)

基于轨迹的安全性审计:Clawdbot(OpenClaw)

Tianyu Chen, Dongrui Liu, Xia Hu, Jingyi Yu, Wenjie Wang

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 Clawdbot的安全性审计通过轨迹评估发现其在不同任务中的安全表现不均,尤其在意图不明确时易出现高影响工具操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14270 2026-02-17 cs.CY cs.AI cs.HC 70%

A Rational Analysis of the Effects of Sycophantic AI

对趋炎附势AI影响的理性分析

Rafael M. Batista, Thomas L. Griffiths

机构 * School of Public and International Affairs, Princeton University(公共与国际事务学院,普林斯顿大学) Princeton University(普林斯顿大学) Department of Psychology, Princeton University(心理学系,普林斯顿大学)

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文研究了趋炎附势AI对信念的影响,通过实验发现无偏采样能显著提高发现率,而顺从反馈会扭曲现实,制造虚假确定性。

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏