arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5090 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5090 篇

2604.11587 2026-04-14 cs.RO 78%

Optimal Kinodynamic Motion Planning Through Anytime Bidirectional Heuristic Search with Tight Termination Condition

通过具有紧密终止条件的 anytime 双向启发式搜索进行最优的运动规划

Yi Wang, Bingxian Mu, Shahab Shokouhi, May-Win Thein

机构 * University of New Hampshire(新罕布什尔大学) University of Prince Edward Island(爱德华王子岛大学)

专题命中 工具调用 :planning(title,abstract)

AI总结 本文提出 BTIT* 算法,结合 anytime 双向启发式搜索,确保 meet-in-the-middle 属性和最优性,实验显示其在两个动力学基准上比非懒惰知情批量规划器更快收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07765 2026-04-14 cs.CV 78%

RemoteAgent: Bridging Vague Human Intents and Earth Observation with RL-based Agentic MLLMs

RemoteAgent: 通过基于强化学习的代理多模态大语言模型弥合模糊人类意图与遥感观测之间的鸿沟

Liang Yao, Shengxiang Xu, Fan Liu, Chuanyi Zhang, Bishun Yao, Rui Min, Yongjun Li, Chaoqian Ouyang, Shimin Di, Min-Ling Zhang

机构 * Hohai University(河海大学) Southeast University(东南大学) Sun Yat-sen University(中山大学)

专题命中 工具调用 :agentic(title,abstract)

AI总结 本文提出RemoteAgent框架,通过VagueEO数据集和强化学习微调,使多模态大语言模型能直接解决图像和稀疏区域任务,并通过模型上下文协议智能协调专用工具进行密集预测,提升遥感任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08407 2026-04-10 cs.CR 78%

Your Agent Is Mine: Measuring Malicious Intermediary Attacks on the LLM Supply Chain

你的代理是我的:测量对LLM供应链的恶意中间人攻击

Hanzhi Liu, Chaofan Shou, Hongbo Wen, Yanju Chen, Ryan Jingyang Fang, Yu Feng

专题命中 工具调用 :agent(title,abstract)

AI总结 研究针对LLM供应链中恶意中间人攻击的系统性分析,提出两种核心攻击类型及适应性规避变种,通过实验发现多个路由器存在恶意注入和秘密外泄行为,并评估了三种客户端防御措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07146 2026-04-10 cs.CV 78%

Learning to Search: A Decision-Based Agent for Knowledge-Based Visual Question Answering

学习搜索:一种基于决策的知识增强视觉问答代理

Zhuohong Chen, Zhenxian Wu, Yunyao Yu, Hangrui Xu, Zirui Liao, Zhifang Liu, Xiangwen Deng, Pen Jiao, Haoqian Wang

机构 * Tsinghua University(清华大学) University of Arizona(亚利桑那大学) Hefei University of Technology(合肥工业大学)

专题命中 工具调用 :agent(title,abstract)

AI总结 本文提出基于决策的KB-VQA代理,通过多步骤决策过程解决视觉问答问题,改进检索与推理整合,提升对稀有实体和长尾事实的处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26085 2026-04-10 cs.IR 78%

AgenticRS-Architecture: System Design for Agentic Recommender Systems

AgenticRS-Architecture:面向代理推荐系统的系统设计

Hao Zhang, Jinxin Hu, Hao Deng, Lingyu Mu, Shizhun Wang, Yu Zhang, Xiaoyi Zeng

专题命中 工具调用 :agentic(title);agent(abstract)

AI总结 本文提出AgenticRS架构,通过交互式进化代理实现推荐系统全生命周期自动化,核心模块包括AutoTrain、AutoFeature和AutoPerf,实现模型、特征和资源的自适应演化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04989 2026-04-08 cs.CR 78%

SkillAttack: Automated Red Teaming of Agent Skills through Attack Path Refinement

SkillAttack:通过攻击路径细化实现对代理技能的自动化红队测试

Zenghao Duan, Yuxin Tian, Zhiyi Yin, Liang Pang, Jingcheng Deng, Zihao Wei, Shicheng Xu, Yuyao Ge, Xueqi Cheng

专题命中 工具调用 :agent(title,abstract)

AI总结 本文提出SkillAttack框架,通过对抗性提示动态验证技能漏洞可利用性,实验显示其在对抗性技能和真实场景中均显著优于基线方法,揭示了即使善意技能在实际代理交互中也存在严重安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04826 2026-04-07 cs.RO 78%

Efficient Multi-Objective Planning with Weighted Maximization Using Large Neighbourhood Search

基于大邻域搜索的加权最大化多目标规划高效方法

Krishna Kalavadia, Shamak Dutta, Yash Vardhan Pant, Stephen L. Smith

机构 * University of Waterloo(滑铁卢大学)

专题命中 工具调用 :planning(title,abstract)

AI总结 本文提出基于大邻域搜索的新型算法,高效解决加权最大化规划问题,在保持解质量的同时将运行时间提升1-2个数量级,适用于自主导航中的多目标优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04543 2026-04-07 cs.MA cs.LO 78%

Statistical Model Checking of the Island Model: An Established Economic Agent-Based Model of Endogenous Growth

岛屿模型的统计模型检验:一个内生增长的已确立经济基于代理模型

Stefano Blando, Giorgio Fagiolo, Daniele Giachini, Andrea Vandin, Ernest Ivanaj

专题命中 工具调用 :agent(title,abstract)

AI总结 本文利用统计模型检验方法对岛屿模型进行分析,验证了模型的关键特征,并展示了其在内生增长研究中的应用价值。

Comments In Proceedings MARS 2026, arXiv:2604.03053

Journal ref EPTCS 443, 2026, pp. 3-22

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01014 2026-04-02 cs.CR cs.CV 78%

AutoMIA: Improved Baselines for Membership Inference Attack via Agentic Self-Exploration

AutoMIA:通过代理自我探索改进的成员推断攻击基线

Ruhao Liu, Weiqi Huang, Qi Li, Xinchao Wang

专题命中 工具调用 :agentic(title,abstract)

AI总结 AutoMIA通过代理自我探索和策略进化,改进成员推断攻击基线,实现模型无关的攻击空间系统遍历,优于现有方法且无需手动特征工程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27075 2026-03-31 cs.CY 78%

Mind The Gap: How The Technical Mechanism Of Agentic AI Outpace Global Legal Frameworks

注意差距:代理AI的技术机制如何超越全球法律框架

Marcel Osmond, Thomas Jego

专题命中 工具调用 :agentic(title,abstract)

AI总结 本文首次比较了各机构对代理AI的定义,揭示技术不准确之处,提出综合开发者文档的共识技术定义,并探讨定义差距导致监管工具无法有效治理代理自主性机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25893 2026-03-30 cs.GT cs.CY 78%

Agentic Markets: Equilibrium Effects of Improving Consumer Search

代理市场:改进消费者搜索的均衡效应

Brendan Lucier, Nicole Immorlica, Markus Mobius, Aleksandrs Slivkins, Daniel G. Goldstein, Jake M. Hofman, Sonia Jaffe, David M. Rothschild

专题命中 工具调用 :agentic(title,abstract)

AI总结 本文研究了改进搜索技术对市场学习和福利的影响,发现更便宜的搜索提升学习和消费者剩余,但更信息性的搜索可能因削弱企业间竞争而降低消费者剩余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20625 2026-03-24 cs.CR 78%

ACRFence: Preventing Semantic Rollback Attacks in Agent Checkpoint-Restore

ACRFence:防止代理检查点-恢复中的语义回滚攻击

Yusheng Zheng, Yiwei Yang, Wei Zhang, Andi Quinn

专题命中 工具调用 :agent(title,abstract)

AI总结 本文提出ACRFence,一种防止代理检查点-恢复中语义回滚攻击的通用解决方案,通过记录不可逆工具效果并强制回放或分叉语义,以应对代理恢复后请求重新生成导致的重复支付和凭证滥用问题。

Journal ref CoDAIM workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17239 2026-03-19 cs.CR 78%

LAAF: Logic-layer Automated Attack Framework A Systematic Red-Teaming Methodology for LPCI Vulnerabilities in Agentic Large Language Model Systems

LAAF:逻辑层自动攻击框架:一种针对代理大语言模型系统中LPCI漏洞的系统性红队方法

Hammad Atta, Ken Huang, Kyriakos Rock Lambros, Yasir Mehmood, Zeeshan Baig, Mohamed Abdur Rahman, Manish Bhatt, M. Aziz Ul Haq, Muhammad Aatif, Nadeem Shahzad, Kamal Noor, Vineeth Sai Narajala, Hazem Ali, Jamel Abed

专题命中 工具调用 :agentic(title,abstract)

AI总结 LAAF是首个结合特定技术分类和分阶段种子升级的自动化红队框架,通过49种技术分类生成大量独特负载,并通过持久化阶段突破器实现分阶段负载变异,有效提升阶段突破效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17055 2026-03-19 cs.CV 78%

PaAgent: Portrait-Aware Image Restoration Agent via Subjective-Objective Reinforcement Learning

PaAgent:通过主观-客观强化学习实现的面向人物图像修复代理

Yijian Wang, Qingsen Yan, Jiantao Zhou, Duwei Dai, Wei Dong

机构 * School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院) Shenzhen Research Institute of Northwestern Polytechnical University(西北工业大学深圳研究院) State Key Laboratory of Internet of Things for Smart City, University of Macau(澳门大学智慧城市物联网国家重点实验室) National-Local Joint Engineering Research Center of Biodiagnosis and Biotherapy, the Second Affiliated Hospital of Xi’an Jiaotong University(西安交通大学生物诊断与生物治疗国家地方联合工程研究中心) College of Information and Control Engineering, Xi’an University of Architecture and Technology(西安建筑科技大学信息与控制工程学院)

专题命中 工具调用 :agent(title,abstract)

AI总结 PaAgent通过结合自进化的人物银行和检索增强生成技术,提升图像修复任务中对复杂场景的感知能力,通过主观-客观强化学习策略优化修复工具选择,实验验证其在多种修复基准上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02989 2026-03-05 cs.RO 78%

CASSR: Continuous A-Star Search through Reachability for real time footstep planning

CASSR:通过可达性进行实时步态规划的连续A*搜索

Jiayi Wang, Steve Tonneau

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) University of Edinburgh(爱丁堡大学)

专题命中 工具调用 :planning(title,abstract)

AI总结 CASSR通过连续A*搜索结合EPA启发式方法,实现双足机器人高效实时步态规划,性能优于传统A*和MIP求解器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21368 2026-02-26 cs.LG cs.AI cs.CL stat.ML 78%

Black-Box Reliability Certification for AI Agents via Self-Consistency Sampling and Conformal Calibration

通过自一致性采样和置信校准实现AI代理的黑盒可靠性认证

Charafeddine Mouzouni

机构 * OPIT -- Open Institute of Technology(开放技术研究所)

专题命中 工具调用 :AI agent(title);分类 cs.AI、cs.CL、cs.LG

AI总结 本文通过自一致性采样和置信校准方法,为AI系统提供可靠性评估,验证了其在不同任务和数据上的有效性,并展示了降低API成本的应用价值。

Comments 41 pages, 11 figures, 10 tables, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19514 2026-02-24 cs.CR cs.HC 78%

Security Risks of AI Agents Hiring Humans: An Empirical Marketplace Study

AI代理雇佣人类的安全风险:一项实证市场研究

Pulak Mehta

专题命中 工具调用 :AI agent(title,abstract)

AI总结 本文通过实证研究揭示了AI代理通过市场平台雇佣人类时存在的安全风险,发现32.7%的赏金来自自动化渠道,识别出六种可购买的滥用类型,并指出现有基本防御措施的缺失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13179 2026-02-16 cs.IR 78%

Fix Before Search: Benchmarking Agentic Query Visual Pre-processing in Multimodal Retrieval-augmented Generation

在搜索前修复:多模态检索增强生成中代理查询视觉预处理的基准测试

Jiankun Zhang, Shenglai Zeng, Kai Guo, Xinnan Dai, Hui Liu, Jiliang Tang, Yi Chang

专题命中 工具调用 :agentic(title,abstract)

AI总结 本文提出V-QPP-Bench,通过代理决策任务评估视觉查询预处理的改进,揭示视觉不完美对检索性能的严重影响及训练方法的优化潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19346 2026-01-28 cs.CE 78%

GeoSSA: Geometric Sparrow Search Algorithm for UAV Path Planning and Engineering Design Optimization

GeoSSA:用于无人机路径规划和工程设计优化的几何乌鸦算法

Junhao Wei, Wenxuan Zhu, Qingyang Xu, Yanxiao Li, Yifu Zhao, Zikun Li, Ran Zhang, Yanzhao Gu, Jinhong Song, Yapeng Wang, Zhiwen Wang, Ngai Cheong, Sio-Kei Im, Xu Yang

专题命中 工具调用 :planning(title,abstract)

AI总结 GeoSSA通过改进的乌鸦算法优化方法,在无人机路径规划和工程设计中实现了高效且稳定的优化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17548 2026-01-27 cs.CR 78%

Prompt Injection Attacks on Agentic Coding Assistants: A Systematic Analysis of Vulnerabilities in Skills, Tools, and Protocol Ecosystems

针对代理编码助手的提示注入攻击:对技能、工具和协议生态系统漏洞的系统分析

Narek Maloyan, Dmitry Namiot

专题命中 工具调用 :agentic(title,abstract)

AI总结 本文系统分析了代理编码助手的提示注入攻击漏洞,提出三维分类法并揭示防御不足,强调需架构级防护而非碎片化措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11958 2026-01-21 q-fin.GN q-fin.PM q-fin.TR 78%

Autonomous Market Intelligence: Agentic AI Nowcasting Predicts Stock Returns

自主市场智能:代理AI现在预测股票回报

Zefeng Chen, Darcy Pu

专题命中 工具调用 :agentic(title,abstract)

AI总结 该研究利用自主AI预测股票回报,发现AI在识别顶级赢家方面具有选股能力,但扩展范围会稀释收益,且低排名股票回报与市场无异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12692 2025-12-16 cs.AI cs.CL cs.LG 78%

WebOperator: Action-Aware Tree Search for Autonomous Agents in Web Environment

WebOperator: 基于动作意识的树搜索用于网络环境中的自主代理

Mahir Labib Dihan, Tanzima Hashem, Mohammed Eunus Ali, Md Rizwan Parvez

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Bangladesh University of Engineering and Technology (BUET)(孟加拉工程与技术大学) Faculty of Information Technology(信息技术学院) Monash University(莫纳什大学) Qatar Computing Research Institute (QCRI)(卡塔尔计算研究所)

专题命中 工具调用 :autonomous agent(title);分类 cs.AI、cs.CL、cs.LG

AI总结 WebOperator通过引入树搜索框架,实现可靠的回溯和战略探索,提升自主代理在网页环境中的任务成功率。

Comments Under review at ICLR 2026. Project page: https://kagnlp.github.io/WebOperator/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21180 2025-12-16 cs.RO 78%

STITCHER: Real-Time Trajectory Planning with Motion Primitive Search

STITCHER:基于运动片段搜索的实时轨迹规划

Helene J. Levy, Brett T. Lopez

机构 * VECTR Laboratory, University of California, Los Angeles(UC洛杉矶大学VECTR实验室)

专题命中 工具调用 :planning(title,abstract)

AI总结 STITCHER通过实时拼接短轨迹段实现高效无碰撞轨迹规划,克服传统优化方法在计算时间和稳定性上的限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06154 2025-12-09 cs.RO 78%

Exploring Adversarial Obstacle Attacks in Search-based Path Planning for Autonomous Mobile Robots

探索基于搜索的路径规划中对抗性障碍攻击

Adrian Szvoren, Jianwei Liu, Dimitrios Kanoulas, Nilufer Tuptuk

机构 * Department of Computer Science, University College London(计算机科学系,伦敦大学学院)

专题命中 工具调用 :planning(title,abstract)

AI总结 研究针对自主移动机器人路径规划中对抗性障碍攻击的鲁棒性,通过模拟和现实实验验证攻击对路径规划的影响,揭示环境因素对算法鲁棒性的重要性。

Journal ref 2025 IEEE International Conference on Robotics and Automation (ICRA), Atlanta, GA, USA, 2025, pp. 14843-14849

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18353 2025-11-25 cs.RO cs.CV 78%

Enhancing UAV Search under Occlusion using Next Best View Planning

利用最佳视角规划提升遮挡环境下的无人机搜索

Sigrid Helene Strand, Thomas Wiedemann, Bram Burczek, Dmitriy Shutin

机构 * Swarm Exploration Group, Department of Communication Systems, Institute for Communications and Navigation, German Aerospace Center (Deutsches Zentrum für Luft- und Raumfahrt, DLR)(德国航空航天中心(德意志航天中心))

专题命中 工具调用 :planning(title,abstract)

AI总结 本文提出了一种基于可见性启发式的优化方法,用于提升遮挡环境下的无人机搜索效率,通过选择最佳视角提高隐蔽物体的检测率。

Comments Submitted to IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15870 2025-11-19 cs.RO 78%

iA*: Imperative Learning-based A* Search for Path Planning

Xiangyu Chen, Fan Yang, Chen Wang

机构 * Spatial AI & Robotics (SAIR) Lab, Institute for Artificial Intelligence and Data Science, Department of Computer Science and Engineering, University at Buffalo(空间人工智能与机器人实验室,人工智能与数据科学研究所,计算机科学与工程系,布法罗大学)

专题命中 工具调用 :planning(title,abstract)

Journal ref IEEE Robotics and Automation Letters (RA-L), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18567 2025-10-22 cs.GT 78%

Contextual Search in Principal-Agent Games: The Curse of Degeneracy

Yiding Feng, Mengfan Ma, Bo Peng, Zongqi Wan

专题命中 工具调用 :agent(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07176 2025-10-09 cs.CR 78%

Exposing LLM User Privacy via Traffic Fingerprint Analysis: A Study of Privacy Risks in LLM Agent Interactions

Yixiang Zhang, Xinhao Deng, Zhongyi Gu, Yihao Chen, Ke Xu, Qi Li, Jianping Wu

专题命中 工具调用 :agent(title,abstract)

Comments 26 pages with 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05556 2025-10-08 cs.DC cs.OS 78%

Toward Systems Foundations for Agentic Exploration

Jiakai Xu, Tianle Zhou, Eugene Wu, Kostis Kaffes

专题命中 工具调用 :agentic(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02426 2025-10-06 hep-ph astro-ph.CO nucl-th 78%

ArgoLOOM: agentic AI for fundamental physics from quarks to cosmos

S. D. Bakshi, P. Barry, C. Bissolotti, I. Cloet, S. Corrodi, Z. Djurcic, S. Habib, K. Heitmann, T. J. Hobbs, W. Hopkins, S. Joosten, B. Kriesten, N. Ramachandra, A. Wells, M. Zurek

专题命中 工具调用 :agentic(title,abstract)

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏