arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 93529 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35614 篇

2601.13843 2026-01-21 eess.SY cs.SY 86%

Small Models, Big Impact: Tool-Augmented AI Agents for Wireless Network Planning

小型模型,大影响:用于无线网络规划的工具增强型AI代理

Yongqiang Zhang, Mustafa A. Kishk, Mohamed-Slim Alouini

专题命中 规划决策 :AI agent(title);planning(title);agent(abstract)

AI总结 MAINTAINED通过整合地理分析、信号传播建模和网络优化的计算工具,实现了比大型语言模型更高效的无线网络规划,同时减少计算资源需求。

Comments 7 pages, 4 figures, 2 tables, accepted by IEEE Communications Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03257 2025-05-07 eess.SY cs.RO cs.SY 86%

Model Predictive Fuzzy Control: A Hierarchical Multi-Agent Control Architecture for Outdoor Search-and-Rescue Robots

Craig Maxwell, Mirko Baglioni, Anahita Jamshidnejad

机构 * Department of Control and Operations, Delft University of Technology(控制与运营系,代尔夫特理工大学)

专题命中 规划决策 :agent(title);multi-agent(title);planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14111 2025-01-27 cs.MA 86%

Collaborating in a competitive world: Heterogeneous Multi-Agent Decision Making in Symbiotic Supply Chain Environments

Wan Wang, Haiyan Wang, Adam J. Sobey

专题命中 规划决策 :agent(title,abstract);multi-agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08534 2024-07-12 eess.SY cs.SY 86%

An Optimal Task Planning and Agent-aware Allocation Algorithm in Collaborative Tasks Combining with PDDL and POPF

Qiguang Chen, Ya-Jun Pan

专题命中 规划决策 :planning(title,abstract);agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13543 2024-05-24 cs.MA 86%

Towards a Distributed Platform for Normative Reasoning and Value Alignment in Multi-Agent Systems

Miguel Garcia-Bohigues, Carmengelys Cordova, Joaquin Taverner, Javier Palanca, Elena del Val, Estefania Argente

专题命中 规划决策 :agent(title,abstract);multi-agent(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17477 2024-04-29 cs.MA 86%

A multi-agent model of hierarchical decision dynamics

Paul Kinsler

专题命中 规划决策 :agent(title,abstract);multi-agent(title)

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16489 2023-05-29 cs.RO 86%

Metaheuristic planner for cooperative multi-agent wall construction with UAVs

Basel Elkhapery, Robert Pěnička, Michal Němec, Mohsin Siddiqui

专题命中 规划决策 :agent(title);multi-agent(title);planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.10876 2023-03-28 cs.CV cs.MA 86%

EqMotion: Equivariant Multi-agent Motion Prediction with Invariant Interaction Reasoning

Chenxin Xu, Robby T. Tan, Yuhong Tan, Siheng Chen, Yu Guang Wang, Xinchao Wang, Yanfeng Wang

专题命中 规划决策 :agent(title,abstract);multi-agent(title)

Comments Accepted to CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.05568 2023-02-14 cs.MA cs.CE cs.GT econ.GN q-fin.CP q-fin.EC 86%

Bounded strategic reasoning explains crisis emergence in multi-agent market games

Benjamin Patrick Evans, Mikhail Prokopenko

专题命中 规划决策 :agent(title,abstract);multi-agent(title)

Comments 10 pages + 7 page appendix, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.11061 2021-04-16 cs.RO cs.MA 86%

MADER: Trajectory Planner in Multi-Agent and Dynamic Environments

Jesus Tordesillas, Jonathan P. How

专题命中 规划决策 :agent(title);multi-agent(title);planning(abstract)

Comments 15 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1109.0601 2011-09-06 cs.MA 86%

Application of distributed constraint satisfaction problem to the agent-based planning in manufacturing systems

S. Kornienko, O. Kornienko, P. Levi

专题命中 规划决策 :agent(title,abstract);planning(title)

Journal ref Proceedings of the International Scientific Congress "Intelligent Systems (IEEE AIS'03)" and "Intelligent CAD's (CAD-2003)", p.124-140, Divnomorsk, Russia, 2003

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21628 2026-08-25 cs.SE cs.RO 新提交 85%

ExploreAI: Agentic Exploration Knowledge Bases for Reproducible Observable-Regression Testing of Black-Box VR and 3D Applications

ExploreAI:用于黑盒VR与3D应用可复现可观测回归测试的智能探索知识库

Jiajie Wang, Kebin Peng, Wei Wang, Xiaoyin Wang, Sen He, Xue Qin

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.SE

AI总结 ExploreAI是LLM驱动的智能体框架,通过构建探索知识库(EKB),实现黑盒VR与3D应用的可复现可观测回归测试,在多场景中验证了其有效性。

Comments 11 pages, 3 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17932 2026-08-19 cs.MA cs.AI 新提交 85%

Collective Counterfactual Planning: Coordination, Consent, and Verification under Representational Constraints

集体反事实规划:表征约束下的协调、同意与验证

Chainarong Amornbunchornvej

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究提出集体反事实规划(CCP)形式化模型,分析表征约束下群体规划的可行性,揭示正负二元性,给出四步可解性方案,解释群体协作的几何机制。

Comments The code is available at https://github.com/DarkEyes/Coll-Counterfactual-Plan

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17282 2026-08-19 cs.AI 新提交 85%

DeAR: Decentralized Agentic Reasoning via Capability Grounding and Collaborative Thought Navigation

DeAR:基于能力锚定与协作思维导航的去中心化智能体推理

Xing Wei, Changmeng Zheng, XiaoYong Wei, Xiufen Ye, Qing Li

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 针对现有智能体推理系统的路由瓶颈与静态角色分配问题,提出DeAR框架,通过三种机制实现去中心化协作,在9类基准测试中性能优于基线方法,提升了知识密集型推理任务的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16891 2026-08-19 cs.AI cs.CE cs.CR cs.CY 新提交 85%

Runtime Governance for Agentic AI: Action-Boundary Control with Trusted Provenance and Fail-Closed Execution

智能体AI的运行时治理:基于可信溯源与故障闭锁执行的行动边界控制

Adam Mazzocchetti

机构 * SPQR Technologies Inc.(SPQR科技公司)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 该研究提出Aegis运行时治理系统,通过可信决策层调解智能体AI的工具行动提案,在沙堡语料库评估中成功阻止风险提案转化为治理副作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12313 2026-08-19 cs.CV cs.CL 版本更新 85%

AVA-Encoder: Towards Agent-Native Video Representation Learning

AVA-Encoder:面向智能体原生的视频表示学习

Chuyue Li, Jinpeng Yu, Haozhe Wang, Tian Xueyun, Zhijing Zhang, Bingnan Li, Shuqi Gu, Kan Ren, Jiaming Liu, Ruihua Huang

机构 * Qwen Business Unit of Alibaba(阿里巴巴通义千问业务部) ShanghaiTech University(上海科技大学) The Hong Kong University of Science and Technology(香港科技大学) Institute of Computing Technology(中国科学院计算技术研究所) Southeast University(东南大学)

专题命中 规划决策 :agent(title,abstract);agentic(abstract,abstract_cn);分类 cs.CL

AI总结 针对创意智能体缺乏从高质量电影学习的有效方式的问题,提出AVA-Encoder框架,其视频表示经重构优化后,在相关基准上性能优于现有方法,还发布了配套框架、基准及数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16402 2026-08-18 cs.AI 新提交 85%

A Policy Algebra for Trust-Preserving Agentic AI Execution

用于信任保留的智能体AI执行的策略代数

Bhaskar Tripathi, Anurag Kumar, Ramendra Kumar, Bhavesh Gadhe

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出一种策略代数,用于定义智能体AI执行的可靠范围,可干预94.8%的策略违规事件,保留86.9%的任务完成率,为构建可靠智能体提供支持。

Comments 7 figures, 10 tables, and 5 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15175 2026-08-18 cs.RO cs.AI 新提交 85%

LAPF: LLM-Agent-Based Path Finder Using the UAVScenes Dataset

LAPF:基于大语言模型智能体的路径查找器,使用UAVScenes数据集

Yousef Emami, Mohammadhossein Homaei, Hao Zhou, Miguel Gutiérrez Gaitán, Atefeh Hajijamali Arani, Rui Zhang

专题命中 规划决策 :agent(title,abstract);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出基于LLM智能体的LAPF框架,整合多模块构建闭环认知架构,在城镇级无人机导航中实现了更优路径效率,且无钳位事件,性能优于CoT提示方法。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15043 2026-08-18 cs.AI 新提交 85%

SCOPE: Score-Isolated Agentic Optimization for Video World Models

SCOPE:用于视频世界模型的分数隔离智能体优化

Yuhua Jiang, Jiaming Wang, Qingbin Liu, Feifei Gao

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Tencent(腾讯)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 本研究针对视频世界模型推理时改进的评估难题,提出SCOPE框架,通过类型化状态更新与冻结策略实现可审计适应,在Physics-IQ基准上较冻结基线提升+14.24,同时揭示推理时更新的益处需原则性部署机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15016 2026-08-18 cs.CR cs.AI 新提交 85%

Hierarchical Agentic Incident Response with Digital-Twin-Validated Attack Inference

结合数字孪生验证攻击推理的分层智能体事件响应

Yiran Gao, Juntao Chen, Tao Li

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.AI

AI总结 该研究针对网络事件响应效率低的问题,提出整合LLM攻击推理、滚动规划与数字孪生验证的分层智能体响应框架,在33组件企业网络测试台的多阶段攻击场景中,其恢复成功率较前沿LLM基线提升18%-31%。

Comments 2026 IEEE Conference on Communications and Network Security

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14579 2026-08-18 cs.AI 新提交 85%

SKILL: Self-correcting Knowledge-guided Iterative Large Language Model Agent for Logic Optimization

SKILL:用于逻辑优化的自校正知识引导迭代大语言模型智能体

Rui Yang

机构 * University of California, Riverside(加州大学河滨分校)

专题命中 规划决策 :agent(title,abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对逻辑综合优化的挑战,提出SKILL智能体,结合多LLM推理与RL交互,经基准测试实现12.4%的PDA提升及86.3%的50万门级逻辑系统成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07339 2026-08-13 cs.AI 版本更新 85%

Tools as Continuous Flow for Evolving Agentic Reasoning

工具作为连续流用于演进代理推理

Tairan Huang, Siyu Shang, Qiang Chen, Xiu Su, Yi Chen

机构 * Central South University(中南大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文提出FlowAgent,通过连续轨迹生成改进代理推理,引入计划级闭环基准,理论证明其鲁棒性和泛化能力,实验证明在长周期推理任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10157 2026-08-12 cs.AI 新提交 85%

SBCO: Self-Supervised, Verifier-Grounded Harness Optimization For Planning Agents

SBCO:面向规划智能体的自监督、验证器驱动的工具链优化器

Vivek Kulkarni, Sudipta Paul, Aounon Kumar, Nicholas Tzou, Srinivas Chappidi

专题命中 规划决策 :planning(title,abstract);agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本研究针对规划任务提出SBCO,一种自监督的验证器驱动工具链优化器,其性能优于或相当的定制基线,且计算成本仅为其1/4至1/5.5。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18401 2026-08-12 cs.CL 版本更新 85%

CAPO: Critic-Guided Action-Aligned Policy Optimization for Advancing LLM Agent Capabilities

StepPO: 面向智能体强化学习的步骤对齐策略优化

Daoyu Wang, Qingchuan Li, Mingyue Cheng, Jie Ouyang, Shuo Yu, Chunli Liu, Shijin Wang, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

专题命中 规划决策 :agent(title,abstract);agentic(abstract,abstract_cn);分类 cs.CL

AI总结 提出StepPO,一种步骤级策略优化方法,通过将智能体强化学习从token级MDP重构为步骤级MDP并引入步骤级信用分配,以解决现有算法在智能体决策粒度上的不匹配问题,在多跳问答等任务上优于多种RL算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09732 2026-08-11 cs.CR cs.AI 新提交 85%

ColluSkill: Adversarial Cross-Skill Composition for Evading Agent Skill Scanners

ColluSkill:用于规避智能体技能扫描器的对抗性跨技能组合

Puyu Zeng, Simeng Qin, Jingzhi Li, Ju Jia, Zheli Liu, Xiaojun Jia

专题命中 规划决策 :agent(title,abstract);planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究提出ColluSkill攻击框架,可通过跨技能组合规避技能扫描器,攻击成功率达96.0%;还提出ChainGuard防御框架,能将攻击成功率降至22.5%,同时放行99.5%良性工作流。

Comments 9 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20255 2026-08-10 cs.CR cs.AI 版本更新 85%

The Ethics of Autonomous AI Agents for Offensive Security

用于进攻性安全的自主人工智能代理的伦理问题

Andreas Happe, Jürgen Cito, Jasmin Wachter

机构 * TU Wien(维也纳技术大学) University of Klagenfurt(克雷格福大学)

专题命中 规划决策 :AI agent(title,abstract);autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 研究使用自主人工智能代理进行进攻性安全时的伦理问题,分析道德归因在多方的扩散及技术对利益相关者的影响,通过研究其不确定性等特性及攻防成本不对称性,为现有框架不适用于此情况提供分层建议。

Comments accepted at FAIEMA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06346 2026-08-07 cs.AI 新提交 85%

TRAJDEBUG: Tracing Error Lifecycle to Identify Critical Failures in Long-Horizon Agent Trajectories

TRAJDEBUG:追踪错误生命周期以识别长视野智能体轨迹中的关键失败

Yunjia Qi, Zehua Yin, Xintong Shi, Hao Peng, Songyuanyi Lu, Yixian Liu, Richeng Xuan, Yuhong Liu, Zhichao Hu, Xiaozhi Wang, Lei Hou, Bin Xu, Juanzi Li

机构 * Tsinghua University(清华大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Tencent Hunyuan(腾讯混元)

专题命中 规划决策 :agent(title,abstract);tool-use(abstract);agentic(abstract);分类 cs.AI

AI总结 针对长视野智能体轨迹调试的级联错误与关键错误定位难题,提出TrajDebug框架,构建含486条轨迹的TrajErrBench基准,实验显示其性能优于现有基线,可提供改进智能体的可操作反馈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06197 2026-08-07 cs.AI 新提交 85%

EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning

EnvACE:通过世界预演内化环境动态以实现智能体强化学习

Zishan Xu, Zhiyuan Yao, Yuxin Chen, Yifu Guo, Zhengxi Lu, Yuquan Lu, Jinyang Huang, Yan Xu, Yasheng Wang, Weinan Zhang, Xingshan Zeng, Weiwen Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Sun Yat-sen University(中山大学) Central South University(中南大学) The Chinese University of Hong Kong(香港中文大学) Tencent Inc.(腾讯公司)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出 EnvACE 方法,以世界预演替代外部环境交互训练 LLM 智能体,在多基准测试中性能优于基线,可突破外部环境约束扩展 LLM 智能体训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02721 2026-08-07 cs.AI 版本更新 85%

GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforcement Learning

GrandCode: 通过代理强化学习实现竞技编程的Grandmaster级别

Ornith Team, Xiaoya Li, Guoyin Wang, Songqiao Su, Chris Shum, Jiwei Li

机构 * DeepReinforce Team(DeepReinforce 团队)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出GrandCode,一种用于竞技编程的多代理强化学习系统,通过代理模块协同训练和代理GRPO算法,实现了在竞技编程比赛中超越人类选手的突破。

Comments Tech Report; Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04709 2026-08-06 cs.CL 新提交 85%

EmpaAva: An Open-source Agentic 3D-Avatar Empathetic Live Chatbot

EmpaAva:开源智能体式3D化身共情实时聊天机器人

Jie Yang, Wenhao Xu, Shuhui Lin, Hao Fei

机构 * National University of Singapore(新加坡国立大学) Tsinghua University(清华大学) University of Oxford(牛津大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.CL

AI总结 该研究提出首个开源智能体式3D化身共情聊天机器人EmpaAva,通过三智能体架构实现闭环多模态交互,在评估中优于多款基准模型,将开源并提供在线演示。

Comments Project&Demo: https://empaava.top/

详情

展开后加载摘要…

URL PDF HTML 收藏