arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35686 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35686 篇

2602.22675 2026-03-02 cs.CL 83%

Search More, Think Less: Rethinking Long-Horizon Agentic Search for Efficiency and Generalization

搜索更多,思考更少:重新思考长周期代理搜索以提高效率和泛化能力

Qianben Chen, Tianrui Qin, King Zhu, Qiexiang Wang, Chengjun Yu, Shu Xu, Jiaqi Wu, Jiayu Zhang, Xinpeng Liu, Xin Gui, Jingyi Cao, Piaohong Wang, Dingfeng Shi, He Zhu, Tiannan Wang, Yuqing Wang, Maojia Song, Tianyu Zheng, Ge Zhang, Jian Yang, Jiaheng Liu, Minghao Liu, Yuchen Eleanor Jiang, Wangchunshu Zhou

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 本文提出SMTL框架,通过并行证据获取提升长周期代理搜索的效率与泛化能力,在多个基准测试中取得优异成绩。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19326 2026-03-02 cs.MA cs.AI 83%

City Editing: Hierarchical Agentic Execution for Dependency-Aware Urban Geospatial Modification

城市编辑:面向依赖意识的层级代理执行

Rui Liu, Steven Jige Quan, Zhong-Ren Peng, Zijun Yao, Han Wang, Zhengzhang Chen, Kunpeng Liu, Yanjie Fu, Dongjie Wang

机构 * University of Kansas, Lawrence, KS, USA(堪萨斯大学) Seoul National University, Seoul, South Korea(首尔国立大学) University of Florida, Gainesville, FL, USA(佛罗里达大学) NEC Laboratories America, Princeton, NJ, USA(NEC美国实验室) Clemson University, Clemson, SC, USA(克莱姆森大学) Arizona State University, Tempe, AZ, USA(亚利桑那州立大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于层级代理的框架,用于高效、准确地修改城市规划,通过分层几何意图和迭代验证机制提升空间修改的效率与一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19364 2026-03-02 cs.AI cs.MA 83%

Integrating LLM in Agent-Based Social Simulation: Opportunities and Challenges

将大语言模型整合到基于代理的社会模拟中:机遇与挑战

Patrick Taillandier, Jean Daniel Zucker, Arnaud Grignard, Benoit Gaudou, Nghi Quang Huynh, Alexis Drogoul

机构 * UR MIAT, University of Toulouse, INRAE, Castanet-Tolosan, France(法国图卢兹大学UR MIAT,INRAE,Castanet-Tolosan分校) UMI 209 UMMISCO, IRD/Sorbonne University, Bondy, France(法国Bondy IRD/索邦大学UMI 209 UMMISCO) LMI ACROSS, Thuyloi University, Hanoi, Vietnam(越南胡志明大学LMI ACROSS) UMR 5505 IRIT, University of Toulouse Capitole, Toulouse, France(法国图卢兹大学Capitole UMR 5505 IRIT) CICT, Can Tho University, Can Tho, Vietnam(越南金瓯大学CICT)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文探讨了大语言模型在社会模拟中的应用,分析其潜力与局限,并提出混合宪法架构作为整合LLM与传统代理模型的可行方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21588 2026-02-26 cs.LG cs.CE 83%

ABM-UDE: Developing Surrogates for Epidemic Agent-Based Models via Scientific Machine Learning

ABM-UDE:通过科学机器学习开发用于流行病代理模型的替代方案

Sharv Murgai, Utkarsh Utkarsh, Kyle C. Nguyen, Alan Edelman, Erin C. S. Acquesta, Christopher Vincent Rackauckas

机构 * Monta Vista High School(蒙塔维斯塔高中) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Sandia National Laboratories(桑塔纳国家实验室)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.LG

AI总结 ABM-UDE通过科学机器学习开发流行病代理模型的替代方案,利用UDEs学习接触率参数化,提升预测精度与可靠性,实现快速、可解释的流行病模拟。

Comments 25 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19633 2026-02-24 cs.AI 83%

TAPE: Tool-Guided Adaptive Planning and Constrained Execution in Language Model Agents

TAPE: 语言模型代理中的工具引导自适应规划与约束执行

Jongwon Jeong, Jungtaek Kim, Kangwook Lee

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 TAPE通过工具引导的自适应规划与约束执行方法,提升语言模型代理在复杂任务中的成功率,特别是在困难设置中表现显著优于现有框架。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18731 2026-02-24 cs.AI 83%

Beyond Description: A Multimodal Agent Framework for Insightful Chart Summarization

超越描述:一种多模态代理框架用于深入的图表摘要

Yuhang Bai, Yujuan Ding, Shanru Lin, Wenqi Fan

机构 * The Hong Kong Polytechnic University(香港理工大学) City University of Hong Kong(香港城市大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出多模态代理框架Chart Insight Agent Flow,通过结合MLLMs的感知与推理能力,提升图表摘要的深度和多样性,并引入新数据集ChartSummInsights以支持研究。

Comments 5 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09877 2026-02-24 cs.AI 83%

Synergising Human-like Responses and Machine Intelligence for Planning in Disaster Response

融合人类样响应与机器智能以应对灾害响应中的规划

Savvas Papaioannou, Panayiotis Kolios, Christos G. Panayiotou, Marios M. Polycarpou

机构 * KIOS Research and Innovation Center of Excellence(KIOS研究与创新卓越中心) Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 规划决策 :planning(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出融合人类样响应与机器智能的框架,以提升灾害响应中复杂任务的规划效率。

Comments 2024 IEEE World Congress on Computational Intelligence (IEEE WCCI), 2024 International Joint Conference on Neural Networks (IJCNN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23029 2026-02-20 cs.LG cs.SY eess.SY 83%

Risk-Aware Decision Making in Restless Bandits: Theory and Algorithms for Planning and Learning

在 restless bandits 中的风险意识决策:用于规划和学习的理论与算法

Nima Akbarzadeh, Yossiri Adulyasak, Erick Delage

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG

AI总结 本文提出了一种风险意识的 restless bandits 决策方法,结合理论与算法,用于规划和学习场景中降低风险暴露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13313 2026-02-17 cs.CV cs.AI 83%

Agentic Spatio-Temporal Grounding via Collaborative Reasoning

基于协作推理的代理时空 grounding

Heng Zhao, Yew-Soon Ong, Joey Tianyi Zhou

机构 * CFAR, IHPC, Agency for Science, Technology and Research(A*STAR)(CFAR、IHPC、新加坡科技研究局) CCDS, Nanyang Technological University(CCDS、南洋理工大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出ASTG框架,通过协作推理实现开放世界下的时空视频grounding,提升检索效率并优于现有弱监督和零样本方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12714 2026-02-16 cs.LG 83%

ADEPT: RL-Aligned Agentic Decoding of Emotion via Evidence Probing Tools -- From Consensus Learning to Ambiguity-Driven Emotion Reasoning

ADEPT: 通过证据探测工具实现情感的代理解码 -- 从共识学习到由模糊性驱动的情感推理

Esther Sun, Bo-Hao Su, Abinay Reddy Naini, Shinji Watanabe, Carlos Busso

机构 * cmu(卡内基梅隆大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 ADEPT通过证据探测工具实现情感的代理解码,从共识学习转向由模糊性驱动的情感推理,提升情感识别的准确性和可解释性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11412 2026-02-13 cs.CY cs.AI cs.HC 83%

When Visibility Outpaces Verification: Delayed Verification and Narrative Lock-in in Agentic AI Discourse

当可见性超越验证:代理AI discourse中的延迟验证与叙述锁定

Hanjing Shi, Dominic DiFranzo

机构 * Lehigh University(莱文大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文研究了代理AI讨论中可见性与验证时间的关系,揭示了高可见度讨论因延迟验证导致的叙述锁定现象,并提出知识摩擦作为平衡平台的干预措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10465 2026-02-12 cs.CR cs.AI cs.DC cs.MA 83%

Authenticated Workflows: A Systems Approach to Protecting Agentic AI

认证工作流:保护代理AI的系统方法

Mohan Rajagopalan, Vinay Rao

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出认证工作流,通过密码学和运行时策略结合,实现企业代理AI的确定性安全,有效防护多种安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10122 2026-02-12 cs.CY cs.AI 83%

A Practical Guide to Agentic AI Transition in Organizations

组织中代理AI转型的实用指南

Eranga Bandara, Ross Gore, Sachin Shetty, Sachini Rajapakse, Isurunima Kularathna, Pramoda Karunarathna, Ravi Mukkamala, Peter Foytik, Safdar H. Bouk, Abdul Rahman, Xueping Liang, Amin Hass, Tharaka Hewa, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan

机构 * Old Dominion University(旧 Dominion 大学) Florida International University(佛罗里达国际大学) Nanyang Technological University(南洋理工大学) University of Colombo(科伦坡大学) Center for Wireless Communications, University of Oulu(无线通信中心,奥卢大学) University of Sri Jayewardenepura(斯里贾yenepura大学) Accenture Technology Labs(埃森哲技术实验室)

专题命中 规划决策 :agentic(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出了一种实用框架,帮助组织将手动流程转型为自动化代理AI系统,通过领域驱动用例识别、任务委托给AI代理及人机协同模型实现可持续的自动化与业务价值对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01550 2026-02-11 cs.AI 83%

S1-NexusAgent: a Self-Evolving Agent Framework for Multidisciplinary Scientific Research

S1-NexusAgent:一个多学科科学研究的自演化代理框架

NexusAgent Team

机构 * S1-NexusAgent Team Institute of Automation Chinese Academy of Sciences(S1-NexusAgent团队自动化研究所中国科学院)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 S1-NexusAgent通过自演化机制和双环架构,实现多学科科学研究中的复杂工作流建模与高效工具协调,验证了其在长视界规划和复杂任务中的卓越性能。

Comments In progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10357 2026-02-11 cs.AI 83%

Optimus-3: Dual-Router Aligned Mixture-of-Experts Agent with Dual-Granularity Reasoning-Aware Policy Optimization

Optimus-3: 具有双粒度推理感知策略优化的双路由对齐专家混合代理

Zaijing Li, Yuquan Xie, Rui Shao, Gongwei Chen, Weili Guan, Dongmei Jiang, Yaowei Wang, Liqiang Nie

机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen Campus)(计算机科学与技术学院,哈尔滨工业大学(深圳校区)) Pengcheng Laboratory(鹏城实验室) School of Information Science and Technology, Harbin Institute of Technology (Shenzhen Campus)(信息科学与技术学院,哈尔滨工业大学(深圳校区)) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 Optimus-3通过双路由对齐专家混合架构和双粒度推理感知策略优化,实现了系统1与系统2的协同,提升了开放性任务的解决能力。

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21868 2026-02-10 cs.HC cs.CL 83%

What Makes LLM Agent Simulations Useful for Policy Practice? An Iterative Design Study in Emergency Preparedness

是什么使大语言模型代理模拟对政策实践有用?一项关于应急准备的迭代设计研究

Yuxuan Li, Sauvik Das, Hirokazu Shirado

机构 * School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.CL

AI总结 本文通过迭代设计研究,探讨了LLM代理模拟在应急准备中的应用,发现通过可验证场景建立信任、获取隐性知识以及共同进化模拟与政策实施是提升其对政策实践有用性的关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05818 2026-02-10 cs.AI cs.DB 83%

TKG-Thinker: Towards Dynamic Reasoning over Temporal Knowledge Graphs via Agentic Reinforcement Learning

TKG-Thinker: 向通过代理强化学习实现动态推理的时序知识图谱迈进

Zihao Jiang, Miao Peng, Zhenyan Shan, Wenjie Xu, Ben Liu, Gong Chen, Ziqi Gao, Min Peng

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 规划决策 :agentic(title);agent(abstract);planning(abstract);分类 cs.AI

AI总结 TKG-Thinker通过代理强化学习实现动态推理,提升时序知识图谱问答的性能和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15782 2026-02-10 cs.LG 83%

Solving General-Utility Markov Decision Processes in the Single-Trial Regime with Online Planning

在单次试验范式中求解一般效用马尔可夫决策过程的在线规划方法

Pedro P. Santos, Alberto Sardinha, Francisco S. Melo

机构 * INESC-ID & Instituto Superior Técnico(INESC-ID与理工学院)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG

AI总结 本文提出了一种在单次试验范式中求解一般效用马尔可夫决策过程的方法,通过在线规划技术提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07092 2026-02-10 cs.MA cs.AI 83%

Lemon Agent Technical Report

柠檬代理技术报告

Haipeng Jiang, Kailong Ren, Zimo Yin, Zhetao Sun, Xin Gan, Guangyi Lv, Ming He, Peng Wang, Congli Yin, Hong Pan, Changwen Zhang, Shan Tong, Zhengyu Xu, Zeping Chen, Yubin Huangfu, Yanzhi Xu, Xing Su, Qin Feng, Dong An, Jianping Fan

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 柠檬代理是一种基于AgentCortex框架的多代理系统,通过自适应调度和三级上下文管理策略,优化资源利用和任务处理效率,实现复杂场景下的高准确率表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06030 2026-02-10 cs.MA cs.LG 83%

PhysicsAgentABM: Physics-Guided Generative Agent-Based Modeling

PhysicsAgentABM: 基于物理的生成基于主体的建模

Kavana Venkatesh, Yinhan He, Jundong Li, Jiaming Cui

机构 * University of Virginia(弗吉尼亚大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.LG

AI总结 PhysicsAgentABM通过结合符号推理与神经网络,实现基于物理的生成式主体建模,提升大规模模拟的准确性和校准性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05386 2026-02-09 cs.CR cs.AI 83%

Spider-Sense: Intrinsic Risk Sensing for Efficient Agent Defense with Hierarchical Adaptive Screening

Spider-Sense: 基于内在风险感知的高效代理防御方法与分层自适应筛查

Zhenxiong Yu, Zhi Yang, Zhiheng Jin, Shuhe Wang, Heng Zhang, Yanlin Fei, Lingfeng Zeng, Fangqi Lou, Shuo Zhang, Tu Hu, Jingping Liu, Rongze Chen, Xingyu Zhu, Kunyi Wang, Chaofa Yuan, Xin Guo, Zhaowei Liu, Feipeng Zhang, Jie Huang, Huacan Wang, Ronghao Chen, Liwen Zhang

机构 * SUFE(上海财经大学) NUS(新加坡国立大学) QuantaAlpha(量子阿尔法) CMU(卡内基梅隆大学) SYSU(南方科技大学) USTC(中国科学技术大学) XJTU(西安交通大学)

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 Spider-Sense通过内在风险感知实现高效代理防御,结合分层自适应筛查机制,有效降低攻击成功率和误报率,仅引入微小延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14388 2026-02-09 cs.AI 83%

Hi-Agent: Hierarchical Vision-Language Agents for Mobile Device Control

Hi-Agent:用于移动设备控制的分层视觉语言代理

Zhe Wu, Hongjin Lu, Junliang Xing, Changhao Zhang, Yuxuan Li, Yin Zhu, Yuhao Yang, Yuheng Jing, Kai Li, Kun Shao, Jianye Hao, Jun Wang, Yuanchun Shi

机构 * Tsinghua University(清华大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University College London(伦敦大学学院)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 Hi-Agent通过分层结构和前瞻性优势函数,实现移动设备控制的高效训练和高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05327 2026-02-06 cs.AI 83%

ProAct: Agentic Lookahead in Interactive Environments

ProAct:交互环境中的代理前瞻性

Yangbin Yu, Mingyu Yang, Junyou Li, Yiming Gao, Feiyu Liu, Yijun Yang, Zichuan Lin, Jiafei Lyu, Yicheng Liu, Zhicong Lu, Deheng Ye, Jie Jiang

机构 * Tencent Hunyuan(腾讯文言)

专题命中 规划决策 :agentic(title);agent(abstract);planning(abstract);分类 cs.AI

AI总结 ProAct通过双阶段训练范式提升交互环境中的前瞻性推理能力,结合GLAD和MC-Critic实现更稳定的策略优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04129 2026-02-05 cs.RO cs.AI cs.ET cs.MA 83%

KGLAMP: Knowledge Graph-guided Language model for Adaptive Multi-robot Planning and Replanning

KGLAMP:基于知识图谱的自适应多机器人规划与再规划语言模型

Chak Lam Shek, Faizan M. Tariq, Sangjae Bae, David Isele, Piyush Gupta

机构 * Honda Research Institute, USA(本田研究院) University of Maryland, College Park(马里兰大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 KGLAMP通过知识图谱引导LLM实现异构多机器人系统的自适应规划与再规划,提升动态环境下的规划效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03974 2026-02-05 cs.AI 83%

Active Epistemic Control for Query-Efficient Verified Planning

主动认知控制用于查询高效的验证规划

Shuhui Qu

机构 * Stanford University(斯坦福大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 主动认知控制通过结合基于模型的信念管理和范畴可行性检查,实现查询高效的验证规划,在交互环境中减少重新规划轮次。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03940 2026-02-05 cs.LG 83%

Autonomous AI Agents for Real-Time Affordable Housing Site Selection: Multi-Objective Reinforcement Learning Under Regulatory Constraints

面向实时经济适用房选址的自主AI代理:在监管约束下的多目标强化学习

Olaf Yunus Laitinen Imanov, Duygu Erisken, Derya Umut Kulali, Taner Yilmaz, Rana Irem Turhan

机构 * Department of Applied Mathematics and Computer Science (DTU Compute), Technical University of Denmark(应用数学与计算机科学系(DTU Compute),丹麦技术大学) Department of Mathematics, Trakya University(数学系,特拉基亚大学) Department of Engineering, Eskisehir Technical University(工程系,埃斯基谢普尔技术大学) Department of Computer Engineering, Afyon Kocatepe University(计算机工程系,阿菲昂卡奥卡佩大学) Department of Computer Systems, Riga Technical University(计算机系统系,里加技术大学)

专题命中 规划决策 :AI agent(title);agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 AURA通过多目标强化学习在监管约束下高效选址,提升经济适用房选址的合规性和效率,减少选址时间并提高社会公平性

Comments 12 pages, 6 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01335 2026-02-03 cs.CV cs.AI 83%

Beyond Pixels: Visual Metaphor Transfer via Schema-Driven Agentic Reasoning

超越像素:通过基于模式的代理推理实现视觉隐喻转移

Yu Xu, Yuxin Zhang, Juan Cao, Lin Gao, Chunyu Wang, Oliver Deussen, Tong-Yee Lee, Fan Tang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent Hunyuan(腾讯文脉) University of Konstanz(康斯坦茨大学) National Cheng-Kung University(国立成功大学)

专题命中 规划决策 :agentic(title);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出基于模式的代理推理框架,实现视觉隐喻转移,通过多代理协作提升隐喻生成的抽象逻辑与视觉创造力。

Comments 11 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01202 2026-02-03 cs.AI 83%

Workflow-R1: Group Sub-sequence Policy Optimization for Multi-turn Workflow Construction

Workflow-R1: 多轮工作流构建的分组子序列策略优化

Mingze Kong, Zikun Qu, Zhongquan Zhou, Pengyu Liang, Xiang Li, Zhiwei Shang, Zhi Hong, Kaiyu Huang, Zhiyong Wang, Zhongxiang Dai

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai Jiao Tong University(上海交通大学) Tianjin University(天津大学) Tongji University(同济大学) University of Edinburgh(爱丁堡大学)

专题命中 规划决策 :workflow(title,abstract);agentic(abstract);分类 cs.AI

AI总结 Workflow-R1通过分组子序列策略优化提升多轮工作流构建的灵活性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00951 2026-02-03 cs.AI 83%

R-HTN: Rebellious Online HTN Planning for Safety and Game AI

R-HTN:安全与游戏AI中的反叛在线HTN规划

Hector Munoz-Avila, David W. Aha, Paola Rizzo

机构 * Computer Science \& Engineering, Lehigh University Bethlehem, PA 18015-3084 USA Navy Center for Applied Research in AI Naval Research Laboratory

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 R-HTN是一种用于安全与游戏AI的在线HTN规划算法,通过反叛机制在遵循指令的情况下实现任务目标。

Journal ref The Annual Conference on Advances in Cognitive Systems (ACS-2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00929 2026-02-03 cs.AI 83%

Learning Abstractions for Hierarchical Planning in Program-Synthesis Agents

在程序合成代理中学习层次规划的抽象

Zergham Ahmed, Kazuki Irie, Joshua B. Tenenbaum, Christopher J. Bates, Samuel J. Gershman

机构 * Harvard University(哈佛大学) MIT(麻省理工学院) Institute for Human and Machine Cognition(人机认知研究院) Kempner Institute for the Study of Natural and Artificial Intelligence at Harvard University, Cambridge, MA, USA(哈佛大学马萨诸塞州剑桥市自然与人工智能研究学院)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 TheoryCoder-2通过主动学习可重用的抽象,提升了程序合成代理在复杂任务中的样本效率和泛化能力。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏