arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35686 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35686 篇

2603.17021 2026-03-23 cs.AI 83%

Generative AI-assisted Participatory Modeling in Socio-Environmental Planning under Deep Uncertainty

生成AI辅助的参与建模在深不确定性下的社会环境规划

Zhihao Pei, Nir Lipovetzky, Angela M. Rojas-Arevalo, Fjalar J. de Haan, Enayat A. Moallemi

机构 * School of Computing(计算学院) Information Systems, Faculty of Engineering(信息学院,工程学院) Information Technology, The University of Melbourne, Parkville VIC 3010, Australia(信息科技,墨尔本大学,帕克维尔 VIC 3010, 澳大利亚) Industrial Research Organization (CSIRO), Research Way, Clayton VIC 3168, Australia(工业研究组织(CSIRO),Research Way,克莱顿 VIC 3168, 澳大利亚) Department of Psychiatry, The University of Melbourne, Parkville VIC 3010, Australia(精神病学系,墨尔本大学,帕克维尔 VIC 3010, 澳大利亚)

专题命中 规划决策 :planning(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型简化社会环境规划中深不确定性下的问题概念化过程,通过模板化工作流实现参与建模,提升建模效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09255 2026-03-20 cs.CL 83%

DSPO: Stable and Efficient Policy Optimization for Agentic Search and Reasoning

DSPO:用于代理搜索和推理的稳定高效策略优化

Chenyang Gu, Yewen Pu, Bruce Yang, Xiaofan Li, Huan Gao

机构 * Sapiens AI Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 DSPO通过序列级优化和动态样本过滤提升代理训练稳定性,使7B模型在多个问答基准上超越前作34.1%,在复杂多跳问答中甚至超越14B模型9个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15888 2026-03-20 cs.AI cs.CV cs.RO 83%

AsgardBench -- Evaluating Visually Grounded Interactive Planning Under Minimal Feedback

AsgardBench -- 评估基于视觉的交互式规划在最小反馈下的表现

Andrea Tupini, Lars Liden, Reuben Tan, Yu Wang, Jianfeng Gao

机构 * Microsoft(微软)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 AsgardBench旨在评估基于视觉的高阶动作序列生成和交互式规划,重点在于执行过程中基于视觉观察而非导航或低级操作的计划适应。通过限制代理输入为图像、动作历史和轻量级成功/失败信号,该基准测试强调条件分支和计划修复。

Comments 19 figures, 6 tables, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14730 2026-03-18 cs.LG 83%

GNNVerifier: Graph-based Verifier for LLM Task Planning

GNNVerifier:基于图的LLM任务规划验证器

Yu Hao, Qiuyu Wang, Cheng Yang, Yawen Li, Zhiqiang Zhang, Chuan Shi

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划决策 :planning(title,abstract);autonomous agent(abstract);分类 cs.LG

AI总结 本文提出基于图的验证器,通过构建任务计划的图结构,利用图神经网络评估计划的合理性,从而纠正LLM生成的计划中的错误。

Comments 17pages,12figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06993 2026-03-18 cs.AI cs.CV 83%

IMAIA: Interactive Maps AI Assistant for Travel Planning and Geo-Spatial Intelligence

IMAIA:交互式地图AI助手用于旅行规划和地理空间智能

Jieren Deng, Zhizhang Hu, Ziyan He, Aleksandar Cvetkovic, Pak Kiu Chung, Dragomir Yankov, Chiqun Zhang

机构 * Microsoft(微软) Amazon(亚马逊)

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 IMAIA通过自然语言交互整合矢量地图和卫星影像,结合地理空间信息提升地图相关问答和摄像头到地点的关联能力,实现空间感知的对话式地图系统。

Comments Accepted to The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15386 2026-03-17 cs.CV cs.AI 83%

RieMind: Geometry-Grounded Spatial Agent for Scene Understanding

RieMind:基于几何的场景理解空间智能体

Fernando Ropero, Erkin Turkoz, Daniel Matos, Junqing Du, Antonio Ruiz, Yanfeng Zhang, Lu Liu, Mingwei Sun, Yongliang Wang

机构 * Riemann Lab, Huawei Technologies(华为技术有限公司里斯曼实验室)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出RieMind,通过显式3D场景图实现空间推理,证明解耦感知与推理能显著提升空间推理能力,实验结果显示比现有方法提升16%-50%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15260 2026-03-17 cs.AI cs.CV 83%

AGCD: Agent-Guided Cross-Modal Decoding for Weather Forecasting

AGCD:面向天气预报的代理引导跨模态解码

Jing Wu, Yang Liu, Lin Zhang, Junbo Zeng, Jiabin Wang, Zi Ye, Guowen Li, Shilei Cao, Jiashun Cheng, Fang Wang, Meng Jin, Yerong Feng, Hong Cheng, Yutong Lu, Haohuan Fu, Juepeng Zheng

机构 * Sun Yat-sen University(中山大学) The Chinese University of Hong Kong(香港中文大学) Jiangxi Science and Technology Normal University(江西科技师范大学) China Meteorological Administration(中国气象局) Huawei Technologies Co., Ltd(华为技术有限公司) Guangdong-Hong Kong-Macao Greater Bay Area Weather Research Center for Monitoring Warning and Forecasting(粤港澳大湾区气象监测预警与预报研究中心) National Supercomputing Center in Shenzhen(深圳国家超算中心) Tsinghua University(清华大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 AGCD通过在解码时注入状态条件化的物理先验,提升天气预报的结构一致性和物理一致性,实验显示在不同分辨率和模型上均取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02046 2026-03-17 cs.CV cs.AI 83%

Agentic Retoucher for Text-To-Image Generation

面向文本到图像生成的代理修复器

Shaocheng Shen, Jianfeng Liang, Chunlei Cai, Cong Geng, Huiyu Duan, Xiaoyun Zhang, Qiang Hu, Guangtao Zhai

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出Agentic Retoucher框架,通过感知-推理-行动循环改进文本到图像生成的质量,引入GenBlemish-27K数据集进行评估,提升图像真实感与局部修正可靠性。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13245 2026-03-17 cs.AI 83%

Automating Document Intelligence in Statutory City Planning

在法定城市规划中自动化文档智能

Lars Malmqvist, Robin Barber

机构 * Research and Implementation(研究与实施)

专题命中 规划决策 :planning(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种集成AI系统,通过自动化识别和脱敏个人信息、提取元数据及分析建筑图纸,减轻规划官员处理大量文档的负担,降低合规风险。

Comments Accepted for presentation at Computing Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12908 2026-03-13 cs.CV cs.AI 83%

DeepSport: A Multimodal Large Language Model for Comprehensive Sports Video Reasoning via Agentic Reinforcement Learning

DeepSport: 一种基于代理强化学习的多模态大语言模型,用于通过主动推理实现综合体育视频理解

Junbo Zou, Haotian Xia, Zhen Ye, Shengjie Zhang, Christopher Lai, Vicente Ordonez, Weining Shen, Hanjie Chen

机构 * Georgia Institute of Technology(佐治亚理工学院) Rice University(Rice大学) Johns Hopkins University(约翰霍普金斯大学) University of California, Irvine(加州大学 Irvine分校) University of California, Santa Barbara(加州大学圣巴巴拉分校)

专题命中 规划决策 :agentic(title,abstract);tool-use(abstract);分类 cs.AI

AI总结 DeepSport通过代理强化学习实现多运动视频理解,首次端到端训练多任务模型,显著提升性能与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10092 2026-03-12 cs.CR cs.AI 83%

Execution Is the New Attack Surface: Survivability-Aware Agentic Crypto Trading with OpenClaw-Style Local Executors

执行是新的攻击面:面向OpenClaw风格的生存意识代理加密交易

Ailiya Borjigin, Igor Stadnyk, Ben Bilski, Serhii Hovorov, Sofiia Pidturkina

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出SAE,一种针对OpenClaw风格系统的生存意识执行标准,通过定义执行合同和强制执行不变量,提高代理加密交易的生存能力。

Comments 26 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07528 2026-03-11 cs.CL 83%

TableMind++: An Uncertainty-Aware Programmatic Agent for Tool-Augmented Table Reasoning

TableMind++: 一种面向工具增强表格推理的不确定性感知程序化代理

Mingyue Cheng, Shuo Yu, Chuang Jiang, Xiaoyu Tao, Qingyang Mao, Jie Ouyang, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.CL

AI总结 TableMind++通过引入不确定性感知推理框架,有效缓解LLM的幻觉问题,提升表格推理的准确性和鲁棒性。

Comments 6 tables, 9 figures. arXiv admin note: text overlap with arXiv:2509.06278

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09049 2026-03-11 cs.AI 83%

EPOCH: An Agentic Protocol for Multi-Round System Optimization

EPOCH:多轮系统优化的代理协议

Zhanlin Liu, Yitao Li, Munirathnam Srikanth

专题命中 规划决策 :agentic(title);autonomous agent(abstract);planning(abstract);分类 cs.AI

AI总结 EPOCH是一种用于多轮系统优化的代理协议,通过分阶段的结构化流程实现协调优化,提升自主改进工作的稳定性和可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22854 2026-03-10 cs.LG cs.MA 83%

CRAwDAD: Causal Reasoning Augmentation with Dual-Agent Debate

基于双智能体辩论的因果推理增强:CRAwDAD

Finn G. Vamosi, Nils D. Forkert

机构 * Department of Computer Science, University of Calgary(卡莱尔大学计算机科学系) Department of Radiology, Hotchkiss Brain Institute, and Alberta Children’s Hospital Research Institute, University of Calgary(卡莱尔大学放射学系、霍奇基斯脑研究所及阿尔伯塔儿童医院研究所在卡莱尔大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.LG

AI总结 CRAwDAD通过双智能体辩论框架提升因果推理准确性,利用推理语言模型在因果推理和辩论中实现性能提升。

Comments 12 pages, 8 figures. Code available at https://github.com/finnvamosi/CRAwDAD

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15828 2026-03-10 cs.RO cs.AI 83%

Context Matters! Relaxing Goals with LLMs for Feasible 3D Scene Planning

情境至关重要!利用LLMs进行可行的3D场景规划

Emanuele Musumeci, Michele Brienza, Francesco Argenziano, Abdel Hakim Drid, Vincenzo Suriani, Daniele Nardi, Domenico D. Bloisi

机构 * Department of Computer, Automation and Management Engineering, Sapienza University of Rome(Sapienza大学计算机、自动化与管理工程系) Department of Electronics and Automation, Mohamed Khider University of Biskra(Mohamed Khider大学电子与自动化系) International University of Rome UNINT, Rome(罗马国际大学UNINT)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 ContextMatters结合LLMs与经典规划,通过分层目标放松提升3D场景规划的成功率

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05294 2026-03-10 cs.AI 83%

STRUCTUREDAGENT: Planning with AND/OR Trees for Long-Horizon Web Tasks

STRUCTUREDAGENT:基于AND/OR树的长周期网络任务规划

ELita Lobo, Xu Chen, Jingjing Meng, Nan Xi, Yang Jiao, Chirag Agarwal, Yair Zick, Yan Gao

机构 * University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) Amazon(亚马逊) Virginia Commonwealth university(弗吉尼亚 Commonwealth 大学) University of Virginia(弗吉尼亚大学)

专题命中 规划决策 :planning(title,abstract);agentic(abstract);分类 cs.AI

AI总结 STRUCTUREDAGENT通过动态AND/OR树和结构化记忆模块提升长周期网络任务的规划能力,实现更高效的搜索与约束满足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00814 2026-03-09 cs.RO cs.LG cs.SY eess.SY 83%

Real-Time Learning of Predictive Dynamic Obstacle Models for Robotic Motion Planning

实时学习预测性动态障碍物模型用于机器人运动规划

Stella Kombo, Masih Haseli, Skylar X. Wei, Joel W. Burdick

机构 * Division of Engineering and Applied Science, California Institute of Technology(工程与应用科学分校,加州理工学院) Applied Intuition(应用直觉)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG

AI总结 本文提出一种实时学习动态障碍物预测模型的方法,通过改进的Hankel-DMD实现去噪和多步预测,适用于机器人运动规划。

Comments 10 pages, 6 figures, submitted to IEEE International Conference on Robotics and Automation (ICRA) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13386 2026-03-09 cs.RO cs.LG 83%

VEGA: Electric Vehicle Navigation Agent via Physics-Informed Neural Operator and Proximal Policy Optimization

VEGA:基于物理信息神经算子和近端策略优化的电动汽车导航代理

Hansol Lim, Minhyeok Im, Jonathan Boyack, Jee Won Lee, Jongseong Brad Choi

机构 * Department of Mechanical Engineering, State University of New York(机械工程系,纽约州立大学) Department of Computer Science, State University of New York(计算机科学系,纽约州立大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.LG

AI总结 VEGA通过结合物理信息神经算子和近端策略优化,为电动汽车提供高效的能耗感知导航方案,实现快速路径规划和充电站点选择。

Comments This work has been submitted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04900 2026-03-06 cs.AI 83%

EvoTool: Self-Evolving Tool-Use Policy Optimization in LLM Agents via Blame-Aware Mutation and Diversity-Aware Selection

EvoTool: 通过责备感知变异和多样性感知选择实现LLM代理中自演化工具使用策略优化

Shuo Yang, Soyeon Caren Han, Xueqi Ma, Yan Li, Mohammad Reza Ghasemi Madani, Eduard Hovy

机构 * School of Computing and Information Systems, The University of Melbourne(计算与信息系统学院,墨尔本大学)

专题命中 规划决策 :tool-use(title,abstract);agent(abstract);分类 cs.AI

AI总结 EvoTool通过责备感知变异和多样性感知选择,优化LLM代理的模块化工具使用策略,提升效率与可迁移性。

Comments Work under review, 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22571 2026-03-06 cs.AI 83%

PerfGuard: A Performance-Aware Agent for Visual Content Generation

PerfGuard: 一种面向视觉内容生成的性能感知代理

Zhipeng Chen, Zhongrui Zhang, Chao Zhang, Yifan Xu, Lan Yang, Jun Liu, Ke Li, Yi-Zhe Song

机构 * School of Artificial Intelligence, Beijing University of Posts and Telecommunications, China(北京邮电大学人工智能学院) Beijing Digital Native Digital City Research Center, China(北京数字原生数字城市研究中心) School of Computer Science and Engineering, Beihang University, China(北航计算机科学与工程学院) SketchX, CVSSP, University of Surrey, United Kingdom(SketchX、CVSSP、英国萨里大学) Chenxi Shuzhi (Beijing) Technology Co., Ltd, China(北京晨曦智数科技有限公司)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 PerfGuard通过性能感知机制提升视觉内容生成任务中工具选择的准确性与执行可靠性。

Comments This paper has been accepted by ICLR 2026. The original paper link is: https://openreview.net/pdf?id=tdN42GTv4S The code repository link is: https://github.com/FelixChan9527/PerfGuard

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07441 2026-03-05 cs.CR cs.AI 83%

AudAgent: Automated Auditing of Privacy Policy Compliance in AI Agents

AudAgent: AI代理隐私政策合规性自动审计

Ye Zheng, Yimin Chen, Yidan Hu

机构 * Rochester Institute of Technology(罗切斯特技术学院) University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 AudAgent通过自动化隐私审计工具,实时监控AI代理的数据实践,确保其符合声明的隐私政策,并可视化检测到的隐私违规行为。

Comments Accepted by PETS'26 (issue 3)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21533 2026-03-03 cs.RO cs.AI 83%

Model Predictive Adversarial Imitation Learning for Planning from Observation

基于模型预测的对抗模仿学习用于从观察中规划

Tyler Han, Yanda Bao, Bhaumik Mehta, Gabriel Guo, Anubhav Vishwakarma, Emily Kang, Sanghun Jung, Rosario Scalise, Jason Zhou, Bryan Xu, Byron Boots

机构 * Paul G. Allen School of Computer Science & Engineering(保罗·G·阿伦计算机科学与工程学院)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出一种基于模型预测的对抗模仿学习方法,通过端到端学习从观察中规划,提升样本效率和鲁棒性。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01927 2026-03-03 cs.AI cs.MA 83%

From Grounding to Planning: Benchmarking Bottlenecks in Web Agents

从基础到规划:网络代理中的瓶颈基准测试

Segev Shlomov, Ben wiesel, Aviad Sela, Ido Levy, Liane Galanti, Roy Abitbol

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文通过分析网络代理的规划和基础组件,发现规划是性能退化的主要原因,提出新的基准测试以改进代理能力。

Journal ref ECAI 2025 - 28th European Conference on Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00873 2026-03-03 cs.AI 83%

MC-Search: Evaluating and Enhancing Multimodal Agentic Search with Structured Long Reasoning Chains

MC-Search:基于结构化长推理链评估和增强多模态代理搜索

Xuying Ning, Dongqi Fu, Tianxin Wei, Mengting Ai, Jiaru Zou, Ting-Wei Li, Hanghang Tong, Yada Zhu, Hendrik Hamann, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Meta IBM Research(IBM研究院) Stony Brook University(石溪大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 MC-Search是首个针对代理MM-RAG的基准,通过结构化长推理链评估和增强多模态代理搜索,揭示了系统性问题并改进了模型的规划和检索能力。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00676 2026-03-03 cs.AI 83%

K^2-Agent: Co-Evolving Know-What and Know-How for Hierarchical Mobile Device Control

K^2-Agent: 为分层移动设备控制共进化知什么和知如何

Zhe Wu, Donglin Mo, Hongjin Lu, Junliang Xing, Jianheng Liu, Yuheng Jing, Kai Li, Kun Shao, Jianye Hao, Yuanchun Shi

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Huawei Noah’s Ark Lab(华为诺亚实验室) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 K2-Agent通过分层框架共进化声明性与程序性知识,提升复杂移动设备任务的规划与执行能力,实现76.1%的成功率和跨任务的强泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00540 2026-03-03 cs.AI 83%

LOGIGEN: Logic-Driven Generation of Verifiable Agentic Tasks

LOGIGEN: 逻辑驱动的可验证代理任务生成

Yucheng Zeng, Weipeng Lu, Linyun Liu, Shupeng Li, Zitian Qu, Chenghao Zhu, Shaofei Li, Zhengdong Tan, Mengyue Liu, Haotian Zhao, Zhe Zhou, Jianmin Wu

机构 * Baidu Inc.(百度公司) Tsinghua University(清华大学)

专题命中 规划决策 :agentic(title);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 LOGIGEN通过逻辑驱动和验证训练生成可验证的复杂任务,提升代理在复杂环境中的任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00532 2026-03-03 cs.AI 83%

DenoiseFlow: Uncertainty-Aware Denoising for Reliable LLM Agentic Workflows

DenoiseFlow:面向可靠LLM代理工作流的不确定性感知去噪

Yandong Yan, Junwei Peng, Shijie Li, Chenxi Li, Yifei Shang, Can Deng, Ruiting Dai, Yongqiang Zhao, Jiaqi Zhu, Yu Huang

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) School of Electronics Engineering and Computer Science, Peking University(北京大学电子工程与计算机科学学院) SKLCCSE, School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) Tsinghua University(清华大学) University of Electronic Science and Technology of China(电子科技大学) Key Laboratory of High Confidence Software Technologies(PKU), MOE(北京大学高可信软件技术重点实验室) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) National Engineering Research Center for Software Engineering, Peking University(软件工程国家工程研究中心)

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 DenoiseFlow通过闭环框架实现多步推理的不确定性感知去噪,提升LLM代理工作流的可靠性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01107 2026-03-03 cs.RO cs.LG 83%

SLAP: Shortcut Learning for Abstract Planning

SLAP:抽象规划的快捷学习

Y. Isabel Liu, Bowen Li, Benjamin Eysenbach, Tom Silver

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG

AI总结 SLAP通过快捷学习方法自动发现抽象规划中的新选项,提升任务成功率和规划效率。

Comments Published at the International Conference on Learning Representations (ICLR) 2026. Code available at https://github.com/isabelliu0/SLAP

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09951 2026-03-03 q-bio.NC cs.LG 83%

Emergence of Spatial Representation in an Actor-Critic Agent with Hippocampus-Inspired Sequence Generator

具有海马体启发序列生成器的Actor-Critic智能体中空间表示的出现

Xiao-Xiong Lin, Yuk-Hoi Yiu, Christian Leibold

机构 * Faculty of Biology & Bernstein Center Freiburg & BrainLinks-BrainTools Center University of Freiburg(生物学系及弗赖堡伯尔尼中心、BrainLinks-BrainTools中心、弗赖堡大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.LG

AI总结 该研究通过海马体启发的序列生成器和Actor-Critic学习者,揭示稀疏输入与序列生成动态的协同作用,为导航任务中的强化学习提供新的归纳偏置。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23668 2026-03-02 cs.AI cs.SY eess.SY 83%

PseudoAct: Leveraging Pseudocode Synthesis for Flexible Planning and Action Control in Large Language Model Agents

PseudoAct: 通过伪代码合成实现大型语言模型代理的灵活规划与动作控制

Yihan, Wen, Xin Chen

机构 * Department of Electrical and Computer Engineering, Texas A&M University(电气与计算机工程系,德克萨斯A&M大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 PseudoAct通过伪代码合成实现LLM代理的灵活规划与动作控制,提升长时决策效率。

详情

展开后加载摘要…

URL PDF HTML 收藏