Probabilistic Planning by Probabilistic Programming
专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI
Comments Article at AAAI-18 Workshop on Planning and Inference
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI
Comments Article at AAAI-18 Workshop on Planning and Inference
专题命中 规划决策 :planning(title,journal_ref);agent(abstract);multi-agent(abstract);分类 cs.AI
Journal ref Dans The International Conference on Automated Planning and Scheduling (2007)
AgenticER:实体解析的下一个前沿领域
专题命中 规划决策 :agentic(summary_cn,abstract);autonomous agent(abstract)
AI总结 针对现有实体解析被动范式无法适配异构流数据场景的问题,提出Agentic ER新范式,将其建模为自主智能体的序列决策过程,构建参考架构并明确研究挑战,开拓数据管理与智能体交叉的新研究方向。
Comments Vision paper submitted to VLDB, 6 pages
HEPTAPOD:编排高能物理工作流程以实现自主智能体
专题命中 规划决策 :agent(abstract);tool use(abstract);planning(abstract);workflow(abstract)
AI总结 研究针对高能物理工作流程,介绍HEPTAPOD编排框架,能集成外部大语言模型,使其与特定领域工具交互构建管理HEP管道,通过案例展示其能力,为高能物理中人工参与及智能体辅助工作流程奠定基础。
Comments 47 pages, 6 figures
VeriEvol:通过可验证的进化指令扩展多模态数学推理
机构 * Tsinghua University(清华大学) ; Tencent Hunyuan(腾讯混元)
专题命中 规划决策 :agent(summary_cn,abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出VeriEvol框架,通过类型感知进化模块生成更难的问题,并利用HTV-Agent验证器确保答案可靠性,从而在强化学习中扩展多模态数学推理数据,提升模型性能。
IPIBench: 在连续流下评估多模态大模型的交互式主动智能
机构 * College of AI, Tsinghua University(清华大学人工智能学院) ; ByteDance(字节跳动)
专题命中 规划决策 :agent(summary_cn,abstract);agentic(abstract)
AI总结 提出IPIBench基准,用于评估多模态大模型在流式视频场景中的交互式主动智能,并设计IPI-Agent框架以改善主动触发和交互协调。
异质科学基础模型协作
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 规划决策 :agent(abstract);planning(abstract);agentic(abstract);multi-agent(abstract)
AI总结 本文提出Eywa框架,通过将语言模型与领域特定基础模型结合,提升科学领域多模态任务的推理能力,实验显示其在结构化数据任务中表现更优。
Comments Preprint. 57 Pages
面向便携物品寻找的个性化具身导航
机构 * University of Maryland, College Park(马里兰大学学院公园分校) ; University of Central Florida(中央佛罗里达大学)
专题命中 规划决策 :planning(summary_cn,abstract);agent(abstract)
AI总结 本文提出了一种面向动态环境的个性化习惯学习方法,通过引入Transit-Aware Planning算法提升便携物品寻找的性能,在模拟和现实环境中均取得显著效果。
Comments 10 pages
学习多智能体局部避障以实现协作搬运任务 with 耦合四足机器人
机构 * Robotic Systems Lab, ETH Zurich(埃因斯坦理工大学机器人系统实验室)
专题命中 规划决策 :agent(title);multi-agent(title)
AI总结 本文提出基于强化学习的策略,使两台连接物体的四足机器人在未知环境中自主避障,无需预设路径或地图。
机构 * Trent Weiss 1 ; Amar Kulkarni 2 ; Madhur Behl 2
专题命中 规划决策 :agent(title);multi-agent(title)
Comments This work has been submitted to the IEEE for possible publication
专题命中 规划决策 :agent(title);multi-agent(title)
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; IBM Research AI(IBM人工智能研究) ; Columbia University(哥伦比亚大学)
专题命中 规划决策 :agent(abstract);tool use(abstract);planning(abstract);multi-agent(abstract)
Comments 36 Pages, 26 Figures, 5 Tables
机构 * Intelligent Space Robotics Laboratory(智能空间机器人实验室) ; Center for Digital Engineering(数字工程中心) ; Skolkovo Institute of Science and Technology(斯克尔科夫科学与技术研究所)
专题命中 规划决策 :agent(title);planning(title)
Comments Manuscript has been accepted at 2025 INTERNATIONAL CONFERENCE ON UNMANNED AIRCRAFT SYSTEMS (ICUAS)
专题命中 规划决策 :agent(title);multi-agent(title)
专题命中 规划决策 :agent(title);multi-agent(title)
Comments Accepted in the 59th IEEE Conference on Decision and Control (CDC 2020). arXiv admin note: text overlap with arXiv:1808.00312
专题命中 规划决策 :autonomous agent(title,abstract);agent(abstract,comments);multi-agent(comments)
Comments Accepted for: Engineering Multi-Agent Systems, 6th International Workshop, EMAS 2018, Stockholm, Sweden, 14-15 July, 2018, Revised, Selected, and Invited Papers
MetaRAG:面向智能体检索增强生成的信念-行动对齐策略优化
机构 * Zhejiang University(浙江大学) ; Ant Group(蚂蚁集团) ; City University of Hong Kong(香港城市大学)
专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 MetaRAG是面向智能体RAG的信念-行动对齐策略优化框架,通过优先验证的行动生成与内部信念探测,提升了智能体RAG的准确率-效率权衡,收益可迁移至多种场景与模型。
Comments EMNLP 2026 MainConference
ARGUS:基于心理理论(Theory-of-Mind)的论证生成,结合策略感知规划与知识接地
机构 * InspireOmni AI ; The Hong Kong Polytechnic University(香港理工大学)
专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.CL
AI总结 该研究提出基于智能体的Argus框架,结合心理理论推理、策略感知规划等,在三个基准上优于基线,可有效改变抗拒受众立场。
自进化科学智能体发现可泛化的物理推理流体控制
机构 * National University of Singapore(新加坡国立大学)
专题命中 规划决策 :agent(title,abstract);workflow(abstract);分类 cs.AI
AI总结 提出一种由大语言模型驱动的自进化科学智能体工作流,通过迭代代码生成和物理仿真诊断,自动构建可解释的控制器,并在欠驱动双关节狗鲨游泳器目标到达任务中实现零样本泛化。
通过规划实现高效的LLM协作
机构 * KAIST(韩国科学技术院) ; Yonsei University(延世大学)
专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI
AI总结 本文提出COPE框架,通过规划模型与执行模型的协作,提升小模型和大模型在复杂任务中的性能,同时显著降低推理成本。
Comments Accepted at TMLR 2026
面向美国联邦公路管理局(FHWA)桥梁检查合规性的基于边缘的智能体检索增强生成
专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI
AI总结 针对FHWA桥梁合规核查的痛点,提出离线智能体RAG系统BridgeGuard,结合向量搜索与SQL查询,在边缘硬件实现高准确率、高速的结构缺陷桥梁识别。
Comments 27 pages, 1 figure, 5 tables. Pre-print submitted to the ASCE Journal of Computing in Civil Engineering. Code and data available at: https://github.com/virajdarji/bridgeguard
面向人形机器人的专业网球风格:自适应运动规划与跟踪
机构 * Noitom Robotics(诺亦腾机器人) ; Shanghai AI Laboratory(上海人工智能实验室) ; Shanghai Jiao Tong University(上海交通大学) ; Dobot Robotics(越疆机器人)
专题命中 规划决策 :planning(title,abstract);分类 cs.AI
AI总结 本研究提出AdaPT框架,从广播视频学习专业网球风格,通过自适应机制弥合仿真到现实的差距,在Unitree G1和Dobot Atom人形机器人上验证了有效性,为相关系统提供了见解。
Comments 14 pages
基于视觉语言模型的证据门控任务与运动规划
机构 * Waseda University(早稻田大学) ; Flinders University(弗林德斯大学)
专题命中 规划决策 :planning(title,abstract);分类 cs.AI
AI总结 针对机器人执行自然语言指令长时操纵任务时的部分可观测问题,提出 EAFG 框架,通过视觉证据获取与可行性门控提升食谱完成率并减少无效操纵尝试。
基于潜世界模型的强化规划
机构 * Pantheon Industries(万神殿工业公司)
专题命中 规划决策 :planning(title,abstract);分类 cs.LG
AI总结 该研究提出RP1方法,将良好搜索规则强化到神经规划器中,可改进多步计划,在多个机器人任务中性能优于手工搜索算法,且效率更高。
Comments Preprint
AdaLens:用于监控和引导长时间运行的智能体数据分析的交互式故事情节
专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 针对长时间智能体数据分析的传统界面无法满足可观测性与可引导性需求,本文提出交互式系统AdaLens,结合故事情节表示与引导交互,经案例及用户研究验证其能有效支持分析师监控与引导此类分析。
PACE:用于去中心化金融中安全AI智能体的策略验证合约执行
专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.AI
AI总结 该研究提出PACE框架,通过引入类型化交易意图等机制,实现去中心化金融中AI智能体的安全交易授权,在确定性沙箱中实现0.00不安全执行率和0.00误报率,提升了DeFi场景下AI智能体的安全性。
VISOR: 通过迭代搜索和超视距推理实现基于视觉检索的增强生成
机构 * Soochow University(苏州大学) ; Baidu Inc.(百度公司)
专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 VISOR通过结构化证据空间和动态轨迹机制解决多步推理中的视觉证据稀疏和搜索漂移问题,实现高效长视距视觉推理。
Comments Accepted by ACM Multimedia 2026 (MM '26). 8 pages, 3 figures. Code: https://github.com/syc1336/VISOR
AstronOS:面向长周期智能体系统的统一执行模型与运行时
专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 AstronOS是面向长周期智能体系统的统一执行模型与运行时,其介导的交接策略在三阶段任务中通过率远高于其他策略,虽时间成本更高但端到端表现更优。
Comments 23 pages, 2 figures, 13 tables. Zhenhang Nie and Gui Zheng contributed equally; Gui Zheng and Bin Zhang are corresponding authors
无干净参考的智能体数据清洗:能力与权衡的实验研究
机构 * Faculty of Arts and Sciences(文理学院) ; University of Sciences and Arts in Lebanon(黎巴嫩科学与艺术大学)
专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 本研究提出整合多组件的基于证据的无参考智能体数据清洗框架,经多数据集实验发现,额外能力会在多指标间引入权衡,无配置在所有标准上最优。
Comments 21 pages, 3 figures, Submitted to New Generation Computing
基于期望自由能的火星探测机器人信息路径规划
机构 * TU Eindhoven(埃因霍温理工大学) ; Cajal Centre for Neuroscience, Spanish National Research Council(西班牙国家研究委员会卡哈尔神经科学中心)
专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG
AI总结 该研究提出将主动推理的期望自由能作为统一准则,用于预算约束下的机器人信息路径规划,其规划方法在火星探测场景中可同时实现精准地图构建与高价值区域定位,性能优于信息论基准方法。
Comments accepted for IWAI 2026