arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35547 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35547 篇

2511.02748 2026-06-08 cs.NI cs.LG 版本更新 79%

Agentic World Modeling for 6G: Near-Real-Time Generative State-Space Reasoning

面向6G的智能体世界建模:近实时生成式状态空间推理

Farhad Rezazadeh, Amir Ashtari Gargari, Hatim Chergui, Sandra Lagen, Merouane Debbah, Houbing Song, Lingjia Liu

机构 * BrainOmega and the Technical University of Catalonia (UPC)(BrainOmega 和 哈佛大学(UPC)) Centre Tecnologic de Telecomunicacions de Catalunya (CTTC/CERCA)(巴塞罗那电信技术中心(CTTC/CERCA)) i2CAT Foundation(i2CAT 基金会) Khalifa University of Science and Technology(科技 Khalifa 大学) University of Maryland, Baltimore County (UMBC)(马里兰大学巴尔的摩分校(UMBC)) Virginia Tech(弗吉尼亚理工学院)

专题命中 规划决策 :agentic(title,abstract);分类 cs.LG

AI总结 提出基于世界建模的智能体框架WM-MS3M,通过生成式状态空间实现6G网络近实时反事实推理与资源分配,在O-RAN数据上降低预测误差并加速推理。

Comments 13 Pages, 3 Figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26615 2026-06-08 cs.CL 版本更新 79%

SlideAgent: Hierarchical Agentic Framework for Multi-Page Visual Document Understanding

SlideAgent:用于多页视觉文档理解的分层代理框架

Yiqiao Jin, Rachneet Kaur, Zhen Zeng, Sumitra Ganesh, Srijan Kumar

机构 * Georgia Institute of Technology(佐治亚理工学院) J.P. Morgan AI Research(摩根大通AI研究)

专题命中 规划决策 :agentic(title,abstract);分类 cs.CL

AI总结 提出SlideAgent,一种用于多模态多页文档(如幻灯片)理解的分层代理框架,通过全局、页面和元素三级推理构建结构化表示,在专有和开源模型上分别提升7.9%和9.8%的准确率。

Comments ACL 2026 Main Conference. https://slideagent.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08903 2026-06-08 cs.RO cs.AI 79%

3D-Grounded Vision-Language Framework for Robotic Task Planning: Automated Prompt Synthesis and Supervised Reasoning

面向机器人任务规划的3D grounded视觉-语言框架:自动化提示合成与监督推理

Guoqin Tang, Qingxuan Jia, Zeyuan Huang, Gang Chen, Ning Ji, Zhipeng Yao

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出融合2D提示合成模块和小语言模型的框架,提升机器人3D场景理解与任务执行能力,实验显示任务成功率高达96.0%。

Journal ref Engineering Applications of Artificial Intelligence, vol. 164, p. 113268, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06079 2026-06-05 cs.CL 79%

SkillComposer: Learning to Evolve Agent Skills for Specification and Generalization

SkillComposer: 学习演化智能体技能以实现特化与泛化

Qi Zhang, Zhaopeng Feng, Xiaonan Shi, Xiaomeng Hu, Chu Liu, Pengjun Xie, Xiaobin Wang, Jieping Ye, Bryan Hooi, Haobo Wang, Junbo Zhao

机构 * Zhejiang University(浙江大学) Tongyi Lab(通义实验室) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 提出SkillComposer框架,通过创建、改进和合并三种可学习操作,使语言模型在推理时自我演化技能,支持离线、在线和混合部署模式,在多个基准上提升性能。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06077 2026-06-05 cs.RO cs.LG 79%

3D Underwater Path Planning via Generative Flow Field Surrogates

基于生成流场代理的三维水下路径规划

Zachary Cooper-Baldock, Paulo E. Santos, Russell S. A. Brinkworth, Karl Sammut

机构 * Flinders University(弗林德斯大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 针对自主水下航行器回收过程中复杂三维螺旋桨尾流的高成本CFD仿真问题,提出用条件生成对抗网络(cGAN)作为替代,结合能量加权A*路径规划,实现快速且有效的路径规划。

Comments 41 pages, 5 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06041 2026-06-05 cs.RO cs.AI cs.NE 79%

Sample-efficient Low-level Motion Planning for Robotic Manipulation Tasks via Zero-shot Transfer Learning

通过零样本迁移学习实现机器人操作任务的样本高效低级运动规划

Yuanzhi He, Victor Romero-Cano, José J. Patiño, Juan David Hernández, William Sawtell, Gualtiero Colombo

机构 * School of Computer Science & Informatics, Cardiff University, Cardiff, UK(计算机科学与信息学系,卡迪夫大学,卡迪夫,英国)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出iCEM+TL框架,通过迁移学习和奖励重塑提高复杂操作任务的成功率,仿真中提升高达23%,并在真实机器人上验证。

Comments 12 pages, 5 figures, International Conference on Artificial Neural Networks (ICANN) 2026 conference accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06014 2026-06-05 cs.AI cs.RO 79%

PLAN-S: Bridging Planning with Latent Style Dynamics for Autonomous Driving World Models

PLAN-S:通过潜在风格动态桥接规划以实现自动驾驶世界模型

Xiaoyun Qiu, Jingtao He, Yijie Chen, Yusong Huang, Haotian Wang, Yixuan Wang, Xinhu Zheng

机构 * Intelligent Transportation Thrust, Systems Hub, and Center of Seamless Connectivity & Connected Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(智能交通 thrust、系统中心及无缝连接与智能连接研究院,香港科学与技术大学(广州))

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出PLAN-S框架,通过从潜在表示解码风格条件语义成本图,解决自动驾驶中潜在世界模型规划的可控性问题,在nuScenes和NAVSIM上降低了碰撞率并提升了驾驶性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05836 2026-06-05 cs.CL 79%

ProSPy: A Profiling-Driven SQL-Python Agentic Framework for Enterprise Text-to-SQL

ProSPy: 面向企业级Text-to-SQL的剖析驱动的SQL-Python智能体框架

Zhaorui Yang, Huawei Zheng, Sen Yang, Yuhui Zhang, Haoxuan Li, Zhizhen Yu, Xuan Yi, Chen Hou, Defeng Xie, Chao Hu, Minfeng Zhu, Dazhen Deng, Haozhe Feng, Danqing Huang, Yingcai Wu, Peng Chen, Wei Chen

机构 * State Key Lab of CAD&CG(计算机辅助设计与图形学国家重点实验室) School of Software Technology(软件技术学院) Tencent TEG(腾讯科技集团) School of Mathematical Sciences, Peking University(北京大学数学科学学院) Zhejiang University(浙江大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.CL

AI总结 提出ProSPy框架,通过自动剖析、模式剪枝、中间视图获取和Python分析四阶段,结合SQL高效性与Python灵活性,解决企业级数据库Text-to-SQL中的模式异构、元数据不完整和复杂分析问题。

Comments 24 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05395 2026-06-05 cs.RO cs.AI 79%

VASO: Formally Verifiable Self-Evolving Skills for Physical AI Agents

VASO:物理AI智能体的形式可验证自进化技能

Yunhao Yang, Neel P. Bhatt, Kevin Wang, Samuel Tetteh, Zhangyang Wang, Ufuk Topcu

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Iowa State University(爱荷华州立大学)

专题命中 规划决策 :AI agent(title,abstract);分类 cs.AI

AI总结 提出VASO框架,通过形式验证引导LLM生成的机器人技能合约自进化,将模型检查的反例转化为文本梯度更新技能合约,无需微调模型权重,在Jackal和四旋翼任务中达到97.2%的形式规范符合率。

Comments Project webpage: https://languagegroundedriskdetection.github.io/ProjectPage/vaso-webpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03662 2026-06-05 cs.SE 79%

Agentic Generation and Evolution of Knowledge Models

知识模型的智能生成与演化

Man Zhang, Tao Yue, Nazareno M. Aguirre, Diego Garbervetsky, Sebastian Uchitel

专题命中 规划决策 :agentic(title,abstract);分类 cs.SE

AI总结 提出TrustModel框架,通过三个智能子系统(建模、一致性、演化)实现知识模型的持续生成与演化,以支持动态环境下复杂软件系统的可信工程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25158 2026-06-05 cs.AI 79%

Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills

Trace2Skill: 将轨迹局部经验转化为可迁移的代理技能

Jingwei Ni, Yihao Liu, Xinpeng Liu, Yutao Sun, Mengyu Zhou, Pengyu Cheng, Dexin Wang, Erchao Zhao, Xiaoxi Jiang, Guanjun Jiang

机构 * ETH Zürich University of Zurich(苏黎世联邦理工学院) Peking University(北京大学) Zhejiang University(浙江大学) Qwen Large Model Application Team, Alibaba(阿里巴巴文心一言应用团队)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出Trace2Skill框架,通过归纳推理将广泛执行轨迹整合为统一的技能目录,有效提升代理技能的可迁移性和实用性,适用于多种领域。

Comments Work in Progress. May version add more experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21162 2026-06-05 cs.IR cs.AI cs.DB 79%

A2RAG: Adaptive Agentic Graph Retrieval for Cost-Aware and Reliable Reasoning

A2RAG:面向成本感知和可靠推理的自适应代理图检索

Jiate Liu, Zebin Chen, Shaobo Qiao, Mingchen Ju, Danting Zhang, Bocheng Han, Shuyue Yu, Xin Shu, Jinglin Wu, Dong Wen, Xin Cao, Guanfeng Liu, Zhengyi Yang

机构 * University of New South Wales(新南威尔士大学) Euler AI Sigma Trading Management(Sigma 交易管理) Eigenflow AI Macquarie University(麦考瑞大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出A2RAG框架,通过自适应控制器和代理检索器解决图检索中成本和可靠性问题,提升多跳问答的准确率并减少计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04226 2026-06-04 cs.RO cs.AI 79%

PerceptTwin: Semantic Scene Reconstruction for Iterative LLM Planning and Verification

PerceptTwin:面向迭代LLM规划与验证的语义场景重建

Charlie Gauthier, Sacha Morin, Liam Paull

机构 * Department of Computer Science and Operations Research, Université de Montréal(蒙特利尔大学计算机科学与运筹学系) Mila - Quebec AI Institute(魁北克人工智能研究所) CIFAR AI Chair(CIFAR人工智能主席)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出PerceptTwin自动管道,从机器人感知的语义场景表示构建交互式仿真,结合LLM法官验证规划正确性与人类偏好,提升规划成功率约39%。

Comments Accepted at ICRA 2026 (Vienna); published on arxiv for archival purposes. See also https://percept-twin.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29584 2026-06-04 cs.CL 79%

GAPD: Gold-Action Policy Distillation for Agentic Reinforcement Learning in Knowledge Base Question Answering

GAPD:面向知识库问答中智能体强化学习的金动作策略蒸馏

Xin Sun, Jianan Xie, Zhongqi Chen, Qiang Liu, Shu Wu, Bowen Song, Weiqiang Wang, Zilei Wang, Liang Wang

机构 * University of Science and Technology of China(中国科学技术大学) NLPR, MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ShanghaiTech University(上海科技大学) Ant Group(蚂蚁集团)

专题命中 规划决策 :agentic(title,abstract);分类 cs.CL

AI总结 提出GAPD框架,通过中间锚点匹配将金动作序列与在线策略对齐,为基于强化学习的知识库问答提供密集的令牌级指导,在多个基准上取得最优结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27191 2026-06-04 cs.RO cs.AI 79%

Vectorized Online POMDP Planning

向量化在线POMDP规划

Marcus Hoerger, Muhammad Sudrajat, Hanna Kurniawati

机构 * School of Computing, Australian National University(澳大利亚国立大学计算机学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出向量化在线POMDP规划器(VOPP),通过全向量化计算消除并行瓶颈,实现大规模并行在线规划,计算效率比现有最先进并行求解器高至少20倍。

Comments 8 pages, 3 figures. Accepted at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.08229 2026-06-04 cs.AI cs.RO cs.SY eess.SY 79%

Optimal Continuous State POMDP Planning with Semantic Observations: A Variational Approach

基于语义观测的最优连续状态POMDP规划:一种变分方法

Luke Burks, Ian Loefgren, Nisar Ahmed

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于变分方法的最优规划策略,针对语义观测下的连续状态部分可观测马尔可夫决策过程(CPOMDP)进行改进,通过变分贝叶斯方法解决混合连续-离散概率模型的表示和推理问题,提升了动态决策任务的效率和鲁棒性。

Comments Final version accepted to IEEE Transactions on Robotics (in press as of August 2019)

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.04595 2026-06-04 cs.RO cs.AI cs.SY eess.SY 79%

Simultaneous Contact, Gait and Motion Planning for Robust Multi-Legged Locomotion via Mixed-Integer Convex Optimization

通过混合整数凸优化实现鲁棒多足运动的同步接触、步态和运动规划

Bernardo Aceituno-Cabezas, Carlos Mastalli, Hongkai Dai, Michele Focchi, Andreea Radulescu, Darwin G. Caldwell, Jose Cappelletto, Juan C. Grieco, Gerardo Fernandez-Lopez, Claudio Semini

机构 * School of Electrical and Computer Engineering, Georgia Institute of Technology, Atlanta, GA 30332 USA(电气与计算机工程系,佐治亚理工学院,亚特兰大,GA 30332 USA) Twentieth Century Fox, Springfield, USA(二十世纪福克斯,斯普林菲尔德,USA) Starfleet Academy, San Francisco, CA 96678 USA(星际舰队学院,旧金山,CA 96678 USA) Tyrell Inc., 123 Replicant Street, Los Angeles, CA 90210 USA(泰勒尔公司,123 复制人街,洛杉矶,CA 90210 USA)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种混合整数凸优化方法,用于同时规划多足机器人的接触位置、步态转换和运动,以提高运动的通用性并保持低计算时间。

Comments 8 pages, IEEE Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.08124 2026-06-04 cs.AI cs.SY eess.SY 79%

Approximate Dynamic Programming for Planning a Ride-Sharing System using Autonomous Fleets of Electric Vehicles

为使用自动驾驶电动车的拼车系统进行规划的近似动态规划

Lina Al-Kanj, Juliana Nascimento, Warren B. Powell

机构 * Operations Research and Financial Engineering Department(运筹学与金融工程系)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文研究了自动驾驶电动车拼车系统中的调度问题、 surge定价问题和车队规模规划问题,采用近似动态规划方法来优化车辆分配、充电和重新定位决策,并通过分层聚合技术提高价值函数估计的准确性,同时利用自适应学习方法确定每趟行程的定价。

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.09914 2026-06-04 eess.SY cs.AI cs.MA cs.RO cs.SY 79%

RADMPC: A Fast Decentralized Approach for Chance-Constrained Multi-Vehicle Path-Planning

RADMPC:一种用于机会约束多车辆路径规划的快速去中心化方法

Aaron Huang, Benjamin J. Ayton, Brian C. Williams

机构 * Computer Science and Artificial Intelligence Laboratory(计算机科学与人工智能实验室) Massachusetts Institute of Technology(麻省理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于去中心化路径规划方法RADMPC的快速机会约束多车辆路径规划方法,通过评估车辆交互来确定需要耦合规划的车辆集,并利用IRA在较小的车辆集上快速规划安全路径,从而显著提高计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
1802.04205 2026-06-04 cs.RO cs.AI cs.SY eess.SY 79%

Efficient Hierarchical Robot Motion Planning Under Uncertainty and Hybrid Dynamics

在不确定性和混合动力学下的高效机器人运动规划

Ajinkya Jain, Scott Niekum

机构 * Department of Mechanical Engineering(机械工程系) Department of Computer Science(计算机科学系) University of Texas at Austin, USA(得克萨斯大学奥斯汀分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种分层POMDP规划器,用于在存在不确定性的情况下为混合动力学模型生成成本优化的运动计划,通过将非线性动力学分解为离散的局部动力学模型,从而有效减少状态不确定性。

Comments 2nd Conference on Robot Learning (CoRL 2018), Zurich, Switzerland

详情

展开后加载摘要…

URL PDF HTML 收藏
1802.08327 2026-06-04 cs.SE cs.RO cs.SY eess.SY 79%

From Hazard Analysis to Hazard Mitigation Planning: The Automated Driving Case

从危险分析到危险缓解规划:自动驾驶案例

Mario Gleirscher, Stefan Kugele

专题命中 规划决策 :planning(title,abstract);分类 cs.SE

AI总结 本文提出一个框架,用于分析和设计能够实时识别和缓解危险的规划器,同时介绍构建规划模型的增量算法及基于给定控制系统架构设计故障容错控制器的示例应用。

Journal ref Barrett C., Davies M., Kahsai T. (eds) NASA Formal Methods. LNCS, vol 10227. Springer

详情

展开后加载摘要…

URL PDF HTML 收藏
1801.07229 2026-06-04 cs.AI cs.SY eess.SY 79%

Combinatorial framework for planning in geological exploration

地质勘探规划的组合框架

Mark Sh. Levin

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种用于油气田地质勘探规划的组合框架,通过多属性评估、层次化设计和区域整合,优化勘探方案。

Comments 14 pages, 15 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
1712.09356 2026-06-04 cs.AI cs.SY eess.SY 79%

An Online Ride-Sharing Path Planning Strategy for Public Vehicle Systems

面向公共交通系统的在线拼车路径规划策略

Ming Zhu, Xiao-Yang Liu, Xiaodong Wang

机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种高效的在线拼车路径规划策略,通过过滤不符合乘客服务质量的请求,将全局搜索转化为局部搜索,从而降低计算复杂度,实验表明计算时间比穷举法减少22%。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1602.06667 2026-06-04 cs.RO cs.AI cs.SY eess.SY 79%

A Motion Planning Strategy for the Active Vision-Based Mapping of Ground-Level Structures

一种用于主动视觉建图的地面结构运动规划策略

Manikandasriram Srinivasan Ramanagopal, André Phu-Van Nguyen, Jerome Le Ny

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种指导配备摄像头或深度传感器的地面机器人自主建图有限三维结构可见部分的策略,通过运动规划算法确定合适视角并自动填补点云中的空洞,适用于建筑、施工和检测领域。

Comments Accepted for publication in IEEE Transactions on Automation Science and Engineering. Available in IEEE Xplore at http://ieeexplore.ieee.org/document/8093664

详情

展开后加载摘要…

URL PDF HTML 收藏
1702.02628 2026-06-04 cs.AI cs.SY eess.SY 79%

Optimal Detection of Faulty Traffic Sensors Used in Route Planning

用于路线规划的故障交通传感器最优检测

Amin Ghafouri, Aron Laszka, Abhishek Dubey, Xenofon Koutsoukos

机构 * Vanderbilt University(范德比大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出基于高斯过程的预测模型,用于检测故障交通传感器,减少误报和漏报对路线规划的影响,并通过实测数据验证方法有效性。

Comments Proceedings of The 2nd Workshop on Science of Smart City Operations and Platforms Engineering (SCOPE 2017), Pittsburgh, PA USA, April 2017, 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1606.05124 2026-06-04 cs.RO cs.AI cs.SY eess.SY 79%

Robust Active Perception via Data-association aware Belief Space planning

通过数据关联意识的信念空间规划实现鲁棒的主动感知

Shashank Pathak, Antony Thomas, Asaf Feniger, Vadim Indelman

机构 * Department of Aerospace Engineering, Technion - Israel Institute of Technology(航空航天工程系,技术ion-以色列理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种结合数据关联推理的信念空间规划方法,以应对定位不确定性和感知模糊环境中的挑战,通过设计新的成本函数提升主动解歧能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
1604.02080 2026-06-04 cs.AI cs.SY eess.SY 79%

Planning with Information-Processing Constraints and Model Uncertainty in Markov Decision Processes

在马尔可夫决策过程中的信息处理约束与模型不确定性规划

Jordi Grau-Moya, Felix Leibfried, Tim Genewein, Daniel A. Braun

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Max Planck Institute for Biological Cybernetics(马克斯·普朗克生物 cybernetics 研究所) Graduate Training Centre for Neuroscience(神经科学研究生培训中心)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出考虑模型不确定性的马尔可夫决策过程规划方法,通过信息论原理统一解决信息处理约束问题,结合广义变分原理推导价值迭代方案,并在网格世界模拟中验证其有效性。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03512 2026-06-03 cs.RO cs.AI 79%

SPADE: Sketch-guided Path Planning Augmented with Diffusion Experts

SPADE: 草图引导的路径规划增强扩散专家

Charbel Abi Hana, Tatiana Ghantous, Mikael Khalil, Anthony Rizk

机构 * IDEALworks GmbH IMT Atlantique IDEALworks GmbH & Saint Joseph University of Beirut(IDEALworks GmbH及贝鲁特圣约瑟夫大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出一种结合扩散增强的框架,通过改进的标注工具和训练策略,在保持实时性的同时提升路径规划的泛化能力和鲁棒性,显著降低姿态误差和FID。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03169 2026-06-03 cs.SD cs.LG cs.MM 79%

SketchSong: Hierarchical Song Generation with Sketch Planning and Fine-Grained Multi-Track Modeling

SketchSong: 基于草图规划与细粒度多轨建模的分层歌曲生成

Xiaoyue Duan, Nanxing Hu, Yutang Feng, Xudong Yan, Jiatao Chen, Jinchao Zhang, Jie Zhou

机构 * Pattern Recognition Center, WeChat AI, Tencent Inc.(腾讯人工智能研究院)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出分层歌曲生成框架SketchSong,通过歌曲级草图规划和细粒度多轨建模解决歌曲编排不连贯及声部建模粗糙问题,在客观指标和人工听测上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02747 2026-06-03 cs.CV cs.AI 79%

Plan2Map: A Multimodal Benchmark for Document-Grounded Geospatial Boundary Reconstruction from Planning Records

Plan2Map: 基于规划记录的文档驱动地理空间边界重建的多模态基准

Fabian Degen, Oishi Deb, Jindong Gu, Junchi Yu, Samuele Marro, Philip Torr, Jialin Yu

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出Plan2Map基准和GeoPlanAgent系统,通过文档证据提取、定位、地图配准、边界分割等步骤,从英国规划记录中重建地理空间边界,显著优于直接VLM方法。

Comments Project page: https://odeb1.github.io/Plan2Map_Project_Page/. Fabian Degen and Oishi Deb Contributed Equally

详情

展开后加载摘要…

URL PDF HTML 收藏