arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35614 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35614 篇

2604.02786 2026-04-06 cs.RO 85%

QuadAgent: A Responsive Agent System for Vision-Language Guided Quadrotor Agile Flight

QuadAgent:一种基于视觉-语言引导的四旋翼敏捷飞行响应代理系统

Ao Zhuang, Feng Yu, Tianbao Zhang, Linzuo Zhang, Danping Zou

专题命中 规划决策 :agent(title,abstract);workflow(abstract);multi-agent(abstract)

AI总结 QuadAgent通过异步多代理架构解耦高层推理与低层控制,利用Impression Graph维护场景记忆并结合视觉避障网络确保飞行安全,实现在复杂环境中高速导航与响应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00213 2026-04-02 cs.RO math.OC 85%

A Player Selection Network for Scalable Game-Theoretic Prediction and Planning

一种用于可扩展博弈论预测与规划的玩家选择网络

Tianyu Qiu, Eric Ouano, Fernando Palafox, Christian Ellis, David Fridovich-Keil

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出PSN Game框架,通过学习玩家选择网络减少博弈规模,提升预测准确性和规划安全性,同时利用目标推断网络处理信息不完全场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28889 2026-04-01 cs.DB 85%

DeepEye: A Steerable Self-driving Data Agent System

DeepEye:一种可调节的自动驾驶数据代理系统

Boyan Li, Yiran Peng, Yupeng Xie, Sirong Lu, Yizhang Zhu, Xing Mu, Xinyu Liu, Yuyu Luo

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);workflow(abstract)

AI总结 本文提出DeepEye,一种基于工作流的生产级数据代理系统,通过统一多模态协调协议和分层推理机制,解决异构数据源联合分析和上下文爆炸问题,实现透明执行和自动化优化。

Comments SIGMOD Demo (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28106 2026-03-31 cs.HC 85%

InconLens: Interactive Visual Diagnosis of Behavioral Inconsistencies in LLM-based Agentic Systems

InconLens:交互式可视化诊断LLM基于代理系统的行为主观不一致性

Shuo Yan, Xiaolin Wen, Shaolun Ruan, Yanjie Zhang, Jiaming Mi, Yushi Sun, Huamin Qu, Rui Sheng

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 本文提出InconLens系统,通过信息节点抽象实现跨运行行为分析,帮助开发者更高效识别分歧点并提升代理系统可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26997 2026-03-31 cs.RO cs.HC 85%

ROSClaw: An OpenClaw ROS 2 Framework for Agentic Robot Control and Interaction

ROSClaw: 一种用于代理机器人控制与交互的OpenClaw ROS 2框架

Irvin Steve Cardenas, Marcus Anthony Arnett, Natalie Catherine Yeo, Lucky Sah, Jong-Hoon Kim

机构 * Advanced Telerobotics Research Lab, Kent State University(肯特州立大学先进远程机器人研究实验室) OpenDive Technologies

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 ROSClaw通过整合OpenClaw代理运行时与ROS 2,实现任意基础模型与ROS-enabled机器人之间的交互,支持动态能力发现、多模态观察归一化、预执行动作验证和结构化审计日志,验证了执行层设计对任务完成与安全行为的关键影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21418 2026-03-31 cs.MA 85%

FUAS-Agents: Autonomous Multi-Modal LLM Agents for Treatment Planning in Focused Ultrasound Ablation Surgery

FUAS-代理:自主多模态大语言模型代理用于聚焦超声消融手术的治疗计划

Lina Zhao, Zihao Bian, Qingyue Chen, Yafang Li, Zhiyi Luo, Jiaxing Bai, Guangbo Li, Min He, Kezhi Li, Huaiyuan Yao, Zongjiu Zhang

专题命中 规划决策 :planning(title,abstract);agent(abstract);autonomous agent(abstract)

AI总结 本文提出FUAS-代理,利用大语言模型的多模态理解和工具使用能力,通过整合患者资料和MRI数据,生成个性化治疗计划,提升临床决策效率和可靠性。

Comments 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06796 2026-03-25 cs.RO 85%

db-LaCAM: Fast and Scalable Multi-Robot Kinodynamic Motion Planning with Discontinuity-Bounded Search and Lightweight MAPF

db-LaCAM:基于断点有界的快速可扩展多机器人运动规划与轻量级MAPF

Akmaral Moldagalieva, Keisuke Okumura, Amanda Prorok, Wolfgang Hönig

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出db-LaCAM,结合现代MAPF算法的高效性和 kinodynamic 规划器的动态感知能力,通过预计算的运动原语生成运动序列,实现高效多机器人运动规划,实验表明其在50个机器人场景中运行速度提升十倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00171 2026-03-23 cs.CV 85%

CompAgent: An Agentic Framework for Visual Compliance Verification

CompAgent:一种用于视觉合规验证的代理框架

Rahul Ghosh, Baishali Chaudhury, Hari Prasanna Das, Meghana Ashok, Ryan Razkenari, Long Chen, Sungmin Hong, Chun-Hao Liu

机构 * Generative AI Innovation Center(生成式人工智能创新中心) Amazon Web Services(亚马逊网络服务)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 本文提出CompAgent,一种基于代理的视觉合规验证框架,通过集成视觉工具和规划代理,提升多模态推理能力,在公开基准测试中取得76%的F1分数,优于现有方法。

Comments Accepted to IEEE CVPR 2026 GRAIL-V Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18958 2026-03-20 cs.GT cs.MA 85%

Optimal Path Planning in Hostile Environments

hostile 环境中的最优路径规划

Andrzej Kaczmarczyk, Šimon Schierreich, Nicholas Axel Tanujaya, Haifeng Xu

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 研究在危险环境中多智能体路径规划问题,证明该问题NP难并提出多项式时间算法,揭示了问题的计算复杂性景观。

Comments Accepted for publication at ICAPS-2026 (25 pages, 6 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18470 2026-03-20 cs.HC 85%

CyberJustice Tutor: An Agentic AI Framework for Cybersecurity Learning via Think-Plan-Act Reasoning and Pedagogical Scaffolding

网络正义导师:一种基于思考-计划-行动推理和教学支架的AI框架,用于网络安全学习

Baiqiang Wang, Yan Bai, Juan Li

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 本文提出CyberJustice Tutor,通过Think-Plan-Act推理和教学支架框架,解决传统聊天机器人在网络安全教育中的局限性,验证了其在专业教育中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08955 2026-03-17 cs.CL cs.AI cs.LG 85%

Imagine-then-Plan: Agent Learning from Adaptive Lookahead with World Models

想象后再计划:基于世界模型的自适应前瞻学习 agent 学习框架

Youwei Liu, Jian Wang, Hanlin Wang, Beichen Guo, Wenjie Li

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出Imagine-then-Plan框架,通过自适应前瞻机制提升agent在复杂任务中的推理能力,实验表明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14011 2026-03-17 cs.CR 85%

Sovereign-OS: A Charter-Governed Operating System for Autonomous AI Agents with Verifiable Fiscal Discipline

Sovereign-OS:一种以宪章治理为核心的自主AI代理操作系统,具有可验证的财政纪律

Aojie Yuan, Haiyue Zhang, Ziyi Wang, Yue Zhao

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);planning(abstract)

AI总结 Sovereign-OS通过宪章定义使命范围和财政限制,结合CEO、CFO、Worker和Auditor角色,实现对AI代理行为的宪法控制,有效阻止财政违规并确保审计完整性。

Comments 4 pages, 2 figures, 2 tables, demo paper. Code: https://github.com/Justin0504/Sovereign-OS Demo: https://youtu.be/vOarAI_epb4

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12644 2026-03-16 cs.CR 85%

Uncovering Security Threats and Architecting Defenses in Autonomous Agents: A Case Study of OpenClaw

揭示自主代理中的安全威胁并构建防御体系:以OpenClaw为例

Zonghao Ying, Xiao Yang, Siyang Wu, Yumeng Song, Yang Qu, Hainan Li, Tianlin Li, Jiakai Wang, Aishan Liu, Xianglong Liu

专题命中 规划决策 :autonomous agent(title,abstract);agent(abstract);agentic(abstract)

AI总结 本文分析了自主代理在安全领域的挑战,提出三层次风险分类和FASA架构,旨在提升自主代理的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12597 2026-03-16 cs.LG cs.AI cs.HC cs.MA cs.SE 85%

Feynman: Knowledge-Infused Diagramming Agent for Scalable Visual Designs

Feynman: 一种融合知识的图表生成代理,用于可扩展的视觉设计

Zixin Wen, Yifu Cai, Kyle Lee, Sam Estep, Josh Sunshine, Aarti Singh, Yuejie Chi, Wode Ni

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文提出Feynman代理,通过知识组件枚举和代码规划生成高质量图表-描述对,构建了可扩展的图表生成流水线,并创建了视觉语言基准Diagramma。

Comments A previous version was submitted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01687 2026-03-03 cs.NI 85%

Predictive Importance Sampling Based Coverage Verification for Multi-UAV Trajectory Planning

基于预测重要性采样的多无人机轨迹规划覆盖验证

Snehashish Ghosh, Sasthi C. Ghosh

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出基于预测重要性采样的多无人机轨迹规划覆盖验证方法,通过LSTM-MDN和防御性混合采样提升鲁棒性,实现更高效的覆盖管理。

Comments This article has been submitted to a conference for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23729 2026-03-02 cs.CL cs.AI cs.LG 85%

From Static Benchmarks to Dynamic Protocol: Agent-Centric Text Anomaly Detection for Evaluating LLM Reasoning

从静态基准到动态协议:面向评估LLM推理能力的代理中心文本异常检测

Seungdong Yoa, Sanghyu Yoon, Suhee Yoon, Dongmin Kim, Ye Seul Sim, Junhyun Lee, Woohyung Lim

机构 * LG AI Research(LG人工智能研究)

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种动态协议,通过代理中心文本异常检测评估LLM推理能力,以克服静态数据集的局限性。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20718 2026-02-26 cs.LG cs.AI cs.CL 85%

Stabilizing Off-Policy Training for Long-Horizon LLM Agent via Turn-Level Importance Sampling and Clipping-Triggered Normalization

通过回合级重要性采样和触发式归一化稳定长时程LLM代理的离策略训练

Chenliang Li, Adel Elmahdy, Alex Boyd, Zhongruo Wang, Siliang Zeng, Alfredo Garcia, Parminder Bhatia, Taha Kass-Hout, Cao Xiao, Mingyi Hong

机构 * Texas A&M University(德克萨斯A&M大学) GE HealthCare(通用电气医疗) University of Minnesota(明尼苏达大学)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 SORL通过回合级重要性采样和触发式归一化稳定长时程LLM代理的离策略训练,减少梯度方差并防止优化崩溃。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15329 2026-02-18 cs.CV 85%

EventMemAgent: Hierarchical Event-Centric Memory for Online Video Understanding with Adaptive Tool Use

EventMemAgent: 基于分层事件中心记忆的在线视频理解与自适应工具使用

Siwei Wen, Zhangcheng Wang, Xingjian Zhang, Lei Huang, Wenjun Wu

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京未来区块链与隐私计算先进创新中心,人工智能学院,北京航空航天大学) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北京航空航天大学) Paradigm Inc.(4Paradigm公司)

专题命中 规划决策 :tool use(title);agent(abstract);tool-use(abstract);agentic(abstract)

AI总结 EventMemAgent通过分层事件中心记忆和自适应工具使用,解决在线视频理解中长程推理与细粒度细节的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14799 2026-02-17 cs.RO quant-ph 85%

Scalable Multi-Robot Path Planning via Quadratic Unconstrained Binary Optimization

通过二次无约束二元优化实现可扩展的多机器人路径规划

Javier González Villasmil

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于二次无约束二元优化的多机器人路径规划方法,通过逻辑预处理和时间窗口分解策略实现了高效且可扩展的路径规划。

Comments 21 pages, 9 figures, 1 table. Accompanying open-source implementation at https://github.com/JavideuS/Spooky

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14589 2026-02-17 cs.AI cs.CL cs.LG 85%

MATEO: A Multimodal Benchmark for Temporal Reasoning and Planning in LVLMs

MATEO:一种多模态基准,用于LVLMs中的时间推理和规划

Gabriel Roccabruna, Olha Khomyn, Giuseppe Riccardi

机构 * Signals and Interactive Systems Lab, University of Trento, Italy(特伦托大学信号与交互系统实验室) University of Trento(特伦托大学) Amazon(亚马逊)

专题命中 规划决策 :planning(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 MATEO是一个多模态基准,用于评估和提升大型视觉语言模型在时间推理和规划方面的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16198 2026-02-16 cs.CL cs.AI cs.SE 85%

RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation

RPG:一个用于统一和可扩展代码库生成的仓库规划图

Jane Luo, Xin Zhang, Steven Liu, Jie Wu, Jianfeng Liu, Yiming Huang, Yangyu Huang, Chengyu Yin, Ying Xin, Yuefeng Zhan, Hao Sun, Qi Chen, Scarlett Li, Mao Yang

机构 * Microsoft(微软公司) Tsinghua University(清华大学) University of California, San Diego(加州大学圣地亚哥分校) Beijing Jiaotong University(北京交通大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 RPG通过统一的图结构提升代码库生成效率,ZeroRepo在真实项目基准上实现显著更高的代码生成量和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10490 2026-02-12 cs.IR 85%

ChainRec: An Agentic Recommender Learning to Route Tool Chains for Diverse and Evolving Interests

ChainRec: 一个用于路由工具链的代理推荐学习系统,以应对多样化和演变的兴趣

Fuchun Li, Qian Li, Xingyu Gao, Bocheng Pan, Yang Wu, Jun Zhang, Huan Yu, Jie Jiang, Jinsheng Xiao, Hailong Shi

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 ChainRec通过动态选择推理工具的代理推荐系统,提升冷启动和兴趣演变场景下的推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23189 2026-02-10 eess.SY cs.SY 85%

The Dawn of Agentic EDA: A Survey of Autonomous Digital Chip Design

代理EDA的黎明:自主数字芯片设计的综述

Zelin Zang, Yuhang Song, Aili Wang, Bingo Wing-Kuen Ling, Qi Sun, Zhen Lei, Fuji Yang, Cheng Zhuo, Jiebo Luo

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 本文提出代理EDA的系统框架,通过认知堆栈分析前端和后端设计流程,强调神经符号优化和可信度提升的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00566 2026-02-03 cs.RO 85%

UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning

UniMotion: 一种用于仿真、预测和规划的统一运动框架

Nan Song, Junzhe Jiang, Jingyu Li, Xiatian Zhu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Innovation Institute(上海创新研究院) University of Surrey(Surrey大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 UniMotion提出了一种统一的运动框架,通过共享结构和定制化训练策略,同时支持运动仿真、预测和规划,实现高效的任务整合和泛化能力。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01945 2026-02-03 cs.LG cs.AI cs.CL 85%

Agentic Policy Optimization via Instruction-Policy Co-Evolution

通过指令-策略共演进行代理策略优化

Han Zhou, Xingchen Wan, Ivan Vulić, Anna Korhonen

机构 * Language Technology Lab, University of Cambridge(剑桥大学语言技术实验室) Machine Learning Research Group, University of Oxford(牛津大学机器学习研究组)

专题命中 规划决策 :agentic(title);agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 INSPO通过指令与策略的共演机制,动态优化指令以提升代理在多轮检索和推理任务中的性能,显著优于静态指令基线。

Comments 8 pages, 4 figures, 1 table (17 pages including references and appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22311 2026-02-02 cs.AI cs.CL cs.LG 85%

Why Reasoning Fails to Plan: A Planning-Centric Analysis of Long-Horizon Decision Making in LLM Agents

为何推理无法规划:从规划角度分析LLM代理在长周期决策中的表现

Zehong Wang, Fang Wu, Hongru Wang, Xiangru Tang, Bolian Li, Zhenfei Yin, Yijun Ma, Yiyang Li, Weixiang Sun, Xiusi Chen, Yanfang Ye

机构 * University of Notre Dame(诺丁汉大学) Stanford University(斯坦福大学) Purdue University(普渡大学) University of Edinburgh(爱丁堡大学) University of Oxford(牛津大学) Yale University(耶鲁大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文从规划角度分析LLM代理在长周期决策中的失败原因,提出FLARE方法通过前瞻和价值传播提升规划能力,使LLaMA-8B在多个基准中超越GPT-4o。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17566 2026-01-27 cs.CV 85%

Sponge Tool Attack: Stealthy Denial-of-Efficiency against Tool-Augmented Agentic Reasoning

Sponge Tool Attack:针对工具增强代理推理的隐蔽低效攻击

Qi Li, Xinchao Wang

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 Sponge Tool Attack通过重写输入提示,隐蔽地破坏工具增强代理推理的效率,验证了其在多种模型和工具上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16984 2026-01-27 cs.LG cs.AI cs.CL cs.CV cs.IR cs.MM 85%

TelcoAI: Advancing 3GPP Technical Specification Search through Agentic Multi-Modal Retrieval-Augmented Generation

TelcoAI: 通过代理多模态检索增强生成技术推进3GPP技术规范搜索

Rahul Ghosh, Chun-Hao Liu, Gaurav Rele, Vidya Sagar Ravipati, Hazar Aouad

机构 * Generative AI Innovation Center, Amazon Web Services (AWS)(生成式AI创新中心,亚马逊网络服务)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 TelcoAI通过代理多模态检索增强生成技术,提升3GPP技术规范搜索的准确性和效率,实现87%的召回率和16%的性能提升。

Comments Accepted to IJCNLP-AACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10820 2026-01-19 cs.LG cs.AI cs.CL cs.MA 85%

Towards Reliable ML Feature Engineering via Planning in Constrained-Topology of LLM Agents

通过LLM代理的受限拓扑规划实现可靠的机器学习特征工程

Himanshu Thakur, Anusha Kamath, Anurag Muthyala, Dhwani Sanmukhani, Smruthi Mukund, Jay Katukuri

机构 * Meta Menlo Park, CA(Meta 洛杉矶公园分校) JPMorgan Chase & Co.(摩根大通公司)

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种基于LLM代理的受限拓扑规划框架,通过多步骤生成代码提升特征工程的可靠性与效率,实验显示在数据集和实际应用中均取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04698 2026-01-09 cs.AI cs.CL cs.LG 85%

TourPlanner: A Competitive Consensus Framework with Constraint-Gated Reinforcement Learning for Travel Planning

TourPlanner: 一种基于约束门控强化学习的竞争共识框架用于旅行规划

Yinuo Wang, Mining Tan, Wenxiang Jiao, Xiaoxi Li, Hao Wang, Xuanyu Zhang, Yuan Lu, Weiming Dong

机构 * Xiaohongshu Inc.(小红书公司) Renmin University of China(中国人民大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)

专题命中 规划决策 :planning(title,abstract);workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 TourPlanner通过多路径推理和约束门控强化学习,解决旅行规划中候选点修剪、探索能力限制和约束优化难题,实现更高效的行程生成。

详情

展开后加载摘要…

URL PDF HTML 收藏