TodoEvolve: Learning to Architect Agent Planning Systems
TodoEvolve: 学习架构智能体规划系统
专题命中 规划决策 :agent(title,abstract);planning(title,abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 TodoEvolve通过元规划范式自主合成和修订任务特定的规划架构,在多个智能体基准测试中优于人工设计的规划模块,同时保持低开销。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
TodoEvolve: 学习架构智能体规划系统
专题命中 规划决策 :agent(title,abstract);planning(title,abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 TodoEvolve通过元规划范式自主合成和修订任务特定的规划架构,在多个智能体基准测试中优于人工设计的规划模块,同时保持低开销。
专题命中 规划决策 :agent(title,abstract);planning(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments Code at https://github.com/lapisrocks/LanguageAgentTreeSearch
专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);planning(abstract)
Comments 8 pages and 4 figures
Agentic ESOpt:以最小GPU资源微调长视野大语言模型智能体
机构 * National University of Singapore(新加坡国立大学)
专题命中 规划决策 :agentic(title,title_cn);分类 cs.LG
AI总结 本文提出Agentic ESOpt框架,用进化策略微调长视野LLM智能体,仅需最小GPU资源,在WebArena-Lite上使Qwen-3.5-27B性能提升6.69%,提示-参数协同演化在多数设置中优于基准。
A/B Agent:面向工业A/B测试中策略迭代的自进化智能体
机构 * The Hong Kong Polytechnic University(香港理工大学) ; Kuaishou Technology(快手科技) ; University of Electronic Science and Technology of China(电子科技大学) ; Southwest Jiaotong University(西南交通大学)
专题命中 规划决策 :agent(title,title_cn);分类 cs.AI
AI总结 该研究提出A/B Agent智能体,通过层级经验树与Tree-RAG技术优化工业A/B测试的策略迭代,在短视频电商场景实现GMV提升4.829%且护栏指标正向增益。
Role-Agent: 通过双角色演化引导LLM智能体
机构 * University of Science and Technology of China(中国科学技术大学) ; AMAP, Alibaba Group(阿里巴巴集团高德地图)
专题命中 规划决策 :agent(title,title_cn);分类 cs.AI
AI总结 提出Role-Agent框架,让单个LLM同时作为智能体和环境,通过世界在智能体(WIA)和智能体在世界(AIW)两个组件实现自举协同演化,在多个基准上平均提升超过4%。
Comments 20 pages, including 12 pages of main text and 8 pages of appendix; work in progress
策略驱动的物理层系统的双层长期优化的代理人工智能
机构 * Key Laboratory of EMW Information (MoE), College of Future Information Technology, Fudan University(复旦大学未来信息技术学院电磁波信息科学教育部重点实验室) ; James Watt School of Engineering, University of Glasgow(格拉斯哥大学詹姆斯·瓦特工程学院) ; School of Engineering, Edith Cowan University(埃迪斯科文大学工程学院) ; Information Systems Technology and Design Pillar, Singapore University of Technology and Design(新加坡科技设计大学信息系统技术与设计系)
专题命中 规划决策 :agentic(title,summary_cn);agent(abstract);multi-agent(abstract);分类 cs.AI
AI总结 提出Agentic-LTPO框架,利用代理AI生成上层配置,下层求解实时物理层问题,在无小区MIMO波束成形中实现57.2%的长期性能提升。
Comments 14 pages, 11 figures
Agentic-V2X:用于5G/6G网络中具有截止日期感知的V2X调度的小型语言模型代理
机构 * Department of Informatics, University of Piraeus(比雷埃克斯大学信息学院) ; Department of Informatics and Telecommunications, University of Peloponnese(希腊佩拉索斯大学信息与电信学院)
专题命中 规划决策 :agentic(title,title_cn);分类 cs.AI
AI总结 研究针对5G/6G网络中V2X调度,提出Agentic-V2X架构。小型本地部署语言模型生成策略,经验证后由轻量级控制器执行,评估多种策略,该架构能生成有效可执行策略,在多方面有竞争力,但非最佳。
Comments 20 pages 7 figures
智能物联网:面向智能体互联网的架构、应用及挑战
机构 * Department of Artificial Intelligence and Data Engineering, Ankara University(人工智能与数据工程系,安卡拉大学)
专题命中 规划决策 :agentic(title,abstract);agent(abstract);AI agent(abstract);tool use(abstract)
AI总结 探讨智能物联网,它将自主智能体能力与网络物理系统整合,旨在从以数据为中心的物联网转变为分布式认知智能体生态系统,文中进行了定位、综述、架构框架介绍等
Comments 14 pages, 2 figures, Author's preprint version. The manuscript may be revised based on peer-review feedback and publication requirements
Scout-Assisted Planning for Heterogeneous Robot Teams under Partially Known Environments
机构 * George Mason University(乔治·马歇尔大学)
专题命中 规划决策 :planning(title,title_cn);分类 cs.AI
AI总结 本文提出了一种Scout-Assisted Planning框架,通过无人机主动收集环境信息来改进地面车辆的导航,通过信息增益引导的行动剪枝减少回溯成本,实验表明其在不同环境中能显著降低地面机器人旅行成本。
Seg-Agent: 无训练语言引导分割的测试时多模态推理
机构 * School of Computing and Information Technology(计算与信息科技学院) ; Great Bay University(大湾大学) ; Hangzhou International Innovation Institute(杭州国际创新研究院) ; Beihang University(北航大学) ; Department of Computing(计算系) ; The Hong Kong Polytechnic University(香港理工大学)
专题命中 规划决策 :agent(title,title_cn);分类 cs.AI
AI总结 Seg-Agent提出无训练的多模态推理框架,通过生成-选择-细化三阶段循环实现视觉区域分割,无需参数更新即可达到与训练方法相当的性能。
ORFS-agent:用于芯片设计优化的工具使用代理
机构 * University of California, San Diego(加州大学圣地亚哥分校)
专题命中 规划决策 :agent(title,title_cn);分类 cs.AI
AI总结 本文提出ORFS-agent,一种基于大语言模型的迭代优化代理,用于自动化开放式硬件设计流程中的参数调优,通过改进资源效率和设计指标,在六个基准测试中提升了性能。
OVOD-Agent:一种用于主动视觉推理和自进化检测的马尔可夫-多臂框架
机构 * Wuhan University(武汉大学)
专题命中 规划决策 :agent(title,title_cn);分类 cs.AI
AI总结 本文提出OVOD-Agent框架,通过将文本优化扩展为可解释的视觉CoT,结合弱马尔可夫决策过程和多臂模块,实现主动视觉推理和自进化检测,提升稀有类别检测性能。
GIANT - 全局路径整合与注意力图网络用于多智能体轨迹规划
机构 * Artificial Intelligence in Robotics Laboratory (AiR Lab), Department of Electrical and Computer Engineering, Aarhus University(人工智能机器人实验室(AiR实验室),电气与计算机工程系,奥胡斯大学) ; Foundation Models for Artificial Intelligence group, Department of Information and Communication Engineering, Tokyo University(人工智能基础模型组,信息与通信工程系,东京大学) ; Automatic Control Group, Department of Electrical Engineering and Information Technology, Paderborn University(自动控制组,电气工程与信息科技系,波德恩大学)
专题命中 规划决策 :planning(title,abstract);agent(title);multi-agent(title);分类 cs.AI
AI总结 GIANT通过结合全局路径规划与注意力图网络,提升多智能体在复杂动态环境中的避障与导航性能。
Comments Published in: 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)
机构 * DeepFlow(深流)
专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);planning(abstract);workflow(abstract)
Comments Accepted as an oral paper for the conference for Distributed Artificial Intelligence (DAI 2025). 8 pages, 2 figures
专题命中 规划决策 :planning(title,abstract);agent(title);multi-agent(title);分类 cs.AI
专题命中 规划决策 :planning(title,abstract);agent(title);multi-agent(title);分类 cs.AI
Comments Presented at International Conference on Robotics and Automation (ICRA) 2020
Journal ref International Conference on Robotics and Automation (ICRA) 2020
专题命中 规划决策 :planning(title,abstract);agent(title);multi-agent(title);分类 cs.LG
专题命中 规划决策 :planning(title,abstract);agent(title);multi-agent(title);分类 cs.AI
Comments See movie at http://youtu.be/gRnsjd_ocxs
符号执行的智能体规划
专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE
AI总结 该研究提出智能体规划系统Agolic,利用早期符号执行运行的证据配置后续有界符号执行,在C/C++程序上平均覆盖3倍以上分支,覆盖更多分支及对比语料库未覆盖的分支,扩展了符号执行的实际覆盖范围。
节点即智能体:图智能体网络
机构 * Rutgers University(罗格斯大学) ; University of Liverpool(利物浦大学) ; Fudan University(复旦大学)
专题命中 规划决策 :agent(title,abstract);agentic(title,abstract);planning(abstract);分类 cs.CL、cs.LG
AI总结 研究针对图神经网络不能处理节点信息不平衡及忽略全局语义关系的局限,提出检索增强图智能体网络ReaGAN,赋予节点自主决策能力,通过智能体规划和局部 - 全局检索实现自适应消息传播,在少样本设置下性能优异。
Comments 11 pages, work in progress
PlanBench-XL:评估大规模工具生态系统中LLM工具使用智能体的长时程规划能力
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 规划决策 :tool-use(title,abstract);planning(title,abstract);agentic(abstract);分类 cs.AI、cs.CL
AI总结 提出PlanBench-XL基准,包含327个零售任务和1665个工具,测试LLM智能体在检索受限工具环境下的长时程规划能力,实验表明GPT-5.4在无阻塞下准确率51.90%,严重阻塞下降至11.36%。
AI经济学家代理:一种基于模型的经济分析代理框架,结合RAG、知识图谱和大语言模型
机构 * Mizuho-DL Financial Technology, Co., Ltd.(Mizuho-DL金融科技有限公司)
专题命中 规划决策 :agent(title,abstract);agentic(title,abstract);AI agent(abstract);分类 cs.AI、cs.LG
AI总结 提出一种基于RAG的AI经济学家代理框架,利用知识图谱和大语言模型进行经济情景分析,通过代理规划、检索证据、选择模型并生成报告,提高经济叙事的连贯性和可追溯性。
BIOGEN:基于证据的多智能体推理框架用于抗菌药物耐药性中的转录组解释
机构 * College of Engineering and Computer Science, University of Central Florida(中佛罗里达大学工程与计算机科学学院)
专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG
AI总结 BIOGEN通过结合生物信息检索、结构化推理和多批评验证,生成可追溯的转录组模块解释,其在抗菌药物耐药性研究中表现出强生物学基础和零幻觉率。
DAVIS:基于知识图谱的规划代理
机构 * Davis Institute for Artificial Intelligence(戴维斯人工智能研究所) ; Colby College(科伯学院) ; University of Notre Dame(圣约翰大学) ; William & Mary(威廉与玛丽学院)
专题命中 规划决策 :agent(title,abstract);planning(title,abstract);agentic(abstract);分类 cs.AI、cs.CL
AI总结 本文提出DAVIS,一种基于知识图谱的规划代理,通过结构化和时间记忆实现模型驱动规划,并采用多轮检索系统提升科学任务处理能力,在ScienceWorld基准测试中表现优异。
Comments Accepted to EMNLP 2025 Findings
HONEST-CAV: 连续和自动化车辆网络信号与轨迹的分层优化方法基于多智能体强化学习
机构 * College of Engineering, Center for Environmental Research and Technology, University of California at Riverside(加州大学河滨分校工程学院、环境研究与技术中心) ; InfoTech Labs, Toyota Motor North America(丰田北美信息科技实验室)
专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI、cs.LG
AI总结 HONEST-CAV通过多智能体强化学习和机器学习轨迹规划算法优化交通信号与车辆轨迹,提升交通效率和节能效果。
Comments 7 pages, 6 figures. Accepted at the 2026 IEEE Intelligent Vehicles Symposium. Final version to appear at IEEE Xplore
MedClarify:一种用于医学诊断的信息寻求AI代理,具有病例特定的后续问题
专题命中 规划决策 :agent(title,abstract);AI agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG
AI总结 MedClarify通过生成病例特定的后续问题,提升医学诊断的准确性与可靠性。
OMG-Agent:迈向鲁棒缺失模态生成的解耦粗到细代理工作流
机构 * University of Electronic Science and Technology of China(电子科技大学)
专题命中 规划决策 :agent(title,abstract);agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG
AI总结 OMG-Agent通过解耦粗到细的代理工作流,有效解决多模态数据缺失问题,提升生成的鲁棒性和保真度。
理解并弥合规划者-生成者之间的差距:对多智能体系统在代码生成中鲁棒性的系统研究
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; Lingnan University(岭南大学) ; Renmin University of China(中国人民大学)
专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI、cs.SE
AI总结 本文研究多智能体系统在代码生成中的鲁棒性问题,发现规划者与生成者之间的信息丢失是主要缺陷,并提出修复方法以提升系统鲁棒性。
Comments 18pages, 5 figures, 6 tables
RECAP:用于代理规划中意图理解的对话重写
专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL
AI总结 RECAP通过对话重写提升代理规划中的意图理解,提出新基准和方法,验证重写对规划效用的提升。