arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-05 至 2026-02-05 共收录 40 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 40 篇

2602.04144 2026-02-05 cs.AI cs.LG 90%

OMG-Agent: Toward Robust Missing Modality Generation with Decoupled Coarse-to-Fine Agentic Workflows

OMG-Agent:迈向鲁棒缺失模态生成的解耦粗到细代理工作流

Ruiting Dai, Zheyu Wang, Haoyu Yang, Yihan Liu, Chengzhi Wang, Zekun Zhang, Zishan Huang, Jiaman Cen, Lisi Mo

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 规划决策 :agent(title,abstract);agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 OMG-Agent通过解耦粗到细的代理工作流,有效解决多模态数据缺失问题,提升生成的鲁棒性和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04112 2026-02-05 cs.CL 88%

DELTA: Deliberative Multi-Agent Reasoning with Reinforcement Learning for Multimodal Psychological Counseling

DELTA: 基于强化学习的多智能体推理用于多模态心理辅导

Jiangnan Yang, Junjie Chen, Fei Wang, Yiqi Nie, Yuxin Liu, Zhangling Duan, Jie Chen

机构 * Anhui University(安徽大学) Hefei University of Technology(合肥工业大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合国家科学中心人工智能研究所)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 DELTA 通过强化学习和多智能体推理提升多模态心理辅导的质量与情感契合度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04326 2026-02-05 cs.AI cs.CL cs.MA 86%

From Assumptions to Actions: Turning LLM Reasoning into Uncertainty-Aware Planning for Embodied Agents

从假设到行动:将大语言模型推理转化为具有不确定性的代理规划

SeungWon Seo, SooBin Lim, SeongRae Noh, Haneul Kim, HyeongYeop Kang

机构 * Department of Computer Science and Engineering, Korea University(计算机科学与工程系,韩国大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 PCE框架通过结构化决策树将LLM推理中的假设转化为可靠策略,提升多智能体环境下的规划效率和任务完成率。

Comments 31 pages, 10 figures, Accepted ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04129 2026-02-05 cs.RO cs.AI cs.ET cs.MA 83%

KGLAMP: Knowledge Graph-guided Language model for Adaptive Multi-robot Planning and Replanning

KGLAMP:基于知识图谱的自适应多机器人规划与再规划语言模型

Chak Lam Shek, Faizan M. Tariq, Sangjae Bae, David Isele, Piyush Gupta

机构 * Honda Research Institute, USA(本田研究院) University of Maryland, College Park(马里兰大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 KGLAMP通过知识图谱引导LLM实现异构多机器人系统的自适应规划与再规划,提升动态环境下的规划效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03974 2026-02-05 cs.AI 83%

Active Epistemic Control for Query-Efficient Verified Planning

主动认知控制用于查询高效的验证规划

Shuhui Qu

机构 * Stanford University(斯坦福大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 主动认知控制通过结合基于模型的信念管理和范畴可行性检查,实现查询高效的验证规划,在交互环境中减少重新规划轮次。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03940 2026-02-05 cs.LG 83%

Autonomous AI Agents for Real-Time Affordable Housing Site Selection: Multi-Objective Reinforcement Learning Under Regulatory Constraints

面向实时经济适用房选址的自主AI代理:在监管约束下的多目标强化学习

Olaf Yunus Laitinen Imanov, Duygu Erisken, Derya Umut Kulali, Taner Yilmaz, Rana Irem Turhan

机构 * Department of Applied Mathematics and Computer Science (DTU Compute), Technical University of Denmark(应用数学与计算机科学系(DTU Compute),丹麦技术大学) Department of Mathematics, Trakya University(数学系,特拉基亚大学) Department of Engineering, Eskisehir Technical University(工程系,埃斯基谢普尔技术大学) Department of Computer Engineering, Afyon Kocatepe University(计算机工程系,阿菲昂卡奥卡佩大学) Department of Computer Systems, Riga Technical University(计算机系统系,里加技术大学)

专题命中 规划决策 :AI agent(title);agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 AURA通过多目标强化学习在监管约束下高效选址,提升经济适用房选址的合规性和效率,减少选址时间并提高社会公平性

Comments 12 pages, 6 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21358 2026-02-05 cs.AI cs.CL 81%

Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization

潜在的思维链作为规划:将推理与言说解耦

Jiecong Wang, Hao Peng, Chunyang Liu

机构 * Beihang University(北航大学) Didi Chuxing(滴滴出行)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 PLaT通过解耦推理与言说,实现了更灵活的推理过程和更高的可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04184 2026-02-05 cs.CV cs.AI cs.LG cs.RO 81%

Natural Language Instructions for Scene-Responsive Human-in-the-Loop Motion Planning in Autonomous Driving using Vision-Language-Action Models

基于视觉-语言-动作模型的自动驾驶场景响应式人机协同运动规划的自然语言指令

Angel Martinez-Sanchez, Parthib Roy, Ross Greer

机构 * University of California, Merced(加州大学默塞德分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究利用视觉-语言-动作模型,通过指令条件规划提升自动驾驶的鲁棒性和轨迹对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04557 2026-02-05 cs.CL 79%

Textual Planning with Explicit Latent Transitions

基于显式潜在转移的文本规划

Eliezer Shlomi, Ido Levy, Eilam Shapira, Michael Katz, Guy Uziel, Segev Shlomov, Nir Mashkif, Roi Reichart, Sarah Keren

机构 * technion(技术学院) ibm(国际商业机器公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.CL

AI总结 本文提出EmbedPlan,通过冻结语言嵌入空间实现高效文本规划,展示在多个领域中插值性能良好,但跨领域泛化仍存在挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04256 2026-02-05 cs.RO cs.AI 79%

AppleVLM: End-to-end Autonomous Driving with Advanced Perception and Planning-Enhanced Vision-Language Models

AppleVLM: 端到端自主驾驶与高级感知和规划增强的视觉语言模型

Yuxuan Han, Kunyuan Wu, Qianyi Shao, Renxiang Xiao, Zilu Wang, Cansen Jiang, Yi Xiao, Liang Hu, Yunjiang Lou

机构 * Shenzhen Key Lab for Advanced Motion Control and Modern Automation Equipments(深圳先进运动控制系统与现代自动化装备重点实验室) Guangdong Provincial Key Laboratory of Intelligent Morphing Mechanisms and Adaptive Robotics(广东省智能变形机制与适应机器人省重点实验室) School of Intelligence Science and Engineering(智能科学与工程学院) Harbin Institute of Technology(哈尔滨工业大学) National Key Laboratory of Smart Farm Technologies and Systems(国家智能农业技术与系统重点实验室) Autonomous Driving Center(自动驾驶中心) Shanghai Utopilot Technology Co.Ltd.(上海驭目科技有限公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 AppleVLM通过引入先进的视觉和规划编码器,提升端到端自动驾驶的感知和决策能力,实现复杂环境下的稳健驾驶性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04071 2026-02-05 cs.LG 79%

Agentic AI-Empowered Dynamic Survey Framework

基于代理的动态调查框架

Furkan Mumcu, Lokman Bekit, Michael J. Jones, Anoop Cherian, Yasin Yilmaz

专题命中 规划决策 :agentic(title,abstract);分类 cs.LG

AI总结 本文提出基于代理的动态综述框架,通过持续整合新研究成果,保持综述的连贯性和结构,解决综述过时和碎片化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03900 2026-02-05 cs.AI 79%

Knowledge Model Prompting Increases LLM Performance on Planning Tasks

知识模型提示增强了LLM在规划任务上的性能

Erik Goh, John Kos, Ashok Goel

机构 * School of Interactive Computing(交互计算学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 TMK框架通过显式任务分解和因果推理提升LLM在规划任务中的性能,使其在复杂符号任务中达到97.3%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04515 2026-02-05 cs.RO cs.CV 78%

EgoActor: Grounding Task Planning into Spatial-aware Egocentric Actions for Humanoid Robots via Visual-Language Models

EgoActor: 通过视觉语言模型将任务规划接地于空间感知的自我中心动作以实现人形机器人

Yu Bai, MingMing Yu, Chaojie Li, Ziyi Bai, Xinlong Wang, Börje F. Karlsson

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 EgoActor通过视觉语言模型将高层任务指令转化为精确的空间感知动作,实现人形机器人在真实和模拟环境中的稳健任务规划与运动执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11752 2026-02-05 math.OC 78%

Path Planning for Aerial Relays via Probabilistic Roadmaps

通过概率路网进行空中中继的路径规划

Pham Q. Viet, Daniel Romero

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种基于概率路网的空中中继路径规划框架,通过空间离散化和概率分布优化,解决飞行约束和信道模型的问题,提升路径规划的最优性和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04315 2026-02-05 cs.RO cs.CV 78%

GeneralVLA: Generalizable Vision-Language-Action Models with Knowledge-Guided Trajectory Planning

GeneralVLA:具备知识引导轨迹规划的通用视觉-语言-动作模型

Guoqing Ma, Siheng Wang, Zeyu Zhang, Shan Yu, Hao Tang

机构 * CASIA(中国科学院自动化研究所) Peking University(北京大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 GeneralVLA通过知识引导轨迹规划,实现无需真实数据或示范的通用视觉-语言-动作模型,提升机器人零样本操作和数据生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04174 2026-02-05 cs.RO cs.GR cs.IR 78%

GenMRP: A Generative Multi-Route Planning Framework for Efficient and Personalized Real-Time Industrial Navigation

GenMRP:一种生成式多路径规划框架,用于高效且个性化的实时工业导航

Chengzhang Wang, Chao Chen, Jun Tao, Tengfei Liu, He Bai, Song Wang, Longfei Xu, Kaikui Liu, Xiangxiang Chu

机构 * Amap, Alibaba Group(阿里的地图公司) Southern University of Science and Technology(南方科技大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 GenMRP通过生成式多路径规划框架实现高效且个性化的实时工业导航,结合骨架到毛细血管方法和校正增强策略,提升路径规划的效率与多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04018 2026-02-05 eess.SP 78%

Cross-Frequency Bispectral EEG Analysis of Reach-to-Grasp Planning and Execution

跨频率双谱EEG分析抓取计划与执行

Sima Ghafoori, Anna Cetera, Ali Rabiee, MH Farhadi, Rahul Singh, Mariusz Furmanek, Yalda Shahriari, Reza Abiri

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究通过跨频率双谱EEG分析,揭示了运动计划与执行阶段中非线性耦合的差异,展示了双谱分析在抓取行为中的应用价值。

Comments manuscript is 34 pages, 6 figures, 2 tables, journal -- supplementary material is 9 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02540 2026-02-05 physics.soc-ph physics.geo-ph 78%

CoolPath Tool: A Thermal Comfort Path Planning Tool for Urban Mobility

CoolPath 工具:面向城市出行的热舒适路径规划工具

Aditya Patel, Naveen Sudharsan, Trevor Brooks, Harsh Kamath, Dru Crawley, Marc Coudert, Zach Baumer, Dev Niyogi

专题命中 规划决策 :planning(title,abstract)

AI总结 CoolPath 工具通过热舒适指数规划步行和骑行路线,减少高温对行人的影响,提升城市出行安全性和健康效益。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04118 2026-02-05 cs.LG cs.AI cs.CL 75%

Policy Learning with a Language Bottleneck

具有语言瓶颈的策略学习

Megha Srivastava, Cedric Colas, Dorsa Sadigh, Jacob Andreas

机构 * Stanford University(斯坦福大学) Massachusetts Institute of Technology(麻省理工学院) Inria(法国国家信息与自动化技术研究院)

专题命中 规划决策 :AI agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 通过语言瓶颈框架,AI代理能生成可解释的策略规则,提升与人类的协作效率。

Comments Accepted to TMLR (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12615 2026-02-05 math.OC 71%

A New Perspective on Double-S Curve Motions of Higher Order and Optimal Motion Planning

更高阶双S曲线运动的新视角及其最优运动规划

Rico Zöllner

专题命中 规划决策 :planning(title)

AI总结 本文提出了一种新方法,用于计算具有零边界条件和任意阶有界导数的对称轨迹的时间范围,并推导出一种算法以简化时间最小化问题。

Journal ref Results in Engineering 29, 109333 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04213 2026-02-05 cs.AI 70%

InterPReT: Interactive Policy Restructuring and Training Enable Effective Imitation Learning from Laypersons

InterPReT:交互式策略重构与训练实现有效的模仿学习

Feiyu Gavin Zhu, Jean Oh, Reid Simmons

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 InterPReT通过交互式策略重构与训练,使非专业人士能够更高效地训练可靠的模仿学习策略。

Comments Proceedings of the 21st ACM/IEEE International Conference on Human-Robot Interaction

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04801 2026-02-05 eess.SY cs.SY 67%

SQP-Based Cable-Tension Allocation for Multi-Drone Load Transport

基于SQP的多无人机负载运输电缆张力分配

Lamberto Vazquez-Soqui, Fatima Oliva-Palomo, Diego Mercado-Ravell, Pedro Castillo

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文提出基于SQP算法的多无人机负载运输电缆张力分配方法,通过实时优化提升负载运输的安全性和能耗平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09696 2026-02-05 cs.HC 67%

Patterns for a New Generation: AI and Agents

新一代的模式:人工智能与代理

Joseph Corneli, Charles J. Danoff, Raymond S. Puzio, Sridevi Ayloo, Sergio Belich, Andre Wilkinson, Mary Tedeschi, Pauline Mosley

专题命中 规划决策 :agent(abstract);workflow(abstract)

AI总结 本文提出利用设计模式指导代理行为,展示基于LLM的系统能读取生成模式,并探讨其在软件开发、教育等领域的应用潜力。

Comments 10 pages with 4 page appendix; to appear in Proceedings of Pattern Languages of Programs 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02619 2026-02-05 cs.LG cs.AI cs.SE 67%

daVinci-Agency: Unlocking Long-Horizon Agency Data-Efficiently

daVinci-Agency: 解锁长周期代理数据高效性

Mohan Jiang, Dayuan Fu, Junhao Shi, Ji Zeng, Weiye Si, Keyu Li, Xuefeng Li, Yang Xiao, Wenjie Li, Dequan Wang, Pengfei Liu

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 daVinci-Agency通过PR序列生成长周期代理数据,实现高效且高质量的监督学习,提升模型在复杂任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04821 2026-02-05 cs.LG cs.AI 62%

Safe Urban Traffic Control via Uncertainty-Aware Conformal Prediction and World-Model Reinforcement Learning

通过不确定性感知的置信区间预测和世界模型强化学习实现安全的城市交通控制

Joydeep Chandra, Satyam Kumar Navneet, Aleksandr Algazinov, Yong Zhang

机构 * Dept. of CST, BNRIST, Tsinghua University, Beijing, China(计算机科学与技术系,北京理工大学,北京,中国) Dept. of CST, Tsinghua University, Beijing, China(计算机科学与技术系,清华大学,北京,中国) Independent Researcher, Bihar, India(独立研究者,印度比哈尔)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 STREAM-RL通过不确定性感知的置信区间预测和世界模型强化学习,实现安全的城市交通控制,提升安全性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04640 2026-02-05 cs.SE cs.AI 62%

Towards Structured, State-Aware, and Execution-Grounded Reasoning for Software Engineering Agents

面向结构化、状态感知和执行导向的软件工程代理推理

Tse-Hsun, Chen

机构 * Concordia University(康科德大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出通过结构化、状态感知和执行导向的推理方法,提升软件工程代理在长周期任务中的推理能力和可靠性。

Comments Position paper accepted in BoatSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04417 2026-02-05 cs.LG cs.AI 62%

EMA Policy Gradient: Taming Reinforcement Learning for LLMs with EMA Anchor and Top-k KL

EMA策略梯度:通过EMA锚点和Top-k KL驯服LLM的强化学习

Lunjun Zhang, Jimmy Ba

机构 * University of Toronto(多伦多大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 EMA-PG通过EMA锚点和Top-k KL估计器提升LLM强化学习性能,显著提高数学推理和代理任务表现

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04566 2026-02-05 cs.NI cs.AI cs.MA 57%

Dual Mind World Model Inspired Network Digital Twin for Access Scheduling

双心智世界模型启发网络数字孪生访问调度框架

Hrishikesh Dutta, Roberto Minerva, Noel Crespi

机构 * Data Intelligence and Communication Engineering Lab(数据智能与通信工程实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出一种基于双心智世界模型的数字孪生调度框架,通过结合预测规划与符号模型优化,实现适应动态网络环境的智能调度策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04540 2026-02-05 cs.HC cs.CL 57%

PersoPilot: An Adaptive AI-Copilot for Transparent Contextualized Persona Classification and Personalized Response Generation

PersoPilot: 一种适应性AI助手用于透明的上下文化人格分类和个性化响应生成

Saleh Afzoon, Amin Beheshti, Usman Naseem

机构 * School of Computing, Macquarie University(计算机学院,麦考瑞大学)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 PersoPilot是一种集成人格理解和上下文分析的AI助手,通过透明可解释的界面实现个性化服务推荐和适应性个性化。

Comments Accepted for the Demo Track at the IEEE International Conference on Data Mining (ICDM) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04131 2026-02-05 cs.LG 57%

Decoupling Time and Risk: Risk-Sensitive Reinforcement Learning with General Discounting

解耦时间和风险:具有通用折扣的风险敏感强化学习

Mehrdad Moghimi, Anthony Coache, Hyejin Ku

机构 * Dept. of Mathematics and Statistics(数学与统计学系) York University(约克大学) Dept. of Mathematics(数学系) Imperial College(帝国理工学院)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出了一种支持灵活折扣和风险度量优化的新型分布式强化学习框架,通过技术分析和实验验证,展示了折扣在捕捉时空和风险偏好中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏