arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-05 至 2026-02-05 共收录 103 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 7 篇

2601.18496 2026-02-05 cs.AI 86%

DEEPMED: Building a Medical DeepResearch Agent via Multi-hop Med-Search Data and Turn-Controlled Agentic Training & Inference

DEEPMED:通过多跳Med-Search数据和转向控制的代理训练与推理构建医疗深度研究代理

Zihan Wang, Hao Wang, Shi Feng, Xiaocui Yang, Daling Wang, Yiqun Zhang, Jinghao Lin, Haihua Yang, Xiaozhong Ji

机构 * Northeastern University(东北大学) ByteDance(字节跳动)

专题命中 工具调用 :agent(title);agentic(title);tool-use(abstract);分类 cs.AI

AI总结 DeepMed通过多跳Med-Search数据和转向控制训练推理,提升医疗领域深度推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04726 2026-02-05 cs.SE cs.AI 84%

Supporting software engineering tasks with agentic AI: Demonstration on document retrieval and test scenario generation

用代理AI支持软件工程任务:文档检索与测试场景生成的演示

Marian Kica, Lukas Radosky, David Slivka, Karin Kubinova, Daniel Dovhun, Tomas Uhercik, Erik Bircak, Ivan Polasek

机构 * Gratex International(格拉特克斯国际) Department of Applied Informatics Faculty of Mathematics, Physics and Informatics Comenius University(应用信息学院数学、物理和信息学院康门ius大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出利用代理AI解决软件工程中的文档检索和测试场景生成问题,通过专用代理处理不同任务,提升软件开发效率。

Comments This is a preprint of a paper that was accepted at the International Conference on Artificial Intelligence, Computer, Data Sciences and Applications (ACDSA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04248 2026-02-05 cs.AI cs.CL 81%

Empirical-MCTS: Continuous Agent Evolution via Dual-Experience Monte Carlo Tree Search

经验-MCTS:通过双经验蒙特卡洛树搜索实现连续智能体进化

Hao Lu, Haoyuan Huang, Yulin Zhou, Chen Li, Ningxin Zhu

机构 * JianChengXingYun Technology Co., Ltd.(健成星云科技有限公司)

专题命中 工具调用 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 经验-MCTS通过双环框架实现连续智能体进化,结合局部探索与全局记忆优化,提升复杂推理任务性能。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21826 2026-02-05 cs.CL 79%

ResT: Reshaping Token-Level Policy Gradients for Tool-Use Large Language Models

ResT: 重塑令牌级策略梯度以适应工具使用大型语言模型

Zihan Lin, Xiaohan Wang, Jie Cao, Jiajun Chai, Guojun Yin, Wei Lin, Ran He

机构 * CRIPAC, Institute of Automation(CRIPAC,自动化研究所) Meituan(美团)

专题命中 工具调用 :tool-use(title,abstract);分类 cs.CL

AI总结 ResT通过熵引导的令牌重新加权优化工具使用任务的策略梯度,提升训练稳定性与效率,实现优于现有方法的性能。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01075 2026-02-05 cs.AI 57%

ConvexBench: Can LLMs Recognize Convex Functions?

ConvexBench: LLMs能否识别凸函数?

Yepeng Liu, Yu Huang, Yu-Xiang Wang, Yingbin Liang, Yuheng Bu

机构 * UC Santa Barbara(加州大学圣芭芭拉分校) University of Pennsylvania(宾夕法尼亚大学) UC San Diego(加州大学圣地亚哥分校) The Ohio State University(俄亥俄州立大学)

专题命中 工具调用 :agentic(abstract);分类 cs.AI

AI总结 ConvexBench通过分治框架解决LLM在深度函数组合中识别凸性的挑战,显著提升大深度下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17178 2026-02-05 physics.soc-ph 50%

Modelling the High-Voltage Grid Using Open Data for Europe and Beyond

利用开放数据构建高压电网模型:为欧洲及更远地区

Bobby Xiong, Davide Fioriti, Fabian Neumann, Iegor Riepin, Tom Brown

专题命中 工具调用 :workflow(abstract)

AI总结 本文通过OpenStreetMap数据构建欧洲高压电网模型,提供开放数据用于全球能源系统建模和分析。

Comments 20 pages, 15 figures, 8 tables. For associated prebuilt electricity network, see https://doi.org/10.5281/zenodo.13358976

Journal ref Nature Scientific Data, volume 12, article number: 277 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04157 2026-02-05 cs.RO 50%

A Modern System Recipe for Situated Embodied Human-Robot Conversation with Real-Time Multimodal LLMs and Tool-Calling

一种面向情境具身人机对话的现代系统配方,结合实时多模态大语言模型与工具调用

Dong Won Lee, Sarah Gillet, Louis-Philippe Morency, Cynthia Breazeal, Hae Won Park

专题命中 工具调用 :tool use(abstract)

AI总结 本文提出了一种结合实时多模态大语言模型与工具调用的系统配方,用于提升情境具身人机对话的交互质量与效率。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 40 篇

2602.04144 2026-02-05 cs.AI cs.LG 90%

OMG-Agent: Toward Robust Missing Modality Generation with Decoupled Coarse-to-Fine Agentic Workflows

OMG-Agent:迈向鲁棒缺失模态生成的解耦粗到细代理工作流

Ruiting Dai, Zheyu Wang, Haoyu Yang, Yihan Liu, Chengzhi Wang, Zekun Zhang, Zishan Huang, Jiaman Cen, Lisi Mo

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 规划决策 :agent(title,abstract);agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 OMG-Agent通过解耦粗到细的代理工作流,有效解决多模态数据缺失问题,提升生成的鲁棒性和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04112 2026-02-05 cs.CL 88%

DELTA: Deliberative Multi-Agent Reasoning with Reinforcement Learning for Multimodal Psychological Counseling

DELTA: 基于强化学习的多智能体推理用于多模态心理辅导

Jiangnan Yang, Junjie Chen, Fei Wang, Yiqi Nie, Yuxin Liu, Zhangling Duan, Jie Chen

机构 * Anhui University(安徽大学) Hefei University of Technology(合肥工业大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合国家科学中心人工智能研究所)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 DELTA 通过强化学习和多智能体推理提升多模态心理辅导的质量与情感契合度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04326 2026-02-05 cs.AI cs.CL cs.MA 86%

From Assumptions to Actions: Turning LLM Reasoning into Uncertainty-Aware Planning for Embodied Agents

从假设到行动:将大语言模型推理转化为具有不确定性的代理规划

SeungWon Seo, SooBin Lim, SeongRae Noh, Haneul Kim, HyeongYeop Kang

机构 * Department of Computer Science and Engineering, Korea University(计算机科学与工程系,韩国大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 PCE框架通过结构化决策树将LLM推理中的假设转化为可靠策略,提升多智能体环境下的规划效率和任务完成率。

Comments 31 pages, 10 figures, Accepted ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04129 2026-02-05 cs.RO cs.AI cs.ET cs.MA 83%

KGLAMP: Knowledge Graph-guided Language model for Adaptive Multi-robot Planning and Replanning

KGLAMP:基于知识图谱的自适应多机器人规划与再规划语言模型

Chak Lam Shek, Faizan M. Tariq, Sangjae Bae, David Isele, Piyush Gupta

机构 * Honda Research Institute, USA(本田研究院) University of Maryland, College Park(马里兰大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 KGLAMP通过知识图谱引导LLM实现异构多机器人系统的自适应规划与再规划,提升动态环境下的规划效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03974 2026-02-05 cs.AI 83%

Active Epistemic Control for Query-Efficient Verified Planning

主动认知控制用于查询高效的验证规划

Shuhui Qu

机构 * Stanford University(斯坦福大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 主动认知控制通过结合基于模型的信念管理和范畴可行性检查,实现查询高效的验证规划,在交互环境中减少重新规划轮次。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03940 2026-02-05 cs.LG 83%

Autonomous AI Agents for Real-Time Affordable Housing Site Selection: Multi-Objective Reinforcement Learning Under Regulatory Constraints

面向实时经济适用房选址的自主AI代理:在监管约束下的多目标强化学习

Olaf Yunus Laitinen Imanov, Duygu Erisken, Derya Umut Kulali, Taner Yilmaz, Rana Irem Turhan

机构 * Department of Applied Mathematics and Computer Science (DTU Compute), Technical University of Denmark(应用数学与计算机科学系(DTU Compute),丹麦技术大学) Department of Mathematics, Trakya University(数学系,特拉基亚大学) Department of Engineering, Eskisehir Technical University(工程系,埃斯基谢普尔技术大学) Department of Computer Engineering, Afyon Kocatepe University(计算机工程系,阿菲昂卡奥卡佩大学) Department of Computer Systems, Riga Technical University(计算机系统系,里加技术大学)

专题命中 规划决策 :AI agent(title);agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 AURA通过多目标强化学习在监管约束下高效选址,提升经济适用房选址的合规性和效率,减少选址时间并提高社会公平性

Comments 12 pages, 6 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21358 2026-02-05 cs.AI cs.CL 81%

Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization

潜在的思维链作为规划:将推理与言说解耦

Jiecong Wang, Hao Peng, Chunyang Liu

机构 * Beihang University(北航大学) Didi Chuxing(滴滴出行)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 PLaT通过解耦推理与言说,实现了更灵活的推理过程和更高的可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04184 2026-02-05 cs.CV cs.AI cs.LG cs.RO 81%

Natural Language Instructions for Scene-Responsive Human-in-the-Loop Motion Planning in Autonomous Driving using Vision-Language-Action Models

基于视觉-语言-动作模型的自动驾驶场景响应式人机协同运动规划的自然语言指令

Angel Martinez-Sanchez, Parthib Roy, Ross Greer

机构 * University of California, Merced(加州大学默塞德分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究利用视觉-语言-动作模型,通过指令条件规划提升自动驾驶的鲁棒性和轨迹对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04557 2026-02-05 cs.CL 79%

Textual Planning with Explicit Latent Transitions

基于显式潜在转移的文本规划

Eliezer Shlomi, Ido Levy, Eilam Shapira, Michael Katz, Guy Uziel, Segev Shlomov, Nir Mashkif, Roi Reichart, Sarah Keren

机构 * technion(技术学院) ibm(国际商业机器公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.CL

AI总结 本文提出EmbedPlan,通过冻结语言嵌入空间实现高效文本规划,展示在多个领域中插值性能良好,但跨领域泛化仍存在挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04256 2026-02-05 cs.RO cs.AI 79%

AppleVLM: End-to-end Autonomous Driving with Advanced Perception and Planning-Enhanced Vision-Language Models

AppleVLM: 端到端自主驾驶与高级感知和规划增强的视觉语言模型

Yuxuan Han, Kunyuan Wu, Qianyi Shao, Renxiang Xiao, Zilu Wang, Cansen Jiang, Yi Xiao, Liang Hu, Yunjiang Lou

机构 * Shenzhen Key Lab for Advanced Motion Control and Modern Automation Equipments(深圳先进运动控制系统与现代自动化装备重点实验室) Guangdong Provincial Key Laboratory of Intelligent Morphing Mechanisms and Adaptive Robotics(广东省智能变形机制与适应机器人省重点实验室) School of Intelligence Science and Engineering(智能科学与工程学院) Harbin Institute of Technology(哈尔滨工业大学) National Key Laboratory of Smart Farm Technologies and Systems(国家智能农业技术与系统重点实验室) Autonomous Driving Center(自动驾驶中心) Shanghai Utopilot Technology Co.Ltd.(上海驭目科技有限公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 AppleVLM通过引入先进的视觉和规划编码器,提升端到端自动驾驶的感知和决策能力,实现复杂环境下的稳健驾驶性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04071 2026-02-05 cs.LG 79%

Agentic AI-Empowered Dynamic Survey Framework

基于代理的动态调查框架

Furkan Mumcu, Lokman Bekit, Michael J. Jones, Anoop Cherian, Yasin Yilmaz

专题命中 规划决策 :agentic(title,abstract);分类 cs.LG

AI总结 本文提出基于代理的动态综述框架,通过持续整合新研究成果,保持综述的连贯性和结构,解决综述过时和碎片化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03900 2026-02-05 cs.AI 79%

Knowledge Model Prompting Increases LLM Performance on Planning Tasks

知识模型提示增强了LLM在规划任务上的性能

Erik Goh, John Kos, Ashok Goel

机构 * School of Interactive Computing(交互计算学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 TMK框架通过显式任务分解和因果推理提升LLM在规划任务中的性能,使其在复杂符号任务中达到97.3%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04515 2026-02-05 cs.RO cs.CV 78%

EgoActor: Grounding Task Planning into Spatial-aware Egocentric Actions for Humanoid Robots via Visual-Language Models

EgoActor: 通过视觉语言模型将任务规划接地于空间感知的自我中心动作以实现人形机器人

Yu Bai, MingMing Yu, Chaojie Li, Ziyi Bai, Xinlong Wang, Börje F. Karlsson

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 EgoActor通过视觉语言模型将高层任务指令转化为精确的空间感知动作,实现人形机器人在真实和模拟环境中的稳健任务规划与运动执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11752 2026-02-05 math.OC 78%

Path Planning for Aerial Relays via Probabilistic Roadmaps

通过概率路网进行空中中继的路径规划

Pham Q. Viet, Daniel Romero

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种基于概率路网的空中中继路径规划框架,通过空间离散化和概率分布优化,解决飞行约束和信道模型的问题,提升路径规划的最优性和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04315 2026-02-05 cs.RO cs.CV 78%

GeneralVLA: Generalizable Vision-Language-Action Models with Knowledge-Guided Trajectory Planning

GeneralVLA:具备知识引导轨迹规划的通用视觉-语言-动作模型

Guoqing Ma, Siheng Wang, Zeyu Zhang, Shan Yu, Hao Tang

机构 * CASIA(中国科学院自动化研究所) Peking University(北京大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 GeneralVLA通过知识引导轨迹规划,实现无需真实数据或示范的通用视觉-语言-动作模型,提升机器人零样本操作和数据生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04174 2026-02-05 cs.RO cs.GR cs.IR 78%

GenMRP: A Generative Multi-Route Planning Framework for Efficient and Personalized Real-Time Industrial Navigation

GenMRP:一种生成式多路径规划框架,用于高效且个性化的实时工业导航

Chengzhang Wang, Chao Chen, Jun Tao, Tengfei Liu, He Bai, Song Wang, Longfei Xu, Kaikui Liu, Xiangxiang Chu

机构 * Amap, Alibaba Group(阿里的地图公司) Southern University of Science and Technology(南方科技大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 GenMRP通过生成式多路径规划框架实现高效且个性化的实时工业导航,结合骨架到毛细血管方法和校正增强策略,提升路径规划的效率与多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04018 2026-02-05 eess.SP 78%

Cross-Frequency Bispectral EEG Analysis of Reach-to-Grasp Planning and Execution

跨频率双谱EEG分析抓取计划与执行

Sima Ghafoori, Anna Cetera, Ali Rabiee, MH Farhadi, Rahul Singh, Mariusz Furmanek, Yalda Shahriari, Reza Abiri

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究通过跨频率双谱EEG分析,揭示了运动计划与执行阶段中非线性耦合的差异,展示了双谱分析在抓取行为中的应用价值。

Comments manuscript is 34 pages, 6 figures, 2 tables, journal -- supplementary material is 9 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02540 2026-02-05 physics.soc-ph physics.geo-ph 78%

CoolPath Tool: A Thermal Comfort Path Planning Tool for Urban Mobility

CoolPath 工具:面向城市出行的热舒适路径规划工具

Aditya Patel, Naveen Sudharsan, Trevor Brooks, Harsh Kamath, Dru Crawley, Marc Coudert, Zach Baumer, Dev Niyogi

专题命中 规划决策 :planning(title,abstract)

AI总结 CoolPath 工具通过热舒适指数规划步行和骑行路线,减少高温对行人的影响,提升城市出行安全性和健康效益。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04118 2026-02-05 cs.LG cs.AI cs.CL 75%

Policy Learning with a Language Bottleneck

具有语言瓶颈的策略学习

Megha Srivastava, Cedric Colas, Dorsa Sadigh, Jacob Andreas

机构 * Stanford University(斯坦福大学) Massachusetts Institute of Technology(麻省理工学院) Inria(法国国家信息与自动化技术研究院)

专题命中 规划决策 :AI agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 通过语言瓶颈框架,AI代理能生成可解释的策略规则,提升与人类的协作效率。

Comments Accepted to TMLR (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12615 2026-02-05 math.OC 71%

A New Perspective on Double-S Curve Motions of Higher Order and Optimal Motion Planning

更高阶双S曲线运动的新视角及其最优运动规划

Rico Zöllner

专题命中 规划决策 :planning(title)

AI总结 本文提出了一种新方法,用于计算具有零边界条件和任意阶有界导数的对称轨迹的时间范围,并推导出一种算法以简化时间最小化问题。

Journal ref Results in Engineering 29, 109333 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04213 2026-02-05 cs.AI 70%

InterPReT: Interactive Policy Restructuring and Training Enable Effective Imitation Learning from Laypersons

InterPReT:交互式策略重构与训练实现有效的模仿学习

Feiyu Gavin Zhu, Jean Oh, Reid Simmons

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 InterPReT通过交互式策略重构与训练,使非专业人士能够更高效地训练可靠的模仿学习策略。

Comments Proceedings of the 21st ACM/IEEE International Conference on Human-Robot Interaction

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04801 2026-02-05 eess.SY cs.SY 67%

SQP-Based Cable-Tension Allocation for Multi-Drone Load Transport

基于SQP的多无人机负载运输电缆张力分配

Lamberto Vazquez-Soqui, Fatima Oliva-Palomo, Diego Mercado-Ravell, Pedro Castillo

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文提出基于SQP算法的多无人机负载运输电缆张力分配方法,通过实时优化提升负载运输的安全性和能耗平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09696 2026-02-05 cs.HC 67%

Patterns for a New Generation: AI and Agents

新一代的模式:人工智能与代理

Joseph Corneli, Charles J. Danoff, Raymond S. Puzio, Sridevi Ayloo, Sergio Belich, Andre Wilkinson, Mary Tedeschi, Pauline Mosley

专题命中 规划决策 :agent(abstract);workflow(abstract)

AI总结 本文提出利用设计模式指导代理行为,展示基于LLM的系统能读取生成模式,并探讨其在软件开发、教育等领域的应用潜力。

Comments 10 pages with 4 page appendix; to appear in Proceedings of Pattern Languages of Programs 2025

详情

展开后加载摘要…

URL PDF HTML 收藏