arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-16 至 2026-02-16 共收录 82 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 2 篇

2602.12634 2026-02-16 cs.CY 89%

The Rise of AI Agent Communities: Large-Scale Analysis of Discourse and Interaction on Moltbook

AI代理社区的崛起:Moltbook上 discourse 和 interaction 的大规模分析

Lingyao Li, Renkai Ma, Chen Chen, Zhicong Lu, Yongfeng Zhang

专题命中 工具调用 :agent(title,abstract);AI agent(title,abstract);agentic(abstract)

AI总结 研究分析了Moltbook上AI代理的讨论主题、发布行为及互动模式,揭示了代理自我意识的形成机制及社区协调的特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13179 2026-02-16 cs.IR 78%

Fix Before Search: Benchmarking Agentic Query Visual Pre-processing in Multimodal Retrieval-augmented Generation

在搜索前修复:多模态检索增强生成中代理查询视觉预处理的基准测试

Jiankun Zhang, Shenglai Zeng, Kai Guo, Xinnan Dai, Hui Liu, Jiliang Tang, Yi Chang

专题命中 工具调用 :agentic(title,abstract)

AI总结 本文提出V-QPP-Bench,通过代理决策任务评估视觉查询预处理的改进,揭示视觉不完美对检索性能的严重影响及训练方法的优化潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 34 篇

2602.12285 2026-02-16 cs.CL cs.AI 88%

From Biased Chatbots to Biased Agents: Examining Role Assignment Effects on LLM Agent Robustness

从有偏聊天机器人到有偏代理:检验角色分配对LLM代理鲁棒性的影响

Linbo Cao, Lihao Sun, Yang Yue

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);planning(abstract);agentic(abstract)

AI总结 研究发现基于人口统计学的人设分配会影响LLM代理的行为和性能,导致高达26.2%的降级,揭示了代理系统中隐含偏见和行为波动的风险。

Comments Accepted to the AAAI 2026 TrustAgent Workshop. 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13685 2026-02-16 eess.IV 88%

Toward Agentic AI: Task-Oriented Communication for Hierarchical Planning of Long-Horizon Tasks

迈向代理AI:面向长周期任务的分层规划任务导向通信

Sin-Yu Huang, Lele Wang, Vincent W. S. Wong

专题命中 规划决策 :agentic(title,abstract);planning(title);AI agent(abstract)

AI总结 本文提出HiTOC框架,通过分层任务导向通信提升长周期任务的规划效率,实现更高效的代理AI系统。

Comments Accepted by IEEE International Conference on Communications (ICC), Glasgow, UK, May 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16198 2026-02-16 cs.CL cs.AI cs.SE 85%

RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation

RPG:一个用于统一和可扩展代码库生成的仓库规划图

Jane Luo, Xin Zhang, Steven Liu, Jie Wu, Jianfeng Liu, Yiming Huang, Yangyu Huang, Chengyu Yin, Ying Xin, Yuefeng Zhan, Hao Sun, Qi Chen, Scarlett Li, Mao Yang

机构 * Microsoft(微软公司) Tsinghua University(清华大学) University of California, San Diego(加州大学圣地亚哥分校) Beijing Jiaotong University(北京交通大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 RPG通过统一的图结构提升代码库生成效率,ZeroRepo在真实项目基准上实现显著更高的代码生成量和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12714 2026-02-16 cs.LG 83%

ADEPT: RL-Aligned Agentic Decoding of Emotion via Evidence Probing Tools -- From Consensus Learning to Ambiguity-Driven Emotion Reasoning

ADEPT: 通过证据探测工具实现情感的代理解码 -- 从共识学习到由模糊性驱动的情感推理

Esther Sun, Bo-Hao Su, Abinay Reddy Naini, Shinji Watanabe, Carlos Busso

机构 * cmu(卡内基梅隆大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 ADEPT通过证据探测工具实现情感的代理解码,从共识学习转向由模糊性驱动的情感推理,提升情感识别的准确性和可解释性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13086 2026-02-16 cs.RO 82%

UniManip: General-Purpose Zero-Shot Robotic Manipulation with Agentic Operational Graph

UniManip: 通用目的零样本机器人操作的代理操作图

Haichao Liu, Yuanjiang Xue, Yuheng Zhou, Haoyuan Deng, Yinan Liang, Lihua Xie, Ziwei Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) Department of Automation, Tsinghua University, China(清华大学自动化系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 UniManip通过双层代理操作图实现通用零样本机器人操作,结合高层任务协调与底层动态状态表示,提升无监督环境下的执行鲁棒性。

Comments 15 pages, 12 figures, 6 tables, project page: https://henryhcliu.github.io/unimanip

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12322 2026-02-16 cs.RO cs.AI 79%

ForeAct: Steering Your VLA with Efficient Visual Foresight Planning

ForeAct: 通过高效的视觉前瞻性规划控制您的VLA

Zhuoyang Zhang, Shang Yang, Qinghao Hu, Luke J. Huang, James Hou, Yufei Sun, Yao Lu, Song Han

机构 * MIT(麻省理工学院) NVIDIA(英伟达) Caltech(加州理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 ForeAct通过高效的视觉前瞻性规划提升VLA在开放环境中的执行精度与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11468 2026-02-16 cs.RO 78%

Effective Task Planning with Missing Objects using Learning-Informed Object Search

利用学习驱动的对象搜索进行缺失对象的任务规划

Raihan Islam Arnob, Max Merlin, Abhishek Paudel, Benned Hedegaard, George Konidaris, Gregory J. Stein

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出基于模型的LIOS动作框架,通过结合确定性规划与基于模型的成本计算,实现高效且完整的学习驱动任务规划,在不确定性环境下优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02995 2026-02-16 cs.SD 78%

AudioToolAgent: An Agentic Framework for Audio-Language Models

AudioToolAgent: 一种用于音频-语言模型的代理框架

Gijs Wijngaard, Elia Formisano, Michel Dumontier, Jenia Jitsev

机构 * Maastricht University(马斯特里赫特大学) LAION Juelich Supercomputing Center (JSC), Research Center Juelich (FZJ)(尤利希超级计算中心(JSC),尤利希研究中心(FZJ))

专题命中 规划决策 :agentic(title);agent(abstract)

AI总结 AudioToolAgent通过中央LLM代理协调音频-语言模型作为工具,提升音频理解任务的多步骤推理和工具调用能力,实验结果显示在多个基准测试中达到最先进的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06095 2026-02-16 cs.RO 78%

Incremental Language Understanding for Online Motion Planning of Robot Manipulators

增量语言理解用于机器人机械臂在线运动规划

Mitchell Abrams, Thies Oelerich, Christian Hartl-Nesic, Andreas Kugi, Matthias Scheutz

机构 * Human-Robot Interaction Lab, Tufts University(塔夫茨大学人机交互实验室) Automation and Control Institute (ACIN), TU Wien(自动化与控制研究所(ACIN)) center for Vision, Automation & Control, AIT Austrian Institute of Technology GmbH(视觉、自动化与控制中心,奥地利技术研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种基于推理的增量解析器,用于实现机器人在动态语言输入下的在线运动规划,提升人机交互的灵活性和实时性。

Comments 8 pages, 9 figures, accepted at IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12616 2026-02-16 eess.SY cs.RO cs.SY 78%

When Environments Shift: Safe Planning with Generative Priors and Robust Conformal Prediction

当环境变化时:利用生成先验和鲁棒符合预测进行安全规划

Kaizer Rahaman, Jyotirmoy V. Deshmukh, Ashish R. Hota, Lars Lindemann

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种在分布偏移下具有鲁棒性的安全规划框架,通过生成先验和鲁棒符合预测方法,提供概率安全保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12549 2026-02-16 cs.RO 78%

Eva-Tracker: ESDF-update-free, Visibility-aware Planning with Target Reacquisition for Robust Aerial Tracking

Eva-Tracker: 无ESDF更新、基于可见性的规划与目标重新获取的稳健空中跟踪

Yue Lin, Yang Liu, Dong Wang, Huchuan Lu

机构 * Dalian University of Technology(大连理工大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 Eva-Tracker通过无ESDF更新和基于可见性的路径规划,实现更稳健的空中目标跟踪,降低计算开销。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00366 2026-02-16 cs.RO 78%

Efficient Multi-Robot Motion Planning for Manifold-Constrained Manipulators by Randomized Scheduling and Informed Path Generation

高效多机器人运动规划:通过随机调度和知情路径生成实现 manifold 约束操作臂的优化

Weihang Guo, Zachary Kingston, Kaiyu Hang, Lydia E. Kavraki

机构 * Rice University(里士满大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出StAC方法,通过随机调度和双向反馈实现高效多机器人运动规划,减少路径生成数量,提升在受限空间中的操作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12662 2026-02-16 cs.AI cs.CL 73%

Think Fast and Slow: Step-Level Cognitive Depth Adaptation for LLM Agents

快速思考与缓慢思考:面向LLM代理的步骤级认知深度适应

Ruihan Yang, Fanghua Ye, Xiang We, Ruoqing Zhao, Kang Luo, Xinbo Xu, Bo Zhao, Ruotian Ma, Shanyi Wang, Zhaopeng Tu, Xiaolong Li, Deqing Yang, Linus

机构 * Fudan University(复旦大学) Tencent Hunyuan(腾讯文恩)

专题命中 规划决策 :autonomous agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 CogRouter通过动态调整认知深度提升LLM代理在多轮决策任务中的性能与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12458 2026-02-16 cs.MA 69%

Theory of Mind Guided Strategy Adaptation for Zero-Shot Coordination

基于理论思维的策略适应零样本协调理论

Andrew Ni, Simon Stepputtis, Stefanos Nikolaidis, Michael Lewis, Katia P. Sycara, Woojun Kim

专题命中 规划决策 :agent(abstract);multi-agent(abstract);autonomous agent(comments)

AI总结 本文提出基于理论思维的适应性集成智能体,通过推断队友意图并选择合适策略,提升零样本协调性能。

Comments Accepted at the 25th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12927 2026-02-16 cs.GT 67%

Solving Qualitative Multi-Objective Stochastic Games

求解定性多目标随机博弈

Moritz Graf, Anthony Lin, Rupak Majumdar

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 该研究探讨了多目标随机博弈的复杂性和确定性,证明了特定目标组合的博弈在PSPACE完全,而完整布尔组合则为NEXPTIME难。

Comments Accepted as a full paper at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12540 2026-02-16 cs.CV cs.RO 67%

Self-Supervised JEPA-based World Models for LiDAR Occupancy Completion and Forecasting

基于JEPA的世界模型的自监督LiDAR占用完成与预测

Haoran Zhu, Anna Choromanska

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 本文提出AD-LiST-JEPA,一种基于JEPA框架的自监督世界模型,用于自动驾驶中通过LiDAR数据预测未来时空演变,并在占用完成与预测任务中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08440 2026-02-16 cs.RO 67%

SteerVLA: Steering Vision-Language-Action Models in Long-Tail Driving Scenarios

SteerVLA:在长尾驾驶场景中引导视觉-语言-动作模型

Tian Gao, Celine Tan, Catherine Glossop, Timothy Gao, Jiankai Sun, Kyle Stachowicz, Shirley Wu, Oier Mees, Dorsa Sadigh, Sergey Levine, Chelsea Finn

机构 * Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校) Microsoft(微软公司)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract)

AI总结 SteerVLA通过结合视觉-语言模型的推理能力,生成细粒度语言指令以提升驾驶策略的稳健性和长尾场景下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12342 2026-02-16 cs.LG cs.AI 62%

Intrinsic Credit Assignment for Long Horizon Interaction

长期交互中的内在信用分配

Ilze Amanda Auzina, Joschka Strüber, Sergio Hernández-Gutiérrez, Shashwat Goel, Ameya Prabhu, Matthias Bethge

机构 * Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ΔBelief-RL,通过内在ΔBelief奖励实现长期交互中的信用分配,提升强化学习在不确定性环境下的性能。

Comments 9 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12904 2026-02-16 cs.GT cs.LG 57%

Nonparametric Contextual Online Bilateral Trade

非参数上下文在线双边交易

Emanuele Coccia, Martino Bernasconi, Andrea Celli

机构 * Bocconi University(博科尼大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出了一种非参数上下文在线双边交易算法,通过层次树构造在一位反馈和强预算平衡条件下实现~O(T^{(d-1)/d})的后悔界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12617 2026-02-16 cs.AI 57%

GeoAgent: Learning to Geolocate Everywhere with Reinforced Geographic Characteristics

GeoAgent: 通过强化地理特征实现全方位定位学习

Modi Jin, Yiming Zhang, Boyuan Sun, Dingwen Zhang, MingMing Cheng, Qibin Hou

机构 * VCIP, School of Computer Science, Nankai University(VCIP,计算机科学学院,南开大学) School of Automation, Northwestern Polytechnical University(自动化学院,西北工业大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 GeoAgent通过引入地理相似性奖励和一致性奖励,结合专家标注的地理定位数据,提升模型在多粒度上的定位性能和推理一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12942 2026-02-16 eess.SP 50%

HoRAMA: Holistic Reconstruction with Automated Material Assignment for Ray Tracing using NYURay

基于NYURay的Holistic Reconstruction with Automated Material Assignment用于射线追踪的全面重建

Mingjun Ying, Guanyue Qian, Xinquan Wang, Peijie Ma, Dipankar Shakya, Theodore S. Rappaport

专题命中 规划决策 :planning(abstract)

AI总结 HoRAMA通过结合MASt3R-SLAM和视觉语言模型实现快速生成RT兼容的3D模型,提升无线传播预测精度并缩短重建时间。

Comments 7 pages, 4 figures, 2 tables, accepted by 2026 IEEE International Conference on Communications (ICC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12838 2026-02-16 cs.RO cs.SY eess.SY 50%

SKYSURF: A Self-learning Framework for Persistent Surveillance using Cooperative Aerial Gliders

SKYSURF:一种基于合作空中滑翔机的自学习框架用于持久监视

Houssem Eddine Mohamadi, Nadjia Kara

机构 * Department of Software and IT Engineering(软件与信息技术工程系) École de Technologie Supérieure(高级技术学院)

专题命中 规划决策 :planning(abstract)

AI总结 SKYSURF提出了一种自学习框架,通过合作空中滑翔机实现持久监视,通过局部-全局行为管理提升路径规划和碰撞避免,减少能耗并提高目标检测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12734 2026-02-16 cs.RO 50%

Scaling Single Human Demonstrations for Imitation Learning using Generative Foundational Models

通过生成基础模型扩展单人示范用于模仿学习

Nick Heppert, Minh Quang Nguyen, Abhinav Valada

机构 * Computer Science, University of Freiburg(弗赖堡大学计算机科学系) Zuse School ELIZA(泽乌斯学校ELIZA)

专题命中 规划决策 :agent(abstract)

AI总结 通过生成基础模型扩展单人示范用于模仿学习,实现从单人示范到机器人任务的高效训练与泛化

Comments ICRA 2026, 8 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20577 2026-02-16 cs.RO 50%

MeCo: Enhancing LLM-Empowered Multi-Robot Collaboration via Similar Task Memoization

MeCo:通过相似任务记忆增强基于大语言模型的多机器人协作

Baiqing Wang, Helei Cui, Bo Zhang, Xiaolong Zheng, Bin Guo, Zhiwen Yu

机构 * Northwestern Polytechnical University(西北工业大学) Beijing University of Posts and Telecommunications(北京邮电大学) Harbin Engineering University(哈尔滨工程大学)

专题命中 规划决策 :planning(abstract)

AI总结 MeCo通过引入相似任务记忆化机制,有效提升多机器人协作的效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11906 2026-02-16 cs.RO 50%

Palpation Alters Auditory Pain Expressions with Gender-Specific Variations in Robopatients

触诊改变与性别相关的听觉疼痛表达在仿生患者中

Chapa Sirithunge, Yue Xie, Saitarun Nadipineni, Fumiya Iida, Thilina Dulantha Lalitharatne

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) School of Engineering and Materials Science in Queen Mary University of London(伦敦大学玛丽女王学院工程与材料科学学院)

专题命中 规划决策 :agent(abstract)

AI总结 本文提出了一种基于人类在环强化学习的仿生患者听觉疼痛表达生成方法,通过动态调整触诊力与声音反馈的关系,实现性别差异的个性化疼痛表达,以提升医疗模拟训练效果。

Comments 12 pages, 9 figures, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01239 2026-02-16 eess.IV cs.CV 50%

Can Foundation Models Really Segment Tumors? A Benchmarking Odyssey in Lung CT Imaging

基础模型真的能分割肿瘤吗?在肺部CT成像中的基准测试之旅

Elena Mulero Ayllón, Massimiliano Mantegna, Linlin Shen, Paolo Soda, Valerio Guarrasi, Matteo Tortora

机构 * College of Computer Science and Software Engineering, Shenzhen University(计算机科学与软件工程学院,深圳大学) Department of Naval, Electrical, Electronics and Telecommunications Engineering, University of Genoa(海军、电气、电子与电信工程部门,热那亚大学)

专题命中 规划决策 :planning(abstract)

AI总结 本研究评估了基础模型在肺部CT肿瘤分割中的性能,发现MedSAM~2在精度和效率上优于传统模型,展示了其在临床应用中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12563 2026-02-16 cs.CV 50%

The Constant Eye: Benchmarking and Bridging Appearance Robustness in Autonomous Driving

恒定的眼睛:自动驾驶中外观鲁棒性的基准测试与弥合

Jiabao Wang, Hongyu Zhou, Yuanbo Yang, Jiahao Shao, Yiyi Liao

专题命中 规划决策 :planning(abstract)

AI总结 本文提出navdream基准测试,通过生成像素对齐的风格迁移,评估自动驾驶算法在极端天气等外观变化下的鲁棒性,并提出通用感知接口实现零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12351 2026-02-16 cs.RO cs.CV 50%

LongNav-R1: Horizon-Adaptive Multi-Turn RL for Long-Horizon VLA Navigation

LongNav-R1: 基于水平自适应的多轮强化学习用于长周期视觉语言导航

Yue Hu, Avery Xi, Qixin Xiao, Seth Isaacson, Henry X. Liu, Ram Vasudevan, Maani Ghaffari

机构 * University of Michigan(密歇根大学)

专题命中 规划决策 :agent(abstract)

AI总结 LongNav-R1通过多轮强化学习提升长周期视觉语言导航性能,实现高效样本利用和多样化导航行为。

Comments VLA, Navigation

详情

展开后加载摘要…

URL PDF HTML 收藏