arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 2002 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 2002 篇

2606.08513 2026-06-09 cs.RO cs.LG cs.SY eess.SY 新提交 79%

Towards End to End Motion Planning and Execution for Autonomous Underwater Vehicles Using Reinforcement Learning

面向自主水下机器人的端到端运动规划与执行:基于强化学习的方法

Elisei Shafer, Oren Gal

机构 * University of Haifa(海法大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出分层强化学习架构,将原始传感器数据直接映射为推进器指令,实现AUV端到端运动规划与执行,在HoloOcean仿真中轨迹长度接近RRT*基线(误差4%-6%),并具备鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06877 2026-06-08 cs.RO cs.AI 新提交 79%

Neuro-Symbolic Learning for Long-Horizon Task Planning Under Complex Logical Constraints

复杂逻辑约束下长时域任务规划的神经符号学习

Qiwei Du, Zitong Zhan, Shaoshu Su, Bowen Li, Yi Du, Zhipeng Zhao, Taimeng Fu, Sebastian Scherer, Jiaoyang Li, Chen Wang

机构 * Spatial AI & Robotics (SAIR) Lab, University at Buffalo, NY 14260(空间人工智能与机器人实验室,布法罗大学,纽约州,14260) Robotics Institute, Carnegie Mellon University, PA 15213(机器人研究所,卡内基梅隆大学,宾夕法尼亚州,15213)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出基于命令学习的双层优化框架,通过神经评分器剪枝无关对象,并引入3R策略(修复、重启、回滚)稳定下层规划,在三个基准上实现失败率降低80.04%、规划时间减少57.14%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06805 2026-06-08 cs.RO cs.AI cs.SY eess.SY 新提交 79%

Lane Change Trajectory Planning for Personalized Driving Comfort and Mobility Efficiency

车道变更轨迹规划:个性化驾驶舒适性与移动效率

Haoxuan Dong, Dongjun Li, Ziyou Song

机构 * Department of Mechanical Engineering(机械工程系) Department of Electrical Engineering(电气工程系) National University of Singapore(新加坡国立大学) Computer Science(计算机科学) University of Michigan(密歇根大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出一种神经网络驱动的轨迹规划器,结合三阶多项式轨迹生成与学习模块,通过双头共享骨干和基于误差胜者逻辑回归的统计门控机制,实现个性化舒适性与移动效率的平衡。

Comments Accepted by the IEEE Intelligent Vehicles Symposium (IEEE IV 2026), Detroit, MI, United States, June 22_25, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07555 2026-08-11 cs.RO 新提交 79%

You Don't Need To Stay in The Loop: An Agentic Robotics Loop for Robot-Policy Improvement

你无需停留在循环中:用于机器人策略改进的智能体机器人循环

Hang Yu

专题命中 规划决策 :agentic(title,comments);agent(abstract)

AI总结 该研究将编码智能体的软件循环架构迁移至机器人策略改进领域,提出AgenticRobotics控制平面,解决机器人工具易失效问题,实现错误提升控制等性能提升。

Comments Agentic Robotics Preview Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07496 2026-08-11 cs.HC 新提交 79%

Human-Simulation Interaction: From Prediction to Exploration in LLM Agent Simulations for Policy

人机模拟交互:面向政策的大语言模型智能体模拟中从预测到探索

Huanxing Chen

专题命中 规划决策 :agent(title,abstract)

AI总结 该研究针对政策领域大语言模型智能体模拟的人机交互问题,提出需将当前问答式交互转为支持探索的人机模拟交互,以解决模型准确率无法弥补的信任赤字。

Comments 4 pages. Position paper accepted to PoliSim@CHI 2026: LLM Agent Simulation for Policy, a workshop at CHI 2026 (CHI Conference on Human Factors in Computing Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27564 2026-07-31 cs.CV 新提交 79%

Inference-Time Agentic Decision Rules Beat Longer Evolving Search for Multi-Image Medical Reasoning

推理时代理决策规则在多图像医学推理任务中优于更长的进化搜索

Site Li, Jianyi Hao, Xiaofeng Liu

机构 * Yale University(耶鲁大学)

专题命中 规划决策 :agentic(title,abstract)

AI总结 本研究对比5种推理时代理策略,发现多图像医学推理中,顺序投票决策规则比扩展进化搜索预算的影响更大,其最终测试准确率显著优于基线及复杂变体。

Comments Presented at the CVPR 2026 Workshop on Multi-Modal Reasoning for Agentic Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13040 2026-08-14 cs.LG cs.CL 新提交 79%

Latent On-Policy Self-Distillation

隐式在线策略自蒸馏

Guibin Zhang, Jiayang Lyu, Ran Sun, Xinlei Yu, Haoyu Zhao, Qibing Ren, Shuicheng Yan

机构 * Shanghai Jiao Tong University(上海交通大学) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出隐式在线策略自蒸馏(LOPD),将教师的特权上下文改为端到端可学习,在智能体工具使用和代码生成任务上,以远低于对比方法的rollout预算实现了更优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11967 2026-08-13 cs.LG cs.AI 新提交 79%

LoongReflect: Boosting Long-Horizon Reflection in Search Agents via Global Perspective Distillation

LoongReflect:通过全局视角蒸馏提升搜索智能体的长程反思能力

Zhixin Zhang, Xinke Jiang, Zhibang Yang, Weixuan Xu, Guohong Qiu, Xu Chu, Junfeng Zhao, Yasha Wang

专题命中 规划决策 :agent(abstract);tool use(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 LoongReflect是将反思表述为记忆控制策略的训练框架,通过双信号通道结合全局视角蒸馏与结果导向GRPO优化,在多跳检索增强生成和数学推理任务上提升了搜索智能体的长程反思能力。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10366 2026-08-12 cs.AI cs.CL 新提交 79%

DSAgentBench: Can Agents Automate End-to-End Data-Science Workflows in Real Computer Environments?

DSAgentBench:智能体能否在真实计算机环境中自动化端到端数据科学工作流?

Mizanur Rahman, Mohammed Saidul Islam, Ridwan Mahbub, Md Tahmid Rahman Laskar, Shafiq Joty, Enamul Hoque Prince

机构 * York University(约克大学) Nanyang Technological University(南洋理工大学) Salesforce AI Research(Salesforce AI研究院)

专题命中 规划决策 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 DSAgentBench是首个评估智能体在真实计算机环境中自动化完整数据科学工作流的基准,含275项任务,实验显示现有智能体与实际需求存在显著能力差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28098 2026-07-31 cs.AI cs.CL 新提交 79%

SciDataSailor: Deep Scientific Data Exploring

SciDataSailor:深度科学数据探索

Jiyong Rao, Yicheng Qiu, Chi Zhang, Chunfeng Song, Runkai Zhao

专题命中 规划决策 :tool use(abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 该研究针对科学数据仓库交互难题,提出SciDataSailor框架,以带特定机制的MCTS实现轨迹合成,构建了微调模型与含千余任务的评估基准,推动LLM智能体的科学数据探索能力。

Comments 63 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19336 2026-07-22 cs.AI cs.CL 新提交 79%

Agents in the Wild: Where Research Meets Deployment

野外的智能体:研究与部署的交汇点

Grace Hui Yang, Pranav N. Venkit, Hooman Sedghamiz, Enrico Santus, Victor Dibia, Ioana Baldini

机构 * Georgetown University(乔治敦大学) Salesforce(Salesforce公司) Bayer(拜耳公司) Bloomberg(彭博公司) Microsoft Research(微软研究院)

专题命中 规划决策 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 探讨基于大语言模型的智能体系统从研究到部署的转变,通过案例研究分析成功设计模式及失败缓解策略,为与会者提供跨行业安全可靠部署的全面视角、设计模式、评估清单和模板。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20596 2026-06-23 cs.HC cs.AI cs.SE 新提交 79%

HAAS Studio: A Tool for Simulating, Benchmarking, and Governing Human-AI Work Allocation

HAAS Studio: 用于模拟、基准测试和管理人-AI工作分配的工具

Vicente Pelechano

机构 * Valencian Research Institute for Artificial Intelligence(巴伦西亚人工智能研究 institute)

专题命中 规划决策 :planning(abstract,abstract_cn);workflow(abstract);分类 cs.AI、cs.SE

AI总结 提出HAAS Studio,一个用于策略感知的自适应人-AI任务分配的模拟与决策支持工具,结合认知表示、协作光谱、多臂老虎机算法和基于契约的治理,支持多领域部署决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18831 2026-06-18 cs.CL cs.AI 新提交 79%

Beyond Reward Engineering: A Data Recipe for Long-Context Reinforcement Learning

超越奖励工程:长上下文强化学习的数据配方

Xiaoyue Xu, Sikui Zhang, Xiaorong Wang, Xu Han, Chaojun Xiao

机构 * OpenBMB Tsinghua University(清华大学)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出一种简单有效的数据配方,结合最小化基于结果的GRPO设置,显著提升大语言模型的长上下文推理能力,在多个基准和智能体任务上取得平均+3.2至+7.2点的提升。

Comments 15 pages, 6 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16038 2026-06-16 cs.SE cs.AI 新提交 79%

Open-SWE-Traces: Advancing Dual-Mode Multilingual Distillation for Software Engineering Agents

Open-SWE-Traces:推进软件工程智能体的双模式多语言蒸馏

Wasi Uddin Ahmad, Nikolai Ludwig, Somshubra Majumdar, Boris Ginsburg

机构 * NVIDIA(英伟达)

专题命中 规划决策 :agent(abstract,abstract_cn);agentic(abstract);分类 cs.AI、cs.SE

AI总结 为解决软件工程智能体训练数据稀缺问题,构建包含20万条轨迹、覆盖9种编程语言的数据集,采用混合推理合成方法,微调Qwen3-30B-A3B系列模型,在SWE-bench基准上取得领先性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10956 2026-06-10 cs.AI cs.CL 新提交 79%

Mind the Gap: Can Frontier LLMs Pass a Standardized Office Proficiency Exam?

注意差距:前沿大语言模型能否通过标准化办公能力考试?

Tengchao Lv, Dongdong Zhang, Jiayu Ding, Yilin Jia, Yuzhong Zhao, Yupan Huang, Wenshan Wu, Xiangyang Zhou, Shaohan Huang, Nan Yang, Li Dong, Lei Cui, Furu Wei

机构 * Microsoft Research(微软研究院)

专题命中 规划决策 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 基于中国计算机等级考试(NCRE)的200个综合操作任务,评估7个前沿LLM在Word、Excel和PowerPoint自动化中的表现,发现单轮模型最高得分率36.6%,带执行反馈的智能体系统达68.8%,仍低于95.5%的社区参考分,表明可靠细粒度办公自动化仍是重大挑战。

Comments 21 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21013 2026-08-24 eess.SP 新提交 78%

Obstacle-Aware Online Receiver Planning in Multistatic Ranging

多站测距中的障碍物感知在线接收机规划

Jingwei Hu, Dave Zachariah, Petre Stoica, Torbjörn Wigren

专题命中 规划决策 :planning(title,abstract)

AI总结 针对多站测距中障碍物导致视距中断的问题,提出非近视后退时域框架,结合凸避障约束规划接收机轨迹,经数值实验验证其效率与跟踪精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21180 2026-08-24 eess.IV cs.CV 新提交 78%

Toward Vision Language Model-based Assessment of Clinical Quality and Usability of LGE-MR Images for Cardiac Ablation Planning

面向基于视觉语言模型的LGE-MR图像临床质量与可用性评估以用于心脏消融规划

Bipasha Kundu, Abhishek Chaturvedi, Axel W. E. Wismueller, Richard Simon, Cristian A. Linte

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究提出两阶段VLM框架用于左心房LGE-MRI的临床导向图像质量评估,在60个图像切片-文本对数据集上,InternVL2的标准级准确率最高,DeepSeek实现完美临床可用性一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21031 2026-08-24 cs.RO 新提交 78%

PhysCaP: Grounding Code-as-Policy Agent with Physics-Informed Exploration

PhysCaP:基于物理引导探索的代码即策略智能体

Chen-Yu Lin, Jing-Wen Chen, Hsueh-En Chang, Hung-An Chen, Sheng-Hsun Chang, Chi-Pin Huang, Fu-En Yang, Min-Hung Chen, Yi-Ting Chen, Yu-Chiang Frank Wang, Shao-Hua Sun

机构 * National Taiwan University(台湾大学) NVIDIA Research(英伟达研究院) National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 规划决策 :agent(title,abstract)

AI总结 PhysCaP是一种带物理引导探索层的代码即策略智能体,采用双智能体设计,可高效估算物体物理属性,在桌面操纵及LIBERO模拟任务中性能优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20946 2026-08-24 cs.RO 新提交 78%

Fast Coordinated Bimanual Motion Planning With Hard Constraints

带硬约束的快速双协作机械臂运动规划

Borna Paro, Luka Petrović, Ivan Marković

机构 * University of Zagreb(萨格勒布大学) Faculty of Electrical Engineering and Computing(电气工程与计算机学院)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对双臂操作的相对变换硬约束问题,提出主从参数化的快速规划流水线,仿真中规划速度提升19.4倍,实际实验验证轨迹可直接迁移至硬件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20284 2026-08-21 cs.CV cs.RO 新提交 78%

Towards Surgical World-Action Modeling: A Preliminary Joint Visual-Trajectory Forecasting for Surgical Motion Planning

面向外科世界动作建模:外科手术运动规划的初步联合视觉-轨迹预测

Weiliang Huang, Huanrong Liu, Bob Zhang, Qi Dou, Zhen Chen, Yun Gu, Guy Rosman, Qingbiao Li

机构 * University of Macau(澳门大学) University of Macau Advanced Research Institute in Hengqin(澳门大学横琴研究院) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学) Shanghai Jiao Tong University(上海交通大学) Tongren Hospital(同仁医院) Duke University(杜克大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出初步联合视觉-轨迹世界动作模型,从历史手术观测中同时预测未来视觉状态与器械轨迹,采用分块自回归展开法,提升了预测性能,证明了联合预测的可行性,但仍存在长范围预测的退化与误差挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19537 2026-08-21 cs.RO 新提交 78%

Multimodal Trajectory Planning for Surface Vehicles using Turning Circle-based Control Barrier Functions

基于转向圆型控制障碍函数的水面航行器多模态轨迹规划

Changyu Lee

机构 * Kongju National University(公州国立大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文针对动态环境下自主水面航行器,提出结合MPC与TC-CBF的无引导路径多模态轨迹规划框架,可提升避碰成功率、减少安全违规并缓解局部极小问题。

Comments This work has been submitted to an Elsevier journal for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19453 2026-08-21 cs.RO cs.FL 新提交 78%

When Automata Meet Streams: Temporal Logic Compilation for Stream-Based Robotics Task and Motion Planning

自动机与流的结合:面向基于流的机器人任务与运动规划的时态逻辑编译

Sayem Nazmuz Zaman, Cyrus Neary

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究提出SAM-TD方法,将LTL_f约束编译为自动机并嵌入动作模式,实现基于流的TAMP对动态生成对象的时态约束处理,在机器人环境中验证了其可行性与竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18908 2026-08-20 cs.CE 新提交 78%

Image Generation Techniques for Urban Planning

面向城市规划的图像生成技术

Katharina Roth, Eva Hagen, Alexander Bartscher, Inga Scheler, Nicolas R. Gauger

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究开发了基于掩码的加权条件流匹配(MWCFM)模型,用于自动生成城市场景中的建筑演示图像,并通过应用相关指标评估其性能,为城市规划图像生成提供优化方案。

Comments 9 pages (incl. references), 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18844 2026-08-20 eess.SY cs.SY 新提交 78%

Robust Joint Planning of EV and eBus Charging Infrastructure with PV Self-Consumption under Demand Uncertainty

考虑需求不确定性的、结合光伏自发自用的电动汽车与电动公交车充电基础设施的鲁棒联合规划

Biswarup Mukherjee

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出结合光伏自发自用的混合整数线性规划框架,对电动汽车与电动公交车充电基础设施进行鲁棒联合规划,通过50节点案例验证了相关策略的有效性。

Comments This manuscript has been submitted for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18833 2026-08-20 cs.CV 新提交 78%

EVADE: Evidence-Verified Agentic Diagnosis with Escape

EVADE:带弃权机制的证据验证智能诊断方法

Mohaimenul Azam Khan Raiaan, Nur Mohammad Fahad

机构 * Monash University(莫纳什大学) Murdoch University(默多克大学)

专题命中 规划决策 :agentic(title,abstract)

AI总结 该研究针对医学VLMs不可靠问题,提出无需训练的EVADE方法,通过跨图像视图验证一致性并引入弃权机制,在多医学VQA数据集上提升了校准度与选择性风险,同时维持了准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18357 2026-08-20 cs.CY 新提交 78%

Capability-Based Planning for AI Crisis Preparedness

面向AI危机准备的基于能力的规划

Isaak Mengesha, Charlie Collins, Juan Felipe Cerón Uribe, Salvatore d'Ambrosio, Vickie Ellis

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究针对AI难以预测的问题,提出三部分组成的基于能力的规划方法框架,经四类AI赋能威胁试点验证,为AI危机准备提供实用工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18254 2026-08-20 cs.RO 新提交 78%

GAPL: Grounded Action-effect Policy Learning for LLM-Based Trajectory Planning

GAPL:面向基于大语言模型的轨迹规划的接地动作效果策略学习

Zhihong Cui, Hengyu Liu, Zhangkai Wu, Yushuai Li, Tianyi Li, Peiyuan Guan, Amir Taherkordi, Tor Skeie

机构 * University of Oslo(奥斯陆大学) Aalborg University(奥尔堡大学) University of Sydney(悉尼大学) Nanjing University of Information Science and Technology(南京信息工程大学) Simula Research Laboratory(西穆拉研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对LLM用于自动驾驶轨迹规划时存在的幻觉、接地不足等问题,提出GAPL框架,整合三类模块并经实验验证其性能优于基线方法

Comments 11 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17324 2026-08-19 cs.RO 新提交 78%

Reconfiguration-Complete Motion Primitives with Constructive Planning for Deformable Planar Modular Robots

面向可变形平面模块化机器人的带构造性规划的可重构完备运动原语

Jie Gu, Tingting Wang, Hongrun Gao, Yirun Sun, Zhihao Xia, Chunxu Tian, Dan Zhang

机构 * Institute of AI and Robotics, Academy for Engineering & Technology, Fudan University(复旦大学工程与技术学院人工智能与机器人研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对可变形平面模块化机器人重构规划的固定表示难题,提出带构造性规划的运动原语及前瞻选择器,证明N≥7的边连接非直线构型可相互重构,实验显示规划时间短于现有框架。

Comments Jie Gu and Tingting Wang contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17172 2026-08-19 cs.NE 新提交 78%

Automating Parent Selection Configuration in Genetic Programming with Agentic AI

用智能体人工智能实现遗传编程中父代选择配置的自动化

Jose Guadalupe Hernandez, Jui-Hsuan Chang, Anil Kumar Saini, Xi Li, Jason H. Moore

专题命中 规划决策 :agentic(title,abstract)

AI总结 该研究提出智能体AI框架,结合LLM推理与RAG实现遗传编程父代选择配置自动化,经符号回归测试,5 mini--AR配置表现优于锦标赛选择,为进化系统自动化设计提供了新路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17038 2026-08-19 cs.RO 新提交 78%

Terrain-Aware Local Path Planning with Global DEM Data Integration for Autonomous UGV Navigation

面向自主无人地面车辆(UGV)导航的融合全球数字高程模型(DEM)数据的地形感知局部路径规划

Devender Singh, Issah Nazif Suleiman, Paul Mitten, Glenn Cutler, Vinicius Prado da Fonseca, Matthew Hamilton

机构 * Memorial University of Newfoundland(纽芬兰纪念大学) Compusult Ltd.(康普萨尔特有限公司)

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究针对UGV户外导航中全局地图与实时传感器反馈脱节的问题,提出融合DEM与LiDAR的混合路径规划框架,经仿真验证可提升障碍物规避率、降低平均坡度,为可靠自主导航提供支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏