arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-31 至 2026-08-31 共收录 175 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 50 篇

2608.28300 2026-08-31 cs.RO cs.AI 新提交 79%

MaCoPlanner: LLM-Assisted Manual-Compiled Task Planning with Proactive Safety Verification for Robotic Industrial Panel Operation

MaCoPlanner:面向机器人工业面板操作的、结合主动安全验证的大语言模型辅助人工编译任务规划

Guipeng Xin, Jiahe Xua, Mohammad Deghat, Chenhui Wan, Jie Liu, Youmin Hu, Zhongxu Hu

机构 * Huazhong University of Science and Technology(华中科技大学) University of New South Wales(新南威尔士大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 MaCoPlanner是面向机器人工业面板操作的规划框架,通过编译设备手册知识生成规划,经主动安全验证后执行,大幅提升了任务成功率,在Level-2、Level-3任务上分别提升了21.6、17.3个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27609 2026-08-31 cs.RO cs.AI 新提交 79%

PHR-VLA: Planning Horizon Reasoning for Vision-Language-Action Models

PHR-VLA:面向视觉-语言-动作模型的规划视界推理

Davood Soleymanzadeh, Kaidi Zhang, Zhiyuan Zhang, Bihao Zhang, Xiao Liang, Yu She, Minghui Zheng

机构 * Texas A&M University(德克萨斯农工大学) Purdue University(普渡大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 该研究针对现有视觉-语言-动作模型缺乏未来任务动态推理机制的问题,提出PHR-VLA框架,通过辅助未来头对齐潜在动态,提升了机器人操纵任务的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18682 2026-08-31 cs.AI 版本更新 79%

RTPO: Reverse-Turn Policy Optimization for Stabilizing Agentic RL Training

RTPO:用于稳定智能体强化学习训练的反向回合策略优化

Yugu Li, Jimmy Cao, Jianglin Qiao, Siyi Hu

机构 * Adelaide University(阿德莱德大学) The University of Sydney(悉尼大学) Curtin University(科廷大学) School of CSIT(计算机科学与信息技术学院) ACFR(澳大利亚空间研究中心) School of EECMS(电子工程、计算机与数学科学学院)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 针对多回合智能体RL训练不稳定问题,提出RTPO方法,通过反向回合策略优化消除上下文不匹配与异步漂移,实验显示其较基线提升21.50%、10.76%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22713 2026-08-31 cs.AI 版本更新 79%

SEGRA: A Structured Experience Guided Reasoning Agent for Property Graph Question Answering

SEGRA:用于基于Gremlin的问答的结构化经验引导图推理代理

Saiyue Lyu, Mariam Dundua, Vishaal Kapoor, Sarthak Ahuja, Neda Kordjazi, Evren Yortucboylu, Harsh Amin, Rebecca Steinert

机构 * University of British Columbia(英属哥伦比亚大学) Amazon(亚马逊)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 针对企业文本到Gremlin问答难题,SEGRA引入经验引导代理,集成多种技术,包括意图路由、查询生成等。在企业IT支持基准测试中成绩出色,平均评判分数大幅提高,技能库还降低了成本,提升了企业图问答的准确性与效率。

Comments Accepted at EMNLP 2026 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28075 2026-08-31 cs.RO 新提交 78%

Plan Along the Way: Event-Triggered Foundation-Model Planning for TAMP Execution in Partially Observable Manipulation

动态规划:部分可观测操纵任务中用于TAMP执行的事件触发式基础模型规划

Puru Ojha, Narendhiran Vijayakumar, Nav Singhal, Girish Varma, Antony Thomas

机构 * Robotics Research Center, IIIT Hyderabad(IIIT海得拉巴机器人研究中心) Center for Security, Theory and Algorithmic Research, IIIT Hyderabad(IIIT海得拉巴安全、理论与算法研究中心)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出ROBUST TAMP框架,针对部分可观测操纵任务,通过事件触发式重规划机制提升TAMP执行的任务成功率,验证了其在6个RLBench/CoppeliaSim场景中的有效性。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19881 2026-08-31 q-bio.NC 版本更新 78%

Planning difficulty and temporal constraints differently shape the level of detail and ordering of visual exploration

问题难度和等待时间影响人类规划中视觉策略的细节和时间组织水平

Mattia Eluchans, Giovanni Pezzulo

专题命中 规划决策 :planning(title,abstract)

AI总结 研究探讨了问题难度和等待时间如何影响人类规划中视觉策略的细节和时间组织,发现难度增加视觉覆盖,时间影响执行中的重计划程度和目光路径一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11072 2026-08-31 cs.RO math.OC 版本更新 78%

Receding Fixed-Horizon Optimization for Near-Time-Optimal Trajectory Planning and Control

后退固定时域优化用于近时间最优轨迹规划与控制

Haotian Tan, Yuan-Hua Ni

机构 * College of Artificial Intelligence, Nankai University, Tianjin 300350, PR China(人工智能学院,南开大学,天津)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对自动驾驶车辆时间最优轨迹规划的两大挑战,提出分层凸优化框架,分解问题为短固定时域规划循环,实验显示其成功率更高、计算时间更短,可实现可靠实时近时间最优轨迹规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30105 2026-08-31 cs.SE 版本更新 77%

EvoRepair: Enhancing Vulnerability Repair Agents Through Experience-Based Self-Evolution

EvoRepair: 通过基于经验的自我进化增强漏洞修复智能体

Haichuan Hu, Guoqing Xie, Quanjun Zhang, Jiawei Liu, Shengcheng Yu, Chunrong Fang, Zhenyu Chen, Liang Xiao

专题命中 规划决策 :agent(abstract,abstract_cn);agentic(abstract);分类 cs.SE

AI总结 提出EvoRepair框架,通过循环学习-修复过程积累和复用漏洞修复经验,在多个基准上显著提升LLM的自动漏洞修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19151 2026-08-31 cs.AI cs.MA 版本更新 77%

Multimodal Collaborative Debate for Zero-Shot Time Series Reasoning

TS-Debate:多模态协作辩论用于零样本时间序列推理

Patara Trirat, Jin Myung Kwak, Jay Heo, Heejun Lee, Sung Ju Hwang

机构 * KAIST Seoul(韩国科学技术院)

专题命中 规划决策 :agent(abstract);tool use(abstract);multi-agent(abstract);分类 cs.AI

AI总结 TS-Debate通过多模态协作辩论框架,在零样本时间序列推理中实现显著性能提升,通过专门代理和结构化协议提升模态保真度和数值精度。

Comments EMNLP 2026 (Main), Project Page: this https URL (https://deepauto-ai.github.io/ts-debate/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28128 2026-08-31 cs.LG cs.AI 新提交 76%

VICT: Verifier-Instrumented Credit Tracing for Long-Horizon LLM Agent Reinforcement Learning

VICT:用于长 horizon LLM 智能体强化学习的验证器插装式信用追踪

Pengcheng Li, Zhengyang Zhang, Dongxu Zhang, Sui Huang, Shaohua Ma

机构 * Tsinghua University(清华大学) Xi’an Jiaotong University(西安交通大学) Jiaxing Nanhu University(嘉兴南湖学院)

专题命中 规划决策 :agent(title);分类 cs.AI、cs.LG

AI总结 针对长 horizon LLM 智能体强化学习的细粒度信用分配挑战,提出 VICT 方法,通过验证器侧的证明边追踪分配信用,在 ALFWorld 和 WebShop 上性能显著优于仅结果训练。

Comments accepted by EMNLP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28182 2026-08-31 physics.soc-ph cs.CL 新提交 74%

Benchmarking large language model agent societies against human behavioural distributions

针对人类行为分布的大语言模型智能体群体基准测试

Raad Bin Tareaf

专题命中 规划决策 :agent(title);分类 cs.CL

AI总结 该研究开发了开源工具SILICA,测试12个大语言模型智能体群体与人类行为的契合度,发现多数模型仅起始行为与人类相近,最终行为、合作模式等均存在显著差距,仅推理训练模型表现接近人类,当前硅基智能体群体仅支持探索性研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22538 2026-08-31 cs.AI 版本更新 74%

STAGE: Stateful Translation to Agentic Graph Execution with Policy-Scoped Context and Deterministic Control

STAGE:基于策略范围上下文与确定性控制的面向智能体图执行的有状态翻译

Mengxi Luo, Changjia Chen, An Cao, Zirong Huang, Wanyi Dai

专题命中 规划决策 :agentic(title);分类 cs.AI

AI总结 该研究提出可执行图框架\textsc{Stage},将模型判断限缩于策略范围节点、流程控制交由确定性代码,在多基准测试中提升了策略执行的任务成功率与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23149 2026-08-31 cs.AI 版本更新 74%

Describe-Then-Act: Proactive Agent Steering via Distilled Language-Action World Models

描述-然后-行动:通过蒸馏的语言-动作世界模型实现前瞻性智能体导航

Massimiliano Pappa, Luca Romani, Valentino Sacco, Alessio Palma, Stéphane Lathuilière, Fabio Galasso, Xavier Alameda-Pineda, Indro Spinelli

机构 * Sapienza University of Rome, Italy(罗马大学萨皮恩扎) Inria, Univ. Grenoble Alpes, CNRS, LJK(法国国家信息与自动化技术研究所)

专题命中 规划决策 :agent(title);分类 cs.AI

AI总结 本文提出DILLO模型,通过蒸馏方法实现无需视觉模拟的前瞻性智能体导航,提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27505 2026-08-31 cs.CL cs.AI 新提交 73%

A Survey on Rubric-Guided Reinforcement Learning for Language Models

面向语言模型的准则引导强化学习综述

Zifei Shan, Fangning Shao

机构 * WeChat, Tencent(腾讯微信)

专题命中 规划决策 :agentic(abstract,abstract_cn);分类 cs.AI、cs.CL

AI总结 该综述针对传统RLHF的缺陷,提出贝叶斯框架并沿先验-后验轴分类准则引导强化学习,分析语言学相关对齐问题,明确未来研究方向。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20409 2026-08-31 cs.CL cs.AI cs.CY 版本更新 73%

Cognitive Chain-of-Thought (CoCoT): Structured Multimodal Reasoning about Social Situations

认知链式推理(CoCoT):关于社会情境的结构化多模态推理

Eunkyu Park, Wesley Hanwen Deng, Gunhee Kim, Motahhare Eslami, Maarten Sap

机构 * Seoul National University(首尔国立大学) Human-Computer Interaction Institute, Carnegie Mellon University(人机交互研究所,卡内基梅隆大学) Language Technologies Institute, Carnegie Mellon University(语言技术研究所,卡内基梅隆大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出CoCoT框架,通过感知、情境推断和规范应用三个阶段提升多模态社会推理能力,在多个任务中取得显著提升。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00864 2026-08-31 math.OC 版本更新 71%

BattOpt: Optimal Facility Planning for Electric Vehicle Battery Recycling

BattOpt:电动汽车电池回收的最优设施规划

Matthew Brun, Xu Andy Sun

专题命中 规划决策 :planning(title)

AI总结 本文提出多阶段随机优化模型,将EverBatt转化为决策工具,结合计量经济学预测生成场景,得出最优电池回收投资可降22%制造成本、26%环境影响,算法求解速度提升14倍以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28490 2026-08-31 cs.CR cs.AI 新提交 70%

LLM-Based Agents for Software and Systems Security: Approaches, Applications, and Assessment

基于大语言模型(LLM)的软件与系统安全智能体:方法、应用与评估

Jingjing Nie, Jiawei Guo, Krishna Meda, Haipeng Cai

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文通过系统综述2023-2026年的同行评审文献,梳理基于LLM的软件与系统安全智能体的技术方法、应用及评估,指出当前智能体权限未受限、行为不可审计的局限,并展望未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27969 2026-08-31 cs.AI 新提交 70%

openJiuwen: Beyond Static Harnesses for Long-Horizon Coding Agents

openJiuwen:超越静态框架的长程编码智能体

openJiuwen Team: Tao Yu, Xinyu Zhang, Qianqian Chen, Xiaoneng Xiang, Chia Kwangyang, Xingchen Huang, Ran Chen, Yangkai Ding, Zheng Wang, Yeo Boon Hong, Bingzheng Gan, Enrui Hu, Shuo Cheng, Deyang Li, Ruifeng Shi, Hongbo Wang, Qi Ye, Xuefeng Jin, Zhangchun Zhao

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 openJiuwen是一款开源智能体框架,针对长程编码智能体的结构可组合性与运行时适应性挑战设计,在SWE-bench Verified和Terminal-Bench 2.1上的准确率分别达82.6%、87.19%,性能优于官方排行榜顶尖方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23629 2026-08-31 cs.RO cs.AI 版本更新 70%

Macro-Operator Generation and Predicate Selection for TAMP Operator Learning

TAMP算子学习的宏算子生成与谓词选择

Can Emir Bora, Emre Ugur

机构 * Bogazici University(博加齐奇大学)

专题命中 规划决策 :planning(abstract,abstract_cn);分类 cs.AI

AI总结 本文针对TAMP算子学习的效率问题,提出自动生成宏算子并剪枝未被引用谓词的系统,在四个TAMP领域实现最高4.6倍规划加速,还解决了基线无法处理的长序列任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13396 2026-08-31 cs.AI cs.CL cs.SE 版本更新 69%

Set-shifting Behavioral Test for Harnessed Agents

用于受约束智能体的集合转移行为测试

Ye Ziwei

专题命中 规划决策 :agent(abstract,comments);分类 cs.AI、cs.CL、cs.SE

AI总结 研究当可靠工具在会话中悄然改变时语言模型智能体的工具选择,借鉴认知心理学的集合转移构建基准和评估框架,计算集合转移准确率,测试发现不同失败模式及集合框架对路由动态有影响。

Comments Accepted at COLM 2026 Workshop on Agent Behavior

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28409 2026-08-31 cs.RO 新提交 67%

Cooperative Risk-Aware Exploration in Heterogeneous Multi-Robot Systems Using Algorithmic Altruism

基于算法利他主义的异构多机器人系统中的协作风险感知探索

Brooks A. Butler, Jair Certório, João P. Hespanha, Magnus Egerstedt

机构 * School of Electrical and Computer Engineering at Oklahoma State University(俄克拉荷马州立大学电气与计算机工程学院) Instituto Tecnológico de Aeronáutica(航空技术研究所) University of California, Santa Barbara(加州大学圣巴巴拉分校) University of North Carolina, Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 该研究针对异构多机器人系统,提出基于算法利他主义的博弈论框架,通过社会纳什均衡调整效用实现风险合理分配,减少冗余探索并提升团队性能,经仿真与硬件实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27462 2026-08-31 cs.CL cs.AI 新提交 62%

Sledgehammer or Scalpel? A Fine-grained Adaptive Framework for Implicit Hate Speech

大锤还是手术刀?用于隐性仇恨言论检测的细粒度自适应框架

Han Wang, Yuhu Cheng, Xuesong Wang, Yi Zhu

机构 * School of Information and Control Engineering, China University of Mining and Technology(中国矿业大学信息与控制工程学院) Yangzhou University(扬州大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 针对隐性仇恨言论检测中现有方法推理流程单一、计算冗余的问题,提出FAID框架,先细粒度分类再自适应处理不同类型样本,在四个基准数据集上显著优于SOTA基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28179 2026-08-31 stat.ML cs.AI cs.IT cs.LG 新提交 62%

Conformal Risk-Averse Decision Making with Optimized Certainty Equivalent Risk Control

基于优化确定性等价风险控制的保角风险厌恶决策

Amirmohammad Farzaneh, Osvaldo Simeone

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对智能体在系统状态不确定时的风险厌恶决策问题,提出基于优化确定性等价(OCE)的风险控制策略,将已知分布下的最优策略简化为CVaR的预测集解,并通过数据驱动校准策略在无线波束成形场景中验证了其OCE风险高概率控制效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28399 2026-08-31 cs.AI q-fin.TR 新提交 57%

RetailAgent: Structured Adverse Timing in Self-Conditioned Multimodal LLM Trading Agents

RetailAgent:自条件多模态大语言模型交易智能体中的结构化不利时机

Yupeng Zhang, Liuyuan Jiang, Hongyi Huang, Bingheng Li, Lisha Chen

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Michigan State University(密歇根州立大学) University of Rochester(罗切斯特大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究提出RetailAgent框架,发现LLM交易智能体的决策存在跨维度的持续不利时机,动作与后续收益的一致性是该效应的关键驱动因素,同时自生成记忆会增强策略持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28270 2026-08-31 cs.RO cs.AI 新提交 57%

Spatial-Semantic Reasoning using Large Language Models for Efficient UAV Search Operations

基于大语言模型的空间语义推理用于高效无人机搜索任务

Marin Maletic, Marijana Peti, Tamara Petrovic, Stjepan Bogdan

机构 * University of Zagreb(萨格勒布大学) Faculty of Electrical Engineering and Computing(电气工程与计算机学院) LARICS (Laboratory for Robotics and Intelligent Control Systems)(拉里克机器人与智能控制系统实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 该研究提出基于大语言模型的无人机实时语义导航框架,结合多技术实现高效目标导航,经仿真与真实实验验证可缩短任务时长且保持高搜索准确率。

Comments 8 pages, preprint, Published in: 2025 European Conference on Mobile Robots (ECMR), DOI: https://doi.org/10.1109/ECMR65884.2025.11163229

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28142 2026-08-31 cs.LG 新提交 57%

Conditional Diffusion Models for Energy-Efficient Driving

面向节能驾驶的条件扩散模型

Hemanth Neelgund Ramesh, André Snoeck, Chyi-Fu Hong, Shijing Sun

机构 * University of Washington(华盛顿大学) Amazon Science(亚马逊科学) University of Cambridge(剑桥大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 该研究提出潜在条件扩散模型,基于1.2万次商用EV行程遥测数据生成电流轨迹,其性能优于直接条件注入,为不确定性感知的大规模车队规划奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27646 2026-08-31 cs.AI 新提交 57%

If Agents Were Angels, No Governance Would Be Necessary: Out-of-Band Policy Enforcement at a Trusted Tool Boundary

如果智能体是天使,就不需要治理:可信工具边界处带外策略执行

Marc Millstone, Tyler Akidau, Johannes Brüderl, Marat Pekker

机构 * Redpanda Data(红熊猫数据公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究提出带外策略执行(OBPE)作为智能体推理外的可信边界,通过原型实验将智能体追踪失败率大幅降低,提升了安全有用的任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27506 2026-08-31 cs.AI 新提交 57%

Thinking Costs Tokens: When More Structure is Worth the Price

思考成本即 token:更多结构何时值得付出代价

Thomas Nolasque, John Grey, Calista Pham, Ankit Vani

机构 * Royal Bank of Canada(加拿大皇家银行)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文研究语言模型推理结构的 token 预算阈值,在 FinQA、TAT-QA 任务上用 GPT-5.4 mini 验证,1500 token 后验证搜索架构性能优于单体模型,交叉点在 1000-1500 token 间。

Comments 8 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10696 2026-08-31 stat.ML cs.LG math.OC math.ST 版本更新 57%

Robust Assortment Optimization from Observational Data

从观测数据中稳健的 assortment 优化

Miao Lu, Yuxuan Han, Han Zhong, Zhengyuan Zhou, Jose Blanchet

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出了一种稳健的数据驱动 assortments 优化框架,通过考虑客户选择行为的潜在分布变化,实现了样本高效且稳健的 assortments 学习。

Comments 65 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16425 2026-08-31 cs.LG 版本更新 57%

Bayesian Experimental Design for Model Discrepancy Calibration: A Rivalry between Kullback--Leibler Divergence and Wasserstein Distance

贝叶斯实验设计用于模型偏差校准:KL散度与瓦瑟斯坦距离的较量

Huchen Yang, Xinghao Dong, Jin-Long Wu

机构 * Department of Mechanical Engineering, University of Wisconsin–Madison, Madison, WI 53706(机械工程系,威斯康星大学麦迪逊分校,麦迪逊,WI 53706)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文比较了KL散度与瓦瑟斯坦距离在贝叶斯实验设计中的应用,发现KL散度在无模型偏差时收敛更快,而瓦瑟斯坦距离在存在模型偏差时更稳健。

详情

展开后加载摘要…

URL PDF HTML 收藏