arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-19 至 2026-08-19 共收录 194 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 59 篇

2510.08713 2026-08-19 cs.AI cs.CV cs.RO 版本更新 79%

Towards Unified World Models for Visual Navigation via Memory-Augmented Planning and Foresight

通过记忆增强的规划和前瞻性构建视觉导航的统一世界模型

Yifei Dong, Fengyi Wu, Guangyu Chen, Lingdong Kong, Qiyu Hu, Yuxuan Zhou, Xu Zhu, Jingdong Sun, Jun-Yan He, Qi Dai, Alexander G. Hauptmann, Zhi-Qi Cheng

机构 * University of Washington(华盛顿大学) National University of Singapore(新加坡国立大学) Apple(苹果公司) Microsoft Research(微软研究院) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出UniWM,一种整合视觉前瞻性与规划的统一世界模型,通过记忆机制提升导航鲁棒性和泛化能力,在多个基准测试中显著提升导航成功率。

Comments Accepted to ECCV 2026. 22 pages, 12 figures, code: https://github.com/UWMILab/UniWM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17324 2026-08-19 cs.RO 新提交 78%

Reconfiguration-Complete Motion Primitives with Constructive Planning for Deformable Planar Modular Robots

面向可变形平面模块化机器人的带构造性规划的可重构完备运动原语

Jie Gu, Tingting Wang, Hongrun Gao, Yirun Sun, Zhihao Xia, Chunxu Tian, Dan Zhang

机构 * Institute of AI and Robotics, Academy for Engineering & Technology, Fudan University(复旦大学工程与技术学院人工智能与机器人研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对可变形平面模块化机器人重构规划的固定表示难题,提出带构造性规划的运动原语及前瞻选择器,证明N≥7的边连接非直线构型可相互重构,实验显示规划时间短于现有框架。

Comments Jie Gu and Tingting Wang contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17172 2026-08-19 cs.NE 新提交 78%

Automating Parent Selection Configuration in Genetic Programming with Agentic AI

用智能体人工智能实现遗传编程中父代选择配置的自动化

Jose Guadalupe Hernandez, Jui-Hsuan Chang, Anil Kumar Saini, Xi Li, Jason H. Moore

专题命中 规划决策 :agentic(title,abstract)

AI总结 该研究提出智能体AI框架,结合LLM推理与RAG实现遗传编程父代选择配置自动化,经符号回归测试,5 mini--AR配置表现优于锦标赛选择,为进化系统自动化设计提供了新路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17038 2026-08-19 cs.RO 新提交 78%

Terrain-Aware Local Path Planning with Global DEM Data Integration for Autonomous UGV Navigation

面向自主无人地面车辆(UGV)导航的融合全球数字高程模型(DEM)数据的地形感知局部路径规划

Devender Singh, Issah Nazif Suleiman, Paul Mitten, Glenn Cutler, Vinicius Prado da Fonseca, Matthew Hamilton

机构 * Memorial University of Newfoundland(纽芬兰纪念大学) Compusult Ltd.(康普萨尔特有限公司)

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究针对UGV户外导航中全局地图与实时传感器反馈脱节的问题,提出融合DEM与LiDAR的混合路径规划框架,经仿真验证可提升障碍物规避率、降低平均坡度,为可靠自主导航提供支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17121 2026-08-19 math.OC 新提交 78%

Bounds for multi-horizon stochastic optimization with application to power generation and transmission expansion planning

多阶段随机优化的界及其在发电与输电扩展规划中的应用

Giovanni Micheli, V Varagapriya, Francesca Maggioni, Guzin Bayraksan

专题命中 规划决策 :planning(title,abstract)

AI总结 本文针对多阶段随机优化问题最优值界的计算难题,提出基于场景树分解的界估计技术,通过不同分解与重组策略实现高效求解,在发电与输电扩展规划问题中验证了方法的效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17133 2026-08-19 astro-ph.IM astro-ph.EP 新提交 78%

The Roman Coronagraph Community Participation Program: Observation planning and data reduction for polarimetric mode

罗曼日冕仪社区参与计划:偏振模式的观测规划与数据处理

Ramya M Anche, Toshiyuki Mizuki, Justin Hom, Alexis Lau, Saanika Choudhary, Jaren N. Ashcraft, Clarissa Do O, Tsutsumi Nagai, Sophie Noiret, Eric Shen, Taichi Uyama, Chen Xie, Jingwen Zhang, Vanessa P. Bailey, Eric Cady, Jessica Gersh-Range, Julien H. Girard, Guillermo Gonzalez, John Livingston, Bertrand Mennesson, Maxwell A. Millar-Blanchaer, Julia Milton, Naoshi Murakami, Dmitry Savransky, Motohide Tamura, Jason J. Wang, Schuyler G. Wolff, Marie Ygouf

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究介绍罗曼日冕仪偏振模式的观测规划、模拟与数据处理流程,通过corgisim生成HD 172555的HLC模式偏振数据集,用corgidrp处理数据,为后续真实校准产品替换奠定基础。

Comments 11 pages, 8 figures, SPIE ATI 2026 (Copenhagen) conference proceeding

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15164 2026-08-19 math.OC 78%

A Stochastic Programming Model for Anticipative Planning of Integrated Electricity and Gas Systems with Bidirectional Energy Flows under Fuel and CO2 Price Uncertainty

Giovanni Micheli, Maria Teresa Vespucci, Alessia Cortazzi, Cinzia Puglisi

专题命中 规划决策 :planning(title,abstract)

Comments Under First Review at Energy Systems. Submission ID 68a28281-e8c0-4c20-beee-abb8acfde63b

Journal ref Energy Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15455 2026-08-19 math.NA cs.AI cs.NA math.AP 版本更新 77%

Solving nonconvex Hamilton--Jacobi--Isaacs equations with PINN-based policy iteration

用基于PINN的策略迭代求解非凸哈密顿-雅可比-艾萨克斯方程

Hee Jun Yang, Minjung Gim, Yeoneung Kim

机构 * National Institute for Mathematical Sciences(数学科学研究院) Department of Applied Artificial Intelligence(应用人工智能系)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出结合PINN与策略迭代的无网格框架,可求解高维非凸HJI方程,在两类数值实验中表现优于直接PINN求解器,具理论依据与应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31222 2026-08-19 cs.AI 版本更新 74%

Thinking Before Retrieving: Robust Zero-Shot Composed Image Retrieval via Strategic Planning and Self-Criticism

先思考再检索:通过战略规划与自我批评实现鲁棒的零样本组合图像检索

Gunho Jung, Jeong-Woo Park, Seon Bin Kim, Seong-Whan Lee

机构 * Department of Artificial Intelligence, Korea University(高丽大学人工智能系)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 提出PEC-CIR框架,通过规划器-执行器-批评家多阶段推理流水线构建查询,在零样本组合图像检索中减少生成错误,提升检索精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17184 2026-08-19 cs.CL 新提交 70%

AISA: AI Safety Assistant Framework for Continuous Improvement of Highway Construction

AISA:用于公路施工持续改进的AI安全助手框架

Mason Smetana, Trevor Neece, Lev Khazanovich

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.CL

AI总结 本研究提出AISA框架,基于LLM和文本嵌入模型实现公路施工事故分类、质量评分及相关数据检索,为未来智能体应用提供基础,在OIICS分类和事故检索等任务上取得优于随机水平的效果。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17164 2026-08-19 cs.LG 新提交 70%

SCENARIODIFF: A Scenario-level Guidance Framework for Multimodal Time Series Forecasting--Extended Version

SCENARIODIFF:面向多模态时间序列预测的场景级引导框架——扩展版

Tuan-Binh Tran, Dat Nguyen Cong, Duc-Trong Le, Thanh Trung Huynh, Tung Kieu

机构 * VinUniversity FPT Software AI Center, FPT Corporation(FPT软件AI中心,FPT集团) VNU University of Engineering and Technology(VNU工程技术大学) Aalborg University(奥尔堡大学)

专题命中 规划决策 :agent(abstract,abstract_cn);分类 cs.LG

AI总结 该研究针对现有多模态时间序列预测方法上下文影响难解释控制的问题,提出SCENARIODIFF分层框架,通过三类智能体生成结构化信号引导多模态扩散Transformer,锚点混合采样优化轨迹,在Time-MMD基准的事件驱动领域表现优异。

Comments 10 pages. An extended version of "SCENARIODIFF: A Scenario-level Guidance Framework for Multimodal Time Series Forecasting" accepted at ICDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17414 2026-08-19 cs.CV cs.PL 新提交 67%

REChart: Reasoning-Efficient Chart Editing with Large Reasoning Models

REChart:基于大型推理模型的推理高效图表编辑方法

Yuanbang Liu, Chenxi Ruan, Yihan Hou, Qiong Luo, Wei Zeng

机构 * HKUST(GZ)(香港科技大学(广州))

专题命中 规划决策 :workflow(abstract);agentic(abstract)

AI总结 REChart是两阶段训练框架,通过过程级监督提升图表编辑的保真度与推理效率,在两个基准上实现同规模开源模型最优性能,推理token用量降低79.0%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17146 2026-08-19 cs.RO 新提交 67%

PDDL-ART: Autonomous Symbolic Abstraction From Demonstration For Long-Horizon Robotic Manipulation Using Vision-Language Models

PDDL-ART:基于演示的自主符号抽象方法,用于使用视觉语言模型的长时程机器人操纵

Disha Kamale, Dmitry Berenson

机构 * University of Michigan(密歇根大学)

专题命中 规划决策 :tool-use(abstract);planning(abstract)

AI总结 PDDL-ART是一种基于VLM的框架,可自主从演示生成PDDL描述,经多阶段校正确保语义对齐,在发动机维护和家庭操纵任务上平均成功率达93.3%,优于基线规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17831 2026-08-19 astro-ph.IM 新提交 67%

Simulation tools for realistic high-order wavefront correction with the Roman Coronagraph

用于罗曼日冕仪真实高阶波前校正的模拟工具

A. Lau, A. J. Riggs, S. F. Redmond, E. Cady, J. Krist, I. Laginja, D. Sirbu, L. Delaye, R. Soummer, S. Noiret, J. C. Lambert, A. Bidot

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 本文介绍了可配置模拟框架corgihowfsc,用于罗曼日冕仪真实高阶波前校正研究,可保留参考工作流程并结合高保真图像模型,支持受控对比研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04728 2026-08-19 cs.CL cs.AI cs.LG 版本更新 67%

Turning Off-Policy Tokens On-Policy: A Plug-in Approach for Improving LLM Alignment

将离策略令牌转换为策略内令牌:一种改进大语言模型对齐的插件方法

Yu Li, Xiuyu Li, Mingyang Yi, Jiaxing Wang, Liangxu Zhang, Zhaolong Xing, Zhen Chen

机构 * Renmin University of China(中国人民大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究针对大语言模型强化学习后训练中离策略数据问题,提出选择性重要性采样(SIS),受拒绝采样启发,以离策略模型为提议分布进行令牌级拒绝测试,理论证明可减少梯度估计差距,实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17959 2026-08-19 cs.AI cs.LG 新提交 62%

Towards Zero-Shot Task Transfer with Neurosymbolic World Models

面向基于神经符号世界模型的零样本任务迁移

Isidoro Tamassia, Lennert De Smet, Giuseppe Marra

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出一种神经符号世界模型,通过解耦观测重构与奖励预测,实现无需额外环境交互的零样本任务迁移,其泛化能力优于纯神经方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17542 2026-08-19 cs.LG cs.AI 新提交 62%

No Gaussian Required: Contrastive Inverse Dynamics for JEPA World Models

无需高斯:用于JEPA世界模型的对比逆动力学

Jack Boylan, Chris Hokamp

机构 * Quantexa(昆泰克萨公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出AC-MTM,用对比逆动力学替代JEPA世界模型的高斯型抗坍塌机制,在多目标视觉任务上性能优于SIGReg,且训练稳定无额外复杂组件

Comments 17 pages, 5 figures. Code: https://github.com/jackboyla/action-contrastive-jepa

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07725 2026-08-19 cs.CL cs.AI 版本更新 62%

SOD: Step-wise On-policy Distillation for Small Language Model Agents

SOD:分步式在线蒸馏用于小型语言模型代理

Qiyong Zhong, Mao Zheng, Mingyang Song, Xin Lin, Jie Sun, Houcheng Jiang, Xiang Wang, Junfeng Fang

机构 * Zhejiang University(浙江大学) Large Language Model Department, Tencent(腾讯大语言模型部门) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 针对小型语言模型中工具集成推理的稳定性问题,提出SOD分步式在线蒸馏框架,通过动态调整蒸馏强度缓解教师信号误导,提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17718 2026-08-19 cs.AI 新提交 57%

Beyond Suspicious Steps: Ontological Trust in Long-Horizon Agents

超越可疑步骤:长周期智能体的本体论信任

An He, Yao Wang, Haibin Zhang

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出本体论信任概念,构建沿角色、目标、证据分解信任的在线监控器RGE,在跨领域轨迹语料库上,RGE的前缀配对漂移检测性能优于各类基线,漂移F1超93%且良性覆盖率达95.8%以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17596 2026-08-19 cs.RO cs.AI 新提交 57%

tinyDSM: A Framework for Skill Modeling and Development for Resource-Constrained Millirobots

tinyDSM:面向资源受限毫米级机器人的技能建模与开发框架

Markus D. Kobelrausch, Michael Miedler, Axel Jantsch

机构 * Institute of Computer Technology, TU Wien(维也纳工业大学计算机技术研究所)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本研究提出面向资源受限毫米级机器人的 tinyDSM 框架,结合内在动机与适应性评估,依托分层知识图谱等实现技能建模,使机器人15分钟内自主掌握从基础到复杂的运动技能。

Comments Manuscript submitted to IEEE Transactions on Cognitive and Developmental Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17341 2026-08-19 cs.AI 新提交 57%

LLM-Only PDDL Domain Repair with Open-Weight Models

仅使用大语言模型的PDDL领域修复:基于开放权重模型

Nader Karimi Bavandpour, Pascal Bercher

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文评估开放权重大语言模型仅用LLM方法修复PDDL模型错误的能力,发现其F1分数优于符号基线,但测试通过率仍不足,无法保证满足修复所需的测试约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17173 2026-08-19 stat.ML cs.LG math.ST stat.ME stat.TH 新提交 57%

Policy Optimization and Statistical Inference for Online Contextual Matrix Games

在线上下文矩阵博弈的策略优化与统计推断

Liner Xiang, Yixin Wang, Hengrui Cai

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 针对策略收益随情境变化的在线博弈问题,提出在线上下文矩阵博弈框架与OnGameLearn算法,经模拟和酒店定价应用验证,可有效平衡探索利用并具备统计保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16897 2026-08-19 physics.soc-ph cs.AI cs.MA 新提交 57%

CityReal: Human-Aligned Urban Behavior and City Dynamics Simulation with Large-Scale LLM Agents

CityReal:基于大规模大语言模型智能体的人类对齐城市行为与城市动态模拟

Nicolas Bougie, Xiaotong Ye, Narimasa Watanabe

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 CityReal是人类对齐城市模拟的模块化框架,将智能体建模为意图驱动的决策者,通过文本适配器提升人群行为对齐度,可扩展至数万个智能体,为城市模拟与预测提供可扩展测试平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07994 2026-08-19 cs.AI cs.IR 版本更新 57%

VDGR-RAG: Vectors, Directories, Graphs, and Reflection Are All You Need for Unified Reasoning over Hierarchical Enterprise Knowledge

VDGR-RAG:向量、目录、图与反思——统一分层企业知识推理所需的一切

Wenqi Chen, Haofei Yang, Rui Yang, Fangming Li

机构 * Huawei Technologies(华为技术有限公司)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 针对现有RAG方法在企业知识问答中存在的局限,提出整合向量、目录、图与反思的VDGR-RAG智能体GraphRAG系统,经实验其在召回率和准确率上均优于多种RAG基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01035 2026-08-19 cs.RO cs.AI cs.CV 版本更新 57%

WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA

WAM-Diff2:面向高效自动驾驶视觉-语言-动作(VLA)的分层自回归到扩散蒸馏

Zhihao Zhu, Hanlin Shang, Mingwang Xu, Feipeng Cai, Zhuolin He, Yaoyi Li, Jianhua Han, Hang Xu, Siyu Zhu

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 WAM-Diff2通过三阶段分层蒸馏策略,将预训练自回归VLA模型转化为高效扩散模型,缓解暴露偏差、实现与基线相当性能,解码速度提升2.8倍,结合系统级优化后达15.1倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21802 2026-08-19 cs.CL 版本更新 57%

When to Plan, When to Polish: Noise Level as a Granularity Axis for Diffusion Language Models

何时规划,何时精炼:噪声水平作为扩散语言模型的粒度轴

Peihong Li, Yuanjie Shi, Yan Yan

机构 * Washington State University(华盛顿州立大学)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 提出噪声依赖粒度控制(NDGC)方法,通过噪声水平调节训练和推理的粒度,实现从粗到细的去噪,无需显式规划器或层次结构,提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06474 2026-08-19 cs.CL 版本更新 57%

DataSTORM: Deep Research on Large-Scale Databases using Exploratory Data Analysis and Data Storytelling

DataSTORM:利用探索性数据分析和数据叙事进行大规模数据库的深度研究

Shicheng Liu, Yucheng Jiang, Sajid Farook, Camila Nicollier Sanchez, David Fernando Castro Pena, Monica S. Lam

机构 * Computer Science Department, Stanford University(斯坦福大学计算机科学系)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 DataSTORM通过探索性数据分析和数据叙事,实现对大规模结构化数据库的深度研究,提出基于论点的分析流程,并在InsightBench上取得新的最佳成绩。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23738 2026-08-19 cs.LG 57%

BXRL: Behavior-Explainable Reinforcement Learning

BXRL: 可解释的行为强化学习

Ram Rachum, Yotam Amitai, Yonatan Nakar, Reuth Mirsky, Cameron Allen

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出BXRL,将行为作为首要对象,定义行为度量函数并探讨如何通过对比行为解释策略。

Journal ref Proceedings of the Workshop on Explainable Artificial Intelligence (XAI) at IJCAI-ECAI 2026, Bremen, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08748 2026-08-19 cs.RO cs.AI 版本更新 57%

Visual Prompting for Robotic Manipulation with Annotation-Guided Pick-and-Place Using ACT

面向机器人操作的视觉提示:采用带标注引导的拾取与放置方法,基于ACT算法

Muhammad A. Muttaqien, Tomohiro Motoda, Ryo Hanai, Yukiyasu Domae

机构 * Embodied AI Research Team(具身人工智能研究团队) National Institute of AIST(国家信息与系统技术研究所)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对便利店机器人拾取放置任务的挑战,提出带标注引导视觉提示的感知-行动流水线,采用ACT算法实现自适应操作,提升了零售环境下的抓取精度与适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18035 2026-08-19 cs.CV 新提交 50%

Plug-and-Play Traffic Element Awareness for End-to-End Autonomous Driving

用于端到端自动驾驶的即插即用交通元素感知

Zongzheng Zhang, Jijun Wang, Saining Zhang, Shuo Wang, Yiru Wang, Hai Yang, Yang Chen, Yuwen Heng, Hao Sun, Anqing Jiang, Hao Zhao

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR)) Bosch Corporate Research(博世企业研究中心)

专题命中 规划决策 :planning(abstract)

AI总结 该研究首次系统探究端到端自动驾驶的交通元素感知,通过补充标注构建统一基础设施,以即插即用方式集成信号,在多范式多数据集上提升性能,在NAVSIM-v2上达到新SOTA。

Comments Accepted by ECCV 2026; Project Page: https://zzongzheng0918.github.io/TE-Aware-E2E-AD/

详情

展开后加载摘要…

URL PDF HTML 收藏