arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-11-26 至 2025-11-26 共收录 30 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 30 篇

2511.20468 2025-11-26 cs.AI 88%

DRAFT-RL: Multi-Agent Chain-of-Draft Reasoning for Reinforcement Learning-Enhanced LLMs

DRAFT-RL: 多智能体链式草稿推理用于强化学习增强的大型语言模型

Yuanhao Li, Mingshan Liu, Hongbo Wang, Yiding Zhang, Yifei Ma, Wei Tan

机构 * BUPT(北京邮电大学) HKUST(GZ)(香港科技大学(广州)) University of Bristol(布里斯托大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 DRAFT-RL通过多智能体链式草稿推理提升强化学习增强的LLM在复杂推理任务中的准确性和收敛速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02630 2025-11-26 cs.CR cs.AI 85%

AI Agents Under Threat: A Survey of Key Security Challenges and Future Pathways

AI代理面临威胁:关键安全挑战与未来路径的综述

Zehang Deng, Yongjian Guo, Changzhou Han, Wanlun Ma, Junwu Xiong, Sheng Wen, Yang Xiang

机构 * Swinburne University of Technology(斯威本理工大学)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文综述了AI代理面临的关键安全挑战,分析了四个关键知识缺口,并探讨了未来安全防护的发展路径。

Comments Submitted to ACM Computing Survey

Journal ref ACM Computing Surveys, Vol. 57, No. 7, Article 182 (July 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19726 2025-11-26 cs.MA cs.AI cs.LG cs.SY eess.SY 85%

An Adaptive, Data-Integrated Agent-Based Modeling Framework for Explainable and Contestable Policy Design

一种适应性强且数据集成的基于代理的建模框架,用于可解释且可争议的政策设计

Roberto Garrone

机构 * Faculty of Pure and Applied Sciences Open University of Cyprus(塞浦路斯开放大学纯科学与应用科学学院)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract,comments);分类 cs.AI、cs.LG

AI总结 本文提出了一种适应性强且数据集成的基于代理的建模框架,用于可解释且可争议的政策设计,通过整合动态制度、信息论诊断、结构因果模型等方法,实现对多代理系统动态行为的系统分析与比较。

Comments 27 pages, 2 case studies (emissions and smart grids). Preprint prepared during the author's PhD research at the Open University of Cyprus and the University of Milano-Bicocca. Introduces a unified framework for adaptive multi-agent learning with information-theoretic, causal, and clustering diagnostics

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19773 2025-11-26 cs.AI cs.CL cs.CV 84%

Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs

在视觉语言模型中实现工具集成推理的规模化代理强化学习

Meng Lu, Ran Xu, Yi Fang, Wenxuan Zhang, Yue Yu, Gaurav Srivastava, Yuchen Zhuang, Mohamed Elhoseiny, Charles Fleming, Carl Yang, Zhengzhong Tu, Yang Xie, Guanghua Xiao, Hanrui Wang, Di Jin, Wenqi Shi, Xuan Wang

机构 * Virginia Tech(弗吉尼亚理工大学) Emory University(埃默里大学) KAUST(阿联酋卡塔尔大学) Georgia Tech(佐治亚理工学院) Cisco(思科系统) TAMU(德克萨斯大学奥斯汀分校) UT Southwestern Medical Center(德克萨斯西南医学中心) Eigen AI

专题命中 规划决策 :agentic(title,abstract);tool-use(abstract);分类 cs.AI、cs.CL

AI总结 本文提出VISTA-Gym,通过多轮轨迹采样和端到端强化学习,提升视觉语言模型的工具集成推理能力,在多个基准测试中取得显著优势。

Comments 17 pages, 9 figures, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19654 2025-11-26 cs.CV cs.AI cs.CL cs.RO 81%

From Forecasting to Planning: Policy World Model for Collaborative State-Action Prediction

从预测到规划:用于协作状态-动作预测的策略世界模型

Zhida Zhao, Talas Fu, Yifan Wang, Lijun Wang, Huchuan Lu

机构 * Dalian University of Technology(大连理工大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出策略世界模型(PWM),通过整合世界建模与轨迹规划,并利用无动作未来状态预测提升规划性能,实现更可靠的自主驾驶决策。

Comments Accepted by NuerIPS 2025 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16274 2025-11-26 cs.LG cs.AI cs.DC cs.PF 81%

STAlloc: Enhancing Memory Efficiency in Large-Scale Model Training with Spatio-Temporal Planning

STAlloc:通过时空规划提升大规模模型训练的内存效率

Zixiao Huang, Junhao Hu, Hao Lin, Chunyang Zhu, Yueran Tang, Quanlu Zhang, Zhen Guo, Zhenhua Li, Shengen Yan, Zhenhua Zhu, Guohao Dai, Yu Wang

机构 * Tsinghua University(清华大学) Infinigence AI Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 STAlloc通过结合离线规划与在线分配,有效减少大规模模型训练中的内存碎片化,提升训练效率和吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20283 2025-11-26 econ.GN cs.LG q-fin.EC 79%

Solving Heterogeneous Agent Models with Physics-informed Neural Networks

利用物理指导神经网络求解异质主体模型

Marta Grzeskiewicz

机构 * University of Cambridge(剑桥大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.LG

AI总结 本文提出ABH-PINN求解器,利用物理指导神经网络解决异质主体模型中的连续时间动态问题,实现更高效和准确的计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19644 2025-11-26 cs.CR cs.AI 79%

IRSDA: An Agent-Orchestrated Framework for Enterprise Intrusion Response

IRSDA:面向企业入侵响应的智能体协调框架

Damodar Panigrahi, Raj Patel, Shaswata Mitra, Sudip Mittal, Shahram Rahimi

机构 * Mississippi State University(密苏里州立大学) The University of Alabama(阿拉巴马大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 IRSDA是一种基于智能体的入侵响应框架,结合自适应计算与知识引导循环,实现自动化防御和政策合规性,提升企业网络安全响应效率与可解释性。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20394 2025-11-26 cs.RO 78%

Improved adaptive wind driven optimization algorithm for real-time path planning

改进的自适应风驱动优化算法用于实时路径规划

Shiqian Liu, Azlan Mohd Zain, Le-le Mao

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出改进的自适应风驱动优化算法,用于提升动态环境中的实时路径规划性能,通过多层级指导机制提高适应性和鲁棒性,实验表明其在路径优化和轨迹平滑方面优于现有方法。

Comments 23 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20156 2025-11-26 cs.CV cs.RO 78%

Map-World: Masked Action planning and Path-Integral World Model for Autonomous Driving

Map-World: 遮蔽动作规划与路径积分世界模型用于自动驾驶

Bin Hu, Zijian Lu, Haicheng Liao, Chengran Yuan, Bin Rao, Yongkang Li, Guofa Li, Zhiyong Cui, Cheng-zhong Xu, Zhenning Li

机构 * University of Macau(澳门大学) National University of Singapore(新加坡国立大学) Purdue University(普渡大学) Chongqing University(重庆大学) Beihang University(北航大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 MAP-World通过结合遮蔽动作规划和路径加权世界模型,实现了高效的多模式自动驾驶规划,无需强化学习即可达到最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19653 2025-11-26 cs.RO 78%

Flow-Based Path Planning for Multiple Homogenous UAVs for Outdoor Formation-Flying

基于流的多架同构无人机户外编队飞行路径规划

Mahmud Suhaimi Ibrahim, Shantanu Rahman, Muhammad Samin Hasan, Minhaj Uddin Ahmad, Abdullah Abrar

机构 * Chief Research Officer(首席研究员)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出基于流网络的多无人机无碰撞路径规划方法,通过模拟和实验验证了其在户外编队飞行中的有效性。

Comments 9 pages, 15 figures, conference

Journal ref 2022 7th International Conference on Mechanical Engineering and Robotics Research (ICMERR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20138 2025-11-26 cs.AI cs.DM cs.LG math.CO 73%

From data to concepts via wiring diagrams

通过连线图从数据到概念

Jason Lo, Mohammadnima Jafari

机构 * Department of Mathematics, California State University, Northridge, USA(数学系,加州州立大学北岭分校) Department of Computer Science, California State University, Northridge, USA(计算机科学系,加州州立大学北岭分校)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 本文通过准骨架连线图方法从序列数据中提取概念,并展示了其在自主代理游戏策略识别中的应用。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18428 2025-11-26 cs.AI cs.CL 73%

Multi-Modal Data Exploration via Language Agents

通过语言代理进行多模态数据探索

Farhad Nooralahzadeh, Yi Zhang, Jonathan Furst, Kurt Stockinger

机构 * Zurich University of Applied Sciences(瑞士应用科学大学)

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 本文提出M$^2$EX系统,通过语言代理实现多模态数据探索,优于现有系统在准确性和性能指标上

Comments Accepted to the IJCNLP AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19496 2025-11-26 cs.LG cs.AI 73%

Xmodel-2.5: 1.3B Data-Efficient Reasoning SLM

Xmodel-2.5: 1.3B数据高效推理SLM

Yang Liu, Xiaolong Zhong, Ling Jiang

机构 * Xiaoduo AI Lab(小多人工智能实验室)

专题命中 规划决策 :agent(abstract);tool-use(abstract);分类 cs.AI、cs.LG

AI总结 Xmodel-2.5通过最大更新参数化和混合精度训练,实现了1.3B参数高效推理模型,提升下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20540 2025-11-26 cs.LO cs.AI cs.GT cs.MA 70%

Proceedings Twentieth Conference on Theoretical Aspects of Rationality and Knowledge

第二十届理性与知识理论研讨会会议纪要

Adam Bjorndahl

机构 * Edited by: Adam Bjorndahl(编辑:Adam Bjorndahl)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 TARK 2025会议收录了关于理性与知识理论的最新研究成果,涵盖知识、信念、博弈论等多个领域。

Journal ref EPTCS 437, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19952 2025-11-26 cs.LG 70%

Hierarchical Spatio-Temporal Attention Network with Adaptive Risk-Aware Decision for Forward Collision Warning in Complex Scenarios

具有自适应风险感知决策的分层时空注意力网络用于复杂场景的前方碰撞预警

Haoran Hu, Junren Shi, Shuo Jiang, Kun Cheng, Xia Yang, Changhao Piao

机构 * organization= School of Automation \& School of Industrial Internet, Chongqing University of Posts organization= Platform Technology Development Department, AVATR Technology Co. LTD. , city= Chongqing , postcode= 400000 , country= China organization= School of Vehicle Mobility, Tsinghua University , city= Beijing , postcode= 100084 , country= China

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出一种结合分层时空注意力网络和动态风险阈值调整算法的前方碰撞预警框架,通过高效模型和自适应机制提升复杂场景下的预警精度与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19885 2025-11-26 cs.MA cs.LG 70%

Complex Instruction Following with Diverse Style Policies in Football Games

复杂足球游戏中多样化风格政策的复杂指令遵循

Chenglu Sun, Shuo Shen, Haonan Hu, Wei Zhou, Chen Chen

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出LCDSP方法,通过多样化风格训练和风格解释器,在复杂足球游戏中实现对高级指令的理解与执行,展示其在复杂现实应用中的潜力。

Comments 21 pages, 13 figures, accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05130 2025-11-26 cs.AI 70%

Scalable and Accurate Graph Reasoning with LLM-based Multi-Agents

基于大语言模型的多智能体图推理方法

Yuwei Hu, Runlin Lei, Xinyi Huang, Zhewei Wei, Yongchao Liu

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 基于大语言模型的多智能体图推理方法,通过分解图问题为节点中心任务,提升图推理的准确性和扩展性。

Comments Accepted by AAAI 2026 Workshop WMAC

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20234 2025-11-26 cs.LG cs.AI 62%

Leveraging weights signals -- Predicting and improving generalizability in reinforcement learning

利用权重信号--在强化学习中预测和提升泛化能力

Olivier Moulin, Vincent Francois-lavet, Paul Elbers, Mark Hoogendoorn

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Vrije Universiteit Medical Center Amsterdam(阿姆斯特丹自由大学医学中心)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过分析神经网络内部权重信号,改进PPO算法以提升强化学习代理的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05718 2025-11-26 cs.AI cs.GR cs.LG cs.RO 62%

RLZero: Direct Policy Inference from Language Without In-Domain Supervision

RLZero: 从语言直接推断策略而不使用领域内监督

Harshit Sikchi, Siddhant Agarwal, Pranaya Jajoo, Samyak Parajuli, Caleb Chuck, Max Rudolph, Peter Stone, Amy Zhang, Scott Niekum

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 RLZero通过预训练的RL代理,无需领域内监督,直接从自然语言指令生成行为策略。

Comments NeurIPS 2025, 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20284 2025-11-26 cs.CR cs.AI 57%

Can LLMs Make (Personalized) Access Control Decisions?

LLMs能否做出(个性化)访问控制决策?

Friederike Groschupp, Daniele Lain, Aritra Dhar, Lara Magdalena Lazier, Srdjan Čapkun

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) Computing Systems Lab, Huawei Technologies Switzerland AG(华为技术瑞士有限公司计算系统实验室)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文研究LLMs在访问控制决策中的应用,发现其能有效反映用户偏好,但个性化可能影响安全实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10037 2025-11-26 cs.AI 57%

Beyond ReAct: A Planner-Centric Framework for Complex Tool-Augmented LLM Reasoning

超越ReAct:一种以规划为中心的框架,用于复杂工具增强的大语言模型推理

Xiaolong Wei, Yuehu Dong, Xingliang Wang, Xingyu Zhang, Zhejun Zhao, Dongdong Shen, Long Xia, Dawei Yin

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种以规划为中心的框架,通过全局DAG规划和两阶段训练方法,提升复杂工具增强LLM的推理能力。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20508 2025-11-26 eess.SY cs.SY 50%

Causal Feature Selection for Weather-Driven Residential Load Forecasting

因果特征选择用于天气驱动的住宅负荷预测

Elise Zhang, François Mirallès, Stéphane Dellacherie, Di Wu, Benoit Boulet

专题命中 规划决策 :planning(abstract)

AI总结 本文通过因果特征选择方法,提升天气驱动住宅负荷预测的简洁性和鲁棒性,利用实际数据验证其有效性。

Comments 5 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20050 2025-11-26 cs.RO 50%

Active3D: Active High-Fidelity 3D Reconstruction via Hierarchical Uncertainty Quantification

Active3D: 通过分层不确定性量化实现主动高保真3D重建

Yan Li, Yingzhao Li, Gim Hee Lee

专题命中 规划决策 :planning(abstract)

AI总结 Active3D通过分层不确定性量化实现高保真3D重建,结合隐式-显式表示和不确定性驱动的探索策略,提升重建精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19709 2025-11-26 cs.RO 50%

Whole-Body Inverse Dynamics MPC for Legged Loco-Manipulation

全身体态逆动力学MPC用于腿部机动操作

Lukas Molnar, Jin Cheng, Gabriele Fadini, Dongho Kang, Fatemeh Zargarbashi, Stelian Coros

机构 * Department of Mechanical and Process Engineering, ETH Zurich(机械与过程工程系,苏黎世联邦理工学院) Computational Robotics Lab, Department of Computer Science, ETH Zurich(计算机器人实验室,计算机科学系,苏黎世联邦理工学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种全身MPC框架,通过逆动力学优化实现腿部机动操作中的统一运动与力规划,实现实时80Hz性能,完成重物拉动、推箱子和擦拭白板等任务。

Comments 9 pages, 6 figures, to be published in IEEE Robotics and Automation Letters (Special Issue: Advancements in MPC and Learning Algorithms for Legged Robots)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16969 2025-11-26 cs.SI 50%

A Multi-echelon Demand-driven Supply Chain Model for Proactive Optimal Control of Epidemics: Insights from a COVID-19 Study

面向传染病主动最优控制的多层级需求驱动供应链模型:基于新冠研究的见解

Kimiya Jozani, Nihal A. Sageer, Hode Eldardiry, Sait Tunc, Esra Buyuktahtakin Toy

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种多层级需求驱动的供应链模型,结合流行病动态和疫苗物流,通过优化和公平性提升在新冠研究中有效减少感染和死亡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13733 2025-11-26 cs.RO 50%

FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph

基于分层多模态场景图的视觉语言导航:快速与慢速推理

Xiaolin Zhou, Tingyang Xiao, Liu Liu, Yucheng Wang, Maiyue Chen, Xinrui Meng, Xinjie Wang, Wei Feng, Wei Sui, Zhizhong Su

机构 * Horizon Robotics D-Robotics Robotics

专题命中 规划决策 :planning(abstract)

AI总结 FSR-VLN通过分层多模态场景图与快速-慢速推理机制,提升视觉语言导航的效率与准确性,实现低延迟高成功率的导航性能。

Comments Demo video are available at https://horizonrobotics.github.io/robot_lab/fsr-vln/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13755 2025-11-26 astro-ph.CO stat.ML 50%

How many simulations do we need for simulation-based inference in cosmology?

基于宇宙学的模拟推断中需要多少次模拟?

Anirban Bairagi, Benjamin Wandelt, Francisco Villaescusa-Navarro

专题命中 规划决策 :planning(abstract)

AI总结 研究发现现有模拟数据不足以训练神经网络提取最优信息,提出经验性神经缩放定律并验证方法,为宇宙学参数推断提供新方向。

Journal ref A&A 703, A301 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01833 2025-11-26 stat.ME 50%

Credible Distributions of Overall Ranking of Entities

实体总体排名的可信分布

Snigdhansu Chatterjee, Gauri Sankar Datta, Yiren Hou, Abhyuday Mandal

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种新的贝叶斯方法,用于解决小区域统计中排名估计的不确定性问题,通过参数空间划分和概率质量函数生成,提高了排名推断的准确性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19507 2025-11-26 physics.soc-ph 50%

Causal spillover effects of electric vehicle charging station placement on local businesses: a staggered adoption study

电动汽车充电站布局对本地商业的因果溢出效应:一项分阶段采用研究

M. Mavin De Silva, Callie Clark, Tadachika Nakayama, Takahiro Yabe

专题命中 规划决策 :planning(abstract)

AI总结 本文通过分阶段采用研究,探讨电动汽车充电站布局对本地商业的因果溢出效应,发现其对不同城市环境中的经济影响存在差异。

详情

展开后加载摘要…

URL PDF HTML 收藏