arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-23 至 2025-12-23 共收录 66 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 66 篇

2512.17187 2025-12-23 cs.MA cs.GT 88%

MAPPO-LCR: Multi-Agent Proximal Policy Optimization with Local Cooperation Reward in Spatial Public Goods Games

MAPPO-LCR:在空间公共物品游戏中采用局部合作奖励的多智能体近端策略优化

Zhaoqilin Yang, Axin Xiang, Kedi Yang, Tianjun Liu, Youliang Tian

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract)

AI总结 MAPPO-LCR通过引入局部合作奖励,解决了空间公共物品游戏中个体收益耦合问题,提升了多智能体近端策略优化的群体协作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18604 2025-12-23 cs.LG 85%

Trajectory Planning for UAV-Based Smart Farming Using Imitation-Based Triple Deep Q-Learning

基于模仿学习的三重深度Q学习用于无人机智能农业的轨迹规划

Wencan Mao, Quanxi Zhou, Tomas Couso Coddou, Manabu Tsukada, Yunling Liu, Yusheng Ji

机构 * National Institute of Informatics(国立信息研究所) The University of Tokyo(东京大学) Pontificia Universidad Católica de Chile(智利天主教大学) China Agricultural University(中国农业大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出基于模仿学习的三重深度Q学习算法,用于提升无人机在智能农业中的轨迹规划性能,实验显示其在杂草识别和数据收集方面均优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18265 2025-12-23 cs.AI 83%

Intelligent Human-Machine Partnership for Manufacturing: Enhancing Warehouse Planning through Simulation-Driven Knowledge Graphs and LLM Collaboration

智能人机协作制造:通过仿真驱动的知识图谱与大语言模型协作提升仓库规划

Himabindu Thogaru, Saisubramaniam Gopalakrishnan, Zishan Ahmad, Anirudh Deodhar

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 本研究提出通过仿真驱动的知识图谱与大语言模型协作,提升制造业仓库规划的智能化水平,实现人机高效协作以优化运营决策。

Comments 13 pages, 2 figures, accepted for oral presentation at AAAI Human Machine Collaboration Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18202 2025-12-23 cs.AI 83%

Sophia: A Persistent Agent Framework of Artificial Life

Sophia:人工智能生命的一种持久代理框架

Mingyang Sun, Feng Hong, Weinan Zhang

机构 * Westlake University(西湖大学) Shanghai Innovation Institute(上海创新研究院) Project Cuddlepark Team(Project Cuddlepark团队) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 Sophia通过引入系统3,实现持久代理框架,使AI代理具备自我改进、身份连续性和透明行为解释能力,推动人工生命的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17629 2025-12-23 cs.LG math.OC 83%

Planning and Learning in Average Risk-aware MDPs

在平均风险感知马尔可夫决策过程中的规划与学习

Weikai Wang, Erick Delage

机构 * GERAD & HEC Montréal(GERAD与蒙特利尔HEC学院) Mila - Québec AI Institute(魁北克AI研究所)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG

AI总结 本文提出了一种相对价值迭代算法和两种基于多级蒙特卡洛方法的Q学习算法,用于在平均风险感知马尔可夫决策过程中实现最优策略的收敛与识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18440 2025-12-23 cs.CL cs.AI 81%

An Agentic AI Framework for Training General Practitioner Student Skills

一种用于培训全科医学生技能的代理AI框架

Victor De Marez, Jens Van Nooten, Luna De Bruyne, Walter Daelemans

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种代理AI框架,用于培训全科医学生技能,通过统一病例生成、角色驱动对话和基于标准的评估,提升医学教育中虚拟模拟患者的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19564 2025-12-23 cs.RO cs.AI 79%

Results of the 2024 CommonRoad Motion Planning Competition for Autonomous Vehicles

2024年自动驾驶车辆运动规划竞赛结果

Yanliang Huang, Xia Yan, Peiran Yin, Zhenduo Zhang, Zeyan Shao, Youran Wang, Haoliang Huang, Matthias Althoff

机构 * Technical University of Munich(慕尼黑技术大学) RWTH Aachen(亚琛工业大学) Harbin Institute of Technology(哈尔滨工业大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 2024年CommonRoad运动规划竞赛评估了自动驾驶车辆在高速公路和城市环境中的运动规划算法性能,通过四个维度比较了多种高性能规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18966 2025-12-23 cs.SE 79%

Scrum Sprint Planning: LLM-based and algorithmic solutions

Scrum迭代规划:基于大语言模型和算法的解决方案

Yuwon Yoon, Kevin Iwan, Madeleine Zwart, Xiaohan Qin, Hina Lee, Maria Spichkova

专题命中 规划决策 :planning(title,abstract);分类 cs.SE

AI总结 本文探讨了大语言模型在Scrum迭代规划中的应用,通过实验发现其结果质量不满足直接使用需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18703 2025-12-23 cs.RO cs.AI 79%

CauTraj: A Causal-Knowledge-Guided Framework for Lane-Changing Trajectory Planning of Autonomous Vehicles

CauTraj:一种融合因果知识的车道变换轨迹规划框架

Cailin Lei, Haiyang Wu, Yuxiong Ji, Xiaoyu Cai, Yuchuan Du

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 CauTraj通过整合因果知识提升自动驾驶车辆车道变换轨迹规划的精度与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18211 2025-12-23 cs.RO cs.AI 79%

LLaViDA: A Large Language Vision Driving Assistant for Explicit Reasoning and Enhanced Trajectory Planning

LLaViDA: 一种用于显式推理和增强轨迹规划的大型语言视觉驾驶助手

Yudong Liu, Spencer Hallyburton, Jiwoo Kim, Yueqian Lin, Yiming Li, Qinsi Wang, Hui Ye, Jingwei Sun, Miroslav Pajic, Yiran Chen, Hai Li

机构 * Duke University(杜克大学) Georgia State University(佐治亚州立大学) University of Florida(佛罗里达大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 LLaViDA通过视觉-语言模型实现显式推理和轨迹规划,提升自动驾驶的轨迹规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00251 2025-12-23 cs.AI 79%

Instruction-Level Weight Shaping: A Framework for Self-Improving AI Agents

指令级权重塑造:一种自我改进的AI代理框架

Rimom Costa

机构 * Adobe Commerce Cloud Support Engineering - EMEA Division(Adobe 商业云支持工程 - EMEA部门)

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI

AI总结 指令级权重塑造通过外部可审计伪参数提升AI代理的自我改进能力,实现低延迟部署和减少幻觉,适用于动态领域。

Comments 12 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19133 2025-12-23 cs.RO cs.CV 78%

WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving

WorldRFT: 通过强化微调的潜在世界模型进行自动驾驶的规划

Pengxuan Yang, Ben Lu, Zhongpu Xia, Chao Han, Yinfeng Gao, Teng Zhang, Kun Zhan, XianPeng Lang, Yupeng Zheng, Qichao Zhang

专题命中 规划决策 :planning(title,abstract)

AI总结 WorldRFT通过强化学习微调提升自动驾驶规划性能,实现安全性和效率的双重优化。

Comments AAAI 2026, first version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19029 2025-12-23 econ.GN q-fin.EC 78%

Backward Growth Accounting: An Economic Tool for Strategic Planning of Business Growth

反向增长会计:一种用于企业增长战略规划的经济工具

Ali Zeytoon-Nejad

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出反向增长会计方法,用于企业增长的结构化规划,以提升经济逻辑和数学工具的应用,识别增长驱动因素并评估增长过程中的不足。

Journal ref Managerial and Decision Economics, 2025; 0:1-22

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18863 2025-12-23 physics.med-ph 78%

A physics-informed, plug-and-play dose engine for gradient-based radiotherapy treatment planning

一种基于物理的、即插即用的剂量引擎用于基于梯度的放疗治疗计划

Attila Simkó, Matthias Kronsteiner, Simon Glatzer, Minh Vu, Josef A. Lundman, Joakim Jonsson, Jörgen Olofsson, Kristina Sandgren, Wolfgang Lechner, Dietmar Georg, Tommy Löfstedt, Tufve Nyholm, Anders Garpebring, Gerd Heilemann

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出PyDoseRT,一种基于物理的、GPU加速的剂量引擎,用于基于梯度的放疗治疗计划优化,无需依赖商业TPS,提高临床有效性与研究灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12220 2025-12-23 cs.RO 78%

Hybrid Dynamics Modeling and Trajectory Planning for a Cable-Trailer System with a Quadruped Robot

混合动力学建模与电缆-拖车系统四足机器人的轨迹规划

Wentao Zhang, Shaohang Xu, Gewei Zuo, Bolin Li, Jingbo Wang, Lijun Zhu

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(人工智能与自动化学院,华中科技大学) Department of Data Science, City University of Hong Kong(数据科学系,城市大学) Embodied AI Center of Shanghai AI Lab(上海人工智能实验室具身智能中心)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种混合动力学模型和搜索算法,用于四足机器人与电缆-拖车系统的轨迹规划,通过几何多边形碰撞避免约束实现安全高效的运动控制。

Comments 8 pages, 8 figures, Accept by RA-L 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05769 2025-12-23 cs.CV 75%

Digital Twin Buildings: 3D Modeling, GIS Integration, and Visual Descriptions Using Gaussian Splatting, ChatGPT/Deepseek, and Google Maps Platform

数字孪生建筑:利用高斯点扩散、ChatGPT/DeepSeek和Google地图平台进行3D建模、GIS集成和视觉描述

Kyle Gao, Dening Lu, Liangzhi Li, Nan Chen, Hongjie He, Linlin Xu, Jonathan Li

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于高斯点扩散、ChatGPT和Google地图平台的数字孪生建筑框架,用于实现建筑的3D建模、GIS集成和视觉描述。

Comments -Fixed minor typo

Journal ref IEEE Geoscience and Remote Sensing Letters 22 (2025) 6013405

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18619 2025-12-23 cs.AI cs.RO 74%

ChronoDreamer: Action-Conditioned World Model as an Online Simulator for Robotic Planning

ChronoDreamer:基于动作的动态世界模型作为机器人规划的在线模拟器

Zhenhao Zhou, Dan Negrut

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 ChronoDreamer通过时空变换器和视觉-语言模型,实现基于动作的动态世界模型,用于机器人规划中的安全动作预测与碰撞检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18309 2025-12-23 cs.LG cs.AI 73%

Embedded Safety-Aligned Intelligence via Differentiable Internal Alignment Embeddings

通过可微内部对齐嵌入实现嵌入式安全对齐智能

Harsh Rathva, Ojas Srivastava, Pruthwik Mishra

机构 * Sardar Vallabhbhai National Institute of Technology (SVNIT)(萨达尔·瓦拉布尔·尼尔达理工学院)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出嵌入式安全对齐智能框架,通过可微内部对齐嵌入实现多智能体强化学习中的安全对齐,探讨了反事实对齐惩罚、感知注意力等机制及理论性质。

Comments 32 pages, 1 figure. Theoretical framework; no empirical results

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00566 2025-12-23 cs.AI cs.CL 73%

Instructor-Worker Large Language Model System for Policy Recommendation: a Case Study on Air Quality Analysis of the January 2025 Los Angeles Wildfires

政策推荐用的Instructor-Worker大语言模型系统:以2025年1月洛杉矶野火空气质量分析为例

Kyle Gao, Dening Lu, Liangzhi Li, Nan Chen, Hongjie He, Linlin Xu, Jonathan Li

机构 * Department of Systems Design Engineering(系统设计工程系) College of Land Engineering(土地工程学院) School of Computer Science(计算机科学学院) Department of Geography and Environmental Management(地理与环境管理系) Department of Geomatics Engineering(测绘工程系)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出Instructor-Worker大语言模型系统,用于基于2025年1月洛杉矶野火期间空气质量数据的政策推荐研究。

Journal ref International Journal of Applied Earth Observation and Geoinformation 143 (2025) 104774

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18596 2025-12-23 cs.LG 70%

EIA-SEC: Improved Actor-Critic Framework for Multi-UAV Collaborative Control in Smart Agriculture

EIA-SEC:改进的Actor-Critic框架用于智能农业多无人机协同控制

Quanxi Zhou, Wencan Mao, Yilei Liang, Manabu Tsukada, Yunling Liu, Jon Crowcroft

机构 * The University of Tokyo(东京大学) National Institute of Informatics(国家信息研究所) The University of Cambridge(剑桥大学) China Agricultural University(中国农业大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.LG

AI总结 EIA-SEC框架通过精英模仿和共享批评机制,提升多无人机在智能农业中的协同控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01298 2025-12-23 cs.CV cs.AI 70%

Towards Enhanced Image Generation Via Multi-modal Chain of Thought in Unified Generative Models

通过统一生成模型中的多模态推理链提升图像生成

Yi Wang, Mushui Liu, Wanggui He, Hanyang Yuan, Longxiang Zhang, Ziwei Huang, Guanghao Zhang, Wenkai Fang, Haoze Jiang, Shengxuming Zhang, Dong She, Jinlong Liu, Weilong Dai, Mingli Song, Hao Jiang, Jie Song

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本文通过引入多模态推理链提升统一生成模型的复杂图像生成能力,提出FoXperts架构和MCoT方法,实现更高效的多模态生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18112 2025-12-23 eess.SY cs.SY 67%

Bayesian Holonic Systems: Equilibrium, Uniqueness, and Computation

贝叶斯整体系统:均衡、唯一性和计算

Yunian Pan, Quanyan Zhu

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文提出贝叶斯整体均衡概念及双时间尺度学习算法,用于复杂耦合控制系统中策略风险的原理性设计与分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21728 2025-12-23 cs.CL cs.AI cs.LG 67%

Affective Multimodal Agents with Proactive Knowledge Grounding for Emotionally Aligned Marketing Dialogue

具有主动知识 grounding 的情感多模态代理用于情感对齐的营销对话

Lin Yu, Xiaofei Han, Yifei Kang, Chiung-Yi Tseng, Danyang Zhang, Ziqian Bi, Zhimo Han

机构 * Hunan Police Academy, Department of Criminal Investigation(湖南警察学院犯罪侦查系) Business College, California State University(加州州立大学长滩分校商学院) Northwestern University(西北大学) AI Agent Lab, Vokram Group(Vokram集团AI代理实验室) Beijing University of Technology(北京理工大学) Zheng Zhou University of Light Industry(郑州轻工业大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 AffectMind通过主动知识 grounding 和情绪-意图对齐模型,提升营销对话中的情感一致性与说服效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08484 2025-12-23 cs.GT 67%

Self-Play Q-learners Can Provably Collude in the Iterated Prisoner's Dilemma

自我博弈的Q学习者可以在重复囚徒困境中证明性合谋

Quentin Bertrand, Juan Duque, Emilio Calvano, Gauthier Gidel

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本研究通过理论分析证明自我博弈的Q学习者在重复囚徒困境中能学习合作策略,而非背叛策略,并通过实验验证其鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19366 2025-12-23 cs.AI cs.LG 62%

Learning General Policies with Policy Gradient Methods

通过策略梯度方法学习通用策略

Simon Ståhlberg, Blai Bonet, Hector Geffner

机构 * Linköping University(利厄普大学) Universitat Pompeu Fabra(庞培法拉大学) RWTH Aachen University(亚琛工业大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文通过策略梯度方法结合图神经网络,实现了与组合方法相当的泛化能力,同时避免了可扩展性瓶颈和特征池的使用。

Comments In Proceedings of the 20th International Conference on Principles of Knowledge Representation and Reasoning (KR 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18623 2025-12-23 cs.CL cs.AI 62%

LLM-CAS: Dynamic Neuron Perturbation for Real-Time Hallucination Correction

LLM-CAS: 动态神经元扰动用于实时幻觉修正

Jensen Zhang, Ningyuan Liu, Yijia Fan, Zihao Huang, Qinglin Zeng, Kaitong Cai, Jian Wang, Keze Wang

机构 * Sun Yat-sen University(中山大学) Snap Inc(Snap公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 LLM-CAS通过动态神经元扰动实现实时幻觉修正,提升大型语言模型的事实准确性。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11646 2025-12-23 cs.LG cs.AI cs.IR 62%

What-If Decision Support for Product Line Extension Using Conditional Deep Generative Models

基于条件深度生成模型的产品线扩展的假设决策支持

Yinxing Li, Tsukasa Ishigaki

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于条件深度生成模型的产品线扩展假设决策支持框架,通过生成合成消费者特征分布,有效评估产品设计风险并识别目标市场。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18311 2025-12-23 cs.AI cs.SE 62%

Monitoring Monitorability

监控可监控性

Melody Y. Guan, Miles Wang, Micah Carroll, Zehao Dou, Annie Y. Wei, Marcus Williams, Benjamin Arnav, Joost Huizinga, Ian Kivlichan, Mia Glaese, Jakub Pachocki, Bowen Baker

机构 * OpenAI

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究提出评估框架和指标,探讨了不同因素对AI系统可监控性的影响,发现更长的思维链和优化方法能提升监控效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14918 2025-12-23 cs.CL cs.LG stat.ML 62%

Reliable Decision Support with LLMs: A Framework for Evaluating Consistency in Binary Text Classification Applications

利用LLM实现可靠决策支持:一种评估二元文本分类应用一致性的框架

Fadel M. Megahed, Ying-Ju Chen, L. Allision Jones-Farmer, Younghwa Lee, Jiawei Brooke Wang, Inez M. Zwetsloot

机构 * Farmer School of Business, Miami University, Oxford, OH 45056, USA(迈阿密大学法默商学院) College of Arts and Sciences, University of Dayton, Dayton, OH 45469, USA(Dayton大学文理学院) Amsterdam Business School, University of Amsterdam, Amsterdam, The Netherlands(阿姆斯特丹大学阿姆斯特丹商学院)

专题命中 规划决策 :planning(abstract);分类 cs.CL、cs.LG

AI总结 本文提出了一种评估LLM在二元文本分类中一致性的框架,通过实验验证了不同模型在金融新闻分类中的性能,并提供了系统化的LLM选择和可靠性评估方法。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18950 2025-12-23 cs.LG cs.AI 59%

Learning Hierarchical Procedural Memory for LLM Agents through Bayesian Selection and Contrastive Refinement

通过贝叶斯选择和对比细化学习层次化程序记忆以提升LLM代理

Saman Forouzandeh, Wei Peng, Parham Moradi, Xinghuo Yu, Mahdi Jalili

机构 * School of Engineering, Royal Melbourne Institute of Technology University(皇家墨尔本理工学院工程学院)

专题命中 规划决策 :分类 cs.AI、cs.LG;agent(comments);autonomous agent(comments);multi-agent(comments)

AI总结 MACLA通过贝叶斯选择和对比细化方法,实现LLM代理的高效学习与持续改进,无需参数更新。

Comments Accepted at The 25th International Conference on Autonomous Agents and Multi-Agent Systems (AAMAS 2026). 21 pages including references, with 7 figures and 8 tables. Code is publicly available at the authors GitHub repository: https://github.com/S-Forouzandeh/MACLA-LLM-Agents-AAMAS-Conference

详情

展开后加载摘要…

URL PDF HTML 收藏