arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-11 至 2025-12-11 共收录 59 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 3 篇

2512.09410 2025-12-11 cs.RO cs.LG cs.MA 77%

Generalizable Collaborative Search-and-Capture in Cluttered Environments via Path-Guided MAPPO and Directional Frontier Allocation

在 cluttered 环境中通过路径引导的 MAPPO 和方向性前沿分配实现可泛化的协作搜索与捕获

Jialin Ying, Zhihao Li, Zicheng Dong, Guohua Wu, Yihuan Liao

机构 * Department of Automation, Central South University, Changsha, China(自动化系,中南大学,长沙,中国)

专题命中 工具调用 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出 PGF-MAPPO 方法,通过路径引导的 MAPPO 和方向性前沿分配,在 cluttered 环境中实现高效的协作搜索与捕获,展示了出色的泛化能力和性能优势。

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09898 2025-12-11 cs.RO cs.AI cs.CV cs.MA cs.SY eess.SY 70%

Visual Heading Prediction for Autonomous Aerial Vehicles

自主航空器的视觉航向预测

Reza Ahmari, Ahmad Mohammadi, Vahid Hemmati, Mohammed Mynuddin, Parham Kebria, Mahmoud Nabil Mahmoud, Xiaohong Yuan, Abdollah Homaifar

机构 * Department of Computer Science at North Carolina A&T State University(北卡罗来纳A&T州立大学计算机科学系) Department of Electrical and Computer Engineering at North Carolina A&T State University(北卡罗来纳A&T州立大学电气与计算机工程系)

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出基于视觉的数据驱动框架,实现无人机与无人地面车辆的实时整合,通过YOLOv5检测UGV并利用轻量级ANN预测航向角,实现高精度的导航与协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09909 2025-12-11 cs.LG cs.AI 62%

STACHE: Local Black-Box Explanations for Reinforcement Learning Policies

STACHE:强化学习策略的局部黑盒解释

Andrew Elashkin, Orna Grumberg

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 STACHE提出一种用于生成强化学习策略局部黑盒解释的框架,通过鲁棒区域和最小反事实分析,揭示策略行为的演变过程。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 27 篇

2107.05664 2025-12-11 cs.RO cs.AI 92%

Altruistic Maneuver Planning for Cooperative Autonomous Vehicles Using Multi-agent Advantage Actor-Critic

为合作自主车辆的利他性动作规划使用多智能体优势Actor-Critic

Behrad Toghi, Rodolfo Valiente, Dorsa Sadigh, Ramtin Pedarsani, Yaser P. Fallah

专题命中 规划决策 :planning(title,abstract);agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract)

AI总结 本文提出一种多智能体优势Actor-Critic算法,用于自动驾驶车辆在混合交通环境中的利他性动作规划,以提升交通效率与安全。

Comments Accepted to 2021 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2021) - Workshop on Autonomous Driving: Perception, Prediction and Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05447 2025-12-11 cs.MA 89%

Distributed scalable coupled policy algorithm for networked multi-agent reinforcement learning

分布式可扩展耦合策略算法用于网络化多智能体强化学习

Pengcheng Dai, Dongming Wang, Wenwu Yu, Wei Ren

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出了一种分布式可扩展耦合策略算法,用于解决网络化多智能体强化学习中的相互依赖奖励和耦合策略问题,通过几何2步采样方法实现无偏梯度估计,提升协同优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09458 2025-12-11 cs.AI cs.LG 88%

Architectures for Building Agentic AI

构建代理AI的架构

Sławomir Nowaczyk

机构 * Center for Applied Intelligent Systems Research, Halmstad University, Sweden(应用智能系统研究所,哈尔姆斯塔德大学,瑞典)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出了一种构建代理AI的架构分类,通过组件化设计和显式控制循环提升系统可靠性。

Comments This is a preprint of a chapter accepted for publication in Generative and Agentic AI Reliability: Architectures, Challenges, and Trust for Autonomous Systems, published by Springer Nature

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07828 2025-12-11 cs.LG econ.GN q-fin.EC 87%

The Adoption and Usage of AI Agents: Early Evidence from Perplexity

AI代理的采用与使用:来自困惑度的早期证据

Jeremy Yang, Noah Yonack, Kate Zyskowski, Denis Yarats, Johnny Ho, Jerry Ma

机构 * Perplexity

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);workflow(abstract);agentic(abstract)

AI总结 本文研究了AI代理在开放网络环境中的采用情况,揭示了不同用户群体在使用强度和用途上的差异,并提出了分层的代理使用分类法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09548 2025-12-11 cs.MA 85%

Supporting Dynamic Agentic Workloads: How Data and Agents Interact

支持动态代理工作负载:数据与代理如何相互作用

Ioana Giurgiu, Michael E. Nidd

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种以代理为中心的数据织物,旨在高效支持动态、多模态的代理工作负载,通过注意力引导的数据检索、语义微缓存等机制提升数据处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09897 2025-12-11 cs.AI cs.CL 84%

SCOPE: Language Models as One-Time Teacher for Hierarchical Planning in Text Environments

SCOPE:语言模型作为一次性教师用于文本环境中的分层规划

Haoye Lu, Pavan Seshadri, Kaheer Suleman

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 SCOPE通过一次性利用LLM生成的子目标预训练轻量级模型,实现高效文本环境分层规划,比ADaPT方法在成功率和推理效率上更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09081 2025-12-11 cs.CV 82%

AgentComp: From Agentic Reasoning to Compositional Mastery in Text-to-Image Models

AgentComp: 从代理推理到文本-图像模型中的组合性 mastery

Arman Zarei, Jiacheng Pan, Matthew Gwilliam, Soheil Feizi, Zhenheng Yang

机构 * TikTok University of Maryland(马里兰大学)

专题命中 规划决策 :agentic(title,abstract);tool-use(abstract)

AI总结 AgentComp通过训练模型区分组合性相似的提示和图像,提升文本-图像模型的组合性生成能力,实现更准确的图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08996 2025-12-11 cs.CV cs.AI cs.LG 81%

Demo: Generative AI helps Radiotherapy Planning with User Preference

演示:生成式AI助力放疗计划制定与用户偏好

Riqiang Gao, Simon Arberet, Martin Kraus, Han Liu, Wilko FAR Verbakel, Dorin Comaniciu, Florin-Cristian Ghesu, Ali Kamen

机构 * Digital Technology and Innovation, Siemens Healthineers(西门子医疗数字化技术与创新部) Varian Medical Systems, Siemens Healthineers(Varian医疗系统,西门子医疗)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 生成式AI通过用户自定义偏好提升放疗计划的灵活性与个性化,优于现有方法在适应性和计划质量上

Comments Best paper in GenAI4Health at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09929 2025-12-11 cs.LG cs.RO 79%

Closing the Train-Test Gap in World Models for Gradient-Based Planning

缩小世界模型在基于梯度规划中的训练-测试差距

Arjun Parthasarathy, Nimit Kalra, Rohun Agrawal, Yann LeCun, Oumayma Bounou, Pavel Izmailov, Micah Goldblum

机构 * Columbia University(哥伦比亚大学) New York University(纽约大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出改进世界模型训练方法,以提高基于梯度的规划效率,缩小训练与测试之间的性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08933 2025-12-11 cs.HC cs.AI cs.CY 79%

Agentic AI as Undercover Teammates: Argumentative Knowledge Construction in Hybrid Human-AI Collaborative Learning

代理AI作为潜入队友:混合人机协作学习中的论证知识构建

Lixiang Yan, Yueqiao Jin, Linxuan Zhao, Roberto Martinez-Maldonado, Xinyu Li, Xiu Guan, Wenxin Guo, Xibin Han, Dragan Gašević

机构 * Tsinghua University(清华大学) Monash University(墨尔本大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本研究探讨代理AI作为潜入队友在混合人机协作学习中对论证知识构建的影响,发现其通过促进高质量推理和协调性提升学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09310 2025-12-11 cs.RO 78%

Scene-agnostic Hierarchical Bimanual Task Planning via Visual Affordance Reasoning

场景无关的双臂任务规划 via 视觉可及性推理

Kwang Bin Lee, Jiho Kang, Sung-Hee Lee

机构 * Graduate School of Culture Technology, Korea Advanced Institute of Science and Technology (KAIST)(文化科技研究生院,韩国科学技术院)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种场景无关的双臂任务规划框架,通过视觉可及性推理实现双臂操作的高效规划与执行。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00007 2025-12-11 stat.AP 78%

Bayesian Statistical Modeling in Action for Estimation and Forecasting in Low- and Middle-income Countries: The Case of the Family Planning Estimation Tool

在低收入和中等收入国家应用贝叶斯统计建模进行估计与预测:家庭计划生育估计工具案例

Leontine Alkema, Herbert Susmann, Evan Ray, Shauna Mooney, Niamh Cahill, Kristin Bietsch, A. A. Jayachandran, Rogers Kagimu, Priya Emmart, Zenon Mujani, Khan Muhammad, Brighton Muzavazi, Rebecca Rosenberg, John Stover, Emily Sonneveldt

专题命中 规划决策 :planning(title,abstract)

AI总结 本文介绍了用于低收入和中等收入国家计划生育指标预测的贝叶斯统计模型,并探讨了其最新更新及验证结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11963 2025-12-11 cs.RO cs.LG 70%

Learning-based social coordination to improve safety and robustness of cooperative autonomous vehicles in mixed traffic

基于学习的社会协调以提高混合交通中协作自动驾驶车辆的安全性和鲁棒性

Rodolfo Valiente, Behrad Toghi, Mahdi Razzaghpour, Ramtin Pedarsani, Yaser P. Fallah

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出基于多智能体强化学习的方法,通过量化自动驾驶车辆的社会偏好并引入利他主义,提升其在混合交通中与人类驾驶车辆协作的安全性和鲁棒性。

Comments arXiv admin note: substantial text overlap with arXiv:2202.00881

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.00881 2025-12-11 cs.RO cs.LG 70%

Robustness and Adaptability of Reinforcement Learning based Cooperative Autonomous Driving in Mixed-autonomy Traffic

基于混合自主交通的强化学习协同自动驾驶的鲁棒性与适应性

Rodolfo Valiente, Behrad Toghi, Ramtin Pedarsani, Yaser P. Fallah

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出了一种基于多智能体强化学习的方法,用于提高自动驾驶车辆在混合自主交通环境中的鲁棒性和适应性,通过隐式学习人类驾驶行为以优化社会效用和安全性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09796 2025-12-11 cs.LG 57%

Knowledge Diversion for Efficient Morphology Control and Policy Transfer

知识分流用于高效形态控制与策略迁移

Fu Feng, Ruixiao Shi, Yucheng Xie, Jianlu Shen, Jing Wang, Xin Geng

机构 * School of Computer Science and Engineering, Southeast University, Nanjing, China(计算机科学与工程学院,东南大学,南京,中国) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及其交叉应用重点实验室(东南大学),教育部,中国)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 DivMorph通过知识分流实现高效形态控制与策略迁移,提升跨任务泛化能力与部署效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09596 2025-12-11 cs.SE 57%

Model management to support systems engineering workflows using ontology-based knowledge graphs

基于本体的知识图谱支持系统工程工作流管理

Arkadiusz Ryś, Lucas Lima, Joeri Exelmans, Dennis Janssens, Hans Vangheluwe

专题命中 规划决策 :workflow(abstract);分类 cs.SE

AI总结 本研究提出基于本体的知识图谱框架,用于支持系统工程工作流管理,通过存储和推理建模制品,提升系统开发效率和数据可访问性。

Journal ref J. Ind. Inf. Integr. 42: 100720 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09562 2025-12-11 cs.SE cs.IT math.IT 57%

Explainable Verification of Hierarchical Workflows Mined from Event Logs with Shapley Values

基于Shapley值的可解释性层次工作流验证

Radoslaw Klimek, Jakub Blazowski

专题命中 规划决策 :workflow(abstract);分类 cs.SE

AI总结 本文提出利用Shapley值对挖掘的工作流进行可解释性验证,通过逻辑规范分析和自动化定理证明器识别关键节点和有害结构,提升流程挖掘的解释性和实用性。

Comments This manuscript has been submitted to Rank A/A* conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09396 2025-12-11 cs.MA cs.AI 57%

GAIR: GUI Automation via Information-Joint Reasoning and Group Reflection

GAIR:通过信息联合推理和群体反思实现GUI自动化

Zishu Wei, Qixiang Ma, Xavier Hu, Yuhang Liu, Hui Zang, Yudong Zhao, Tao Wang, Shengyu Zhang, Fei Wu

机构 * Zhejiang University(浙江大学) Huawei Technologies Ltd.(华为技术有限公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 GAIR是一种基于MLLM的GUI自动化代理框架,通过信息联合推理和群体反思整合异质模型能力,提升GUI自动化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.10585 2025-12-11 cs.RO cs.AI 57%

Prediction-aware and Reinforcement Learning based Altruistic Cooperative Driving

具有预测意识和强化学习的利他性协作驾驶

Rodolfo Valiente, Mahdi Razzaghpour, Behrad Toghi, Ghayoor Shah, Yaser P. Fallah

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出一种基于预测意识和强化学习的自动驾驶方法,通过混合预测网络和社交优化框架提升安全性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09798 2025-12-11 cs.RO 50%

High-Resolution Water Sampling via a Solar-Powered Autonomous Surface Vehicle

通过太阳能供电的自主水面车辆实现高分辨率水样采集

Misael Mamani, Mariel Fernandez, Grace Luna, Steffani Limachi, Leonel Apaza, Carolina Montes-Dávalos, Marcelo Herrera, Edwin Salcedo

机构 * School of Electronic Engineering and Computer Science Queen Mary University of London, UK(电子工程与计算机科学学院,伦敦女王玛丽大学,英国)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种太阳能供电的自主水面车辆,通过模块化采样系统实现高分辨率水样采集,适用于远程环境的水体监测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09670 2025-12-11 cs.CV cs.SY eess.SY 50%

An Automated Tip-and-Cue Framework for Optimized Satellite Tasking and Visual Intelligence

一种自动化提示与提示框架用于优化卫星任务分配和视觉智能

Gil Weissman, Amir Ivry, Israel Cohen

机构 * Andrew and Erna Viterbi Faculty of Electrical and Computer Engineering, Technion-Israel Institute of Technology(安德鲁和伊尔纳·维特比电气与计算机工程学院,技术离子理工学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种自动化提示与提示框架,用于优化卫星任务分配和视觉智能,通过生成提示和任务并利用人工智能模型处理影像,提升地球观测效率。

Comments Under review at IEEE Transactions on Geoscience and Remote Sensing (TGRS). 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09349 2025-12-11 cs.RO 50%

COVLM-RL: Critical Object-Oriented Reasoning for Autonomous Driving Using VLM-Guided Reinforcement Learning

COVLM-RL:基于VLM引导强化学习的自动驾驶中关键对象导向推理

Lin Li, Yuxin Cai, Jianwu Fang, Jianru Xue, Chen Lv

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, National Engineering Research Center for Visual Information and Applications, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人机混合增强智能国家重点实验室、视觉信息与应用国家工程研究中心、人工智能与机器人研究院)

专题命中 规划决策 :agent(abstract)

AI总结 COVLM-RL通过结合关键对象导向推理与VLM引导强化学习,提升了自动驾驶系统的泛化能力和训练效率。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09227 2025-12-11 physics.soc-ph 50%

Evaluating the Impact of Population Growth and Applying Decarbonization Regulations on the Energy Market in the ERCOT Interconnection Area

评估人口增长及应用脱碳法规对能源市场的影响:ERCOT互联区域

Farah Altarazi

专题命中 规划决策 :planning(abstract)

AI总结 本研究评估人口增长和脱碳法规对 ERCOT 能源市场的影响,发现碳定价比静态排放上限更有效,且人口不确定性需纳入长期规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09215 2025-12-11 cs.CV 50%

View-on-Graph: Zero-shot 3D Visual Grounding via Vision-Language Reasoning on Scene Graphs

视图-图:通过场景图上的视觉-语言推理实现零样本3D视觉定位

Yuanyuan Liu, Haiyang Mei, Dongyang Zhan, Jiayue Zhao, Dongsheng Zhou, Bo Dong, Xin Yang

专题命中 规划决策 :agent(abstract)

AI总结 本文提出视图-图方法,通过场景图上的视觉-语言推理实现零样本3D视觉定位,有效解决空间语义关系处理难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09083 2025-12-11 math.OC 50%

Reactive Vehicle Guidance using Dynamic Maneuvering Cue

利用动态机动提示的反应式车辆引导

Alexander Von Moll, Isaac Weintraub

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于动态机动提示的反应式车辆引导方法,通过闭式分析表达式实现机载实时执行,并用于多威胁区域的碰撞避免与冲突解决。

Comments AIAA SciTech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03166 2025-12-11 cs.CV 50%

RingMoE: Mixture-of-Modality-Experts Multi-Modal Foundation Models for Universal Remote Sensing Image Interpretation

RingMoE:面向通用遥感图像解释的多模态专家混合多模态基础模型

Hanbo Bi, Yingchao Feng, Boyuan Tong, Mengyu Wang, Haichen Yu, Yongqiang Mao, Hao Chang, Wenhui Diao, Peijin Wang, Yue Yu, Hanyang Peng, Yehong Zhang, Kun Fu, Xian Sun

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Target Cognition and Application Technology(TCAT), Aerospace Information Research Institute, Chinese Academy of Sciences(目标认知与应用技术重点实验室) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Peng Cheng Laboratory, Shenzhen(鹏城实验室)

专题命中 规划决策 :planning(abstract)

AI总结 RingMoE是一种多模态专家混合模型,通过自监督学习和物理信息嵌入,提升遥感图像的多模态处理能力,实现从单模态到多模态的高效适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08995 2025-12-11 cs.HC cs.IR 50%

PoultryTalk: A Multi-modal Retrieval-Augmented Generation (RAG) System for Intelligent Poultry Management and Decision Support

PoultryTalk: 一种用于智能家禽管理与决策支持的多模态检索增强生成(RAG)系统

Kapalik Khanal, Biswash Khatiwada, Stephen Afrifa, Ranjan Sapkota, Sanjay Shah, Frank Bai, Ramesh Bahadur Bist

专题命中 规划决策 :planning(abstract)

AI总结 PoultryTalk是一种多模态RAG系统,通过文本和图像交互为家禽管理提供实时专家指导,实现了高准确率和用户满意度。

详情

展开后加载摘要…

URL PDF HTML 收藏