arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-23 至 2025-12-23 共收录 155 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 9 篇

2512.18745 2025-12-23 cs.CV cs.CL cs.LG 79%

InSight-o3: Empowering Multimodal Foundation Models with Generalized Visual Search

InSight-o3: 通过通用视觉搜索增强多模态基础模型

Kaican Li, Lewei Yao, Jiannan Wu, Tiezheng Yu, Jierun Chen, Haoli Bai, Lu Hou, Lanqing Hong, Wei Zhang, Nevin L. Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Huawei(华为)

专题命中 工具调用 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 InSight-o3通过通用视觉搜索任务提升多模态基础模型的推理能力,解决复杂视觉信息整合问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17912 2025-12-23 cs.CL cs.AI 73%

Graph-O1 : Monte Carlo Tree Search with Reinforcement Learning for Text-Attributed Graph Reasoning

Graph-O1:基于强化学习的蒙特卡洛树搜索用于文本属性图推理

Lihui Liu

机构 * Wayne State University(韦恩州立大学)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 Graph-O1通过整合蒙特卡洛树搜索与强化学习,实现文本属性图的分步交互推理,提升问答任务的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10581 2025-12-23 cs.GR 67%

GraphTracer: Graph-Guided Failure Tracing in LLM Agents for Robust Multi-Turn Deep Search

GraphTracer: LLM代理中基于图的故障追踪以实现鲁棒多轮深度搜索

Heng Zhang, Yuling Shi, Xiaodong Gu, Haochen You, Zijian Zhang, Lubin Gan, Yilei Yuan, Jin Huang

专题命中 工具调用 :agent(abstract);multi-agent(abstract)

AI总结 GraphTracer通过信息流分析和依赖图构建,提升多代理系统在多轮深度搜索中的故障归因准确性与鲁棒性。

Comments This submission has been withdrawn by the authors due to a fundamental error in the methodology that affects the validity of the main results

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19155 2025-12-23 cs.AI 57%

Can We Test Consciousness Theories on AI? Ablations, Markers, and Robustness

我们能用人工智能测试意识理论吗?消融、标志和鲁棒性

Yin Jun Phua

机构 * Institute of Science Tokyo(东京科学研究所)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文通过构建人工代理测试意识理论,发现GWT和HOT分别负责广播能力与质量控制,揭示了意识理论的互补性与功能层次。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14992 2025-12-23 q-fin.PM 50%

Multi-Objective Bayesian Optimization of Deep Reinforcement Learning for Environmental, Social, and Governance (ESG) Financial Portfolio Management

多目标贝叶斯优化深度强化学习用于环境、社会和治理(ESG)金融投资组合管理

M. Coronado-Vaca

专题命中 工具调用 :agent(abstract)

AI总结 本文提出利用多目标贝叶斯优化方法优化深度强化学习在ESG投资组合管理中的应用,通过帕累托集实现夏普比率与ESG评分的最佳权衡。

Comments arXiv admin comment: This version has been removed by arXiv administrators as the submitter did not have the rights to agree to the license at the time of submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18706 2025-12-23 cs.SD 50%

X-Talk: On the Underestimated Potential of Modular Speech-to-Speech Dialogue System

X-Talk:模块化语音到语音对话系统的被低估潜力

Zhanxun Liu, Yifan Duan, Mengmeng Wang, Pengchao Feng, Haotian Zhang, Xiaoyu Xing, Yijia Shan, Haina Zhu, Yuhang Dai, Chaochao Lu, Xipeng Qiu, Lei Xie, Lan Wang, Nan Yan, Zilong Zheng, Ziyang Ma, Kai Yu, Xie Chen

机构 * MoE Key Lab of Artificial Intelligence, X-LANCE Lab, Shanghai Jiao Tong University(人工智能基础理论重点实验室,X-LANCE实验室,上海交通大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Audio, Speech and Language Processing Group, Northwestern Polytechnical University(语音与语言处理组,西北工业大学) Fudan University(复旦大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)

专题命中 工具调用 :tool use(abstract)

AI总结 X-Talk通过模块化设计和流水线优化,提升语音到语音对话系统的性能与灵活性,展示其在复杂语音任务中的潜力。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19111 2025-12-23 eess.SY cs.SY 50%

Radio Map Assisted Routing and Predictive Resource Allocation over Dynamic Low Altitude Networks

基于无线电地图的路由与预测资源分配在动态低空网络中的应用

Bowen Li, Junting Chen

专题命中 工具调用 :planning(abstract)

AI总结 本文提出基于动态空间-时间图模型的跨层优化框架,用于解决动态低空网络中的路由与预测资源分配问题,通过显式界限和二分搜索算法实现全局最优解,提升延迟敏感和大数据传输性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17967 2025-12-23 cs.DB 50%

Memelang: An Axial Grammar for LLM-Generated Vector-Relational Queries

Memelang:一种用于LLM生成向量关系查询的轴性语法

Bri Holt

专题命中 工具调用 :tool use(abstract)

AI总结 Memelang是一种紧凑的查询语言,通过轴性语法实现LLM生成的向量关系查询的结构化生成,支持坐标稳定引用、变量绑定和隐式上下文传递,以提高查询效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10200 2025-12-23 cs.CV 50%

LVAgent: Long Video Understanding by Multi-Round Dynamical Collaboration of MLLM Agents

LVAgent: 通过多轮动态协作的MLLM代理实现长视频理解

Boyu Chen, Zhengrong Yue, Siran Chen, Zikang Wang, Yang Liu, Peng Li, Yali Wang

机构 * Shenzhen Key Lab of Computer Vision and Pattern Recognition, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳计算机视觉与模式识别重点实验室,深圳先进技术研究院,中国科学院) Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究院(AIR),清华大学,北京,中国) Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究院,清华大学,北京,中国) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 工具调用 :agent(abstract)

AI总结 LVAgent通过多轮动态协作的MLLM代理提升长视频理解性能,实现80%的准确率并在LongVideoBench上提升13.3%

Comments accepted in ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 66 篇

2512.17187 2025-12-23 cs.MA cs.GT 88%

MAPPO-LCR: Multi-Agent Proximal Policy Optimization with Local Cooperation Reward in Spatial Public Goods Games

MAPPO-LCR:在空间公共物品游戏中采用局部合作奖励的多智能体近端策略优化

Zhaoqilin Yang, Axin Xiang, Kedi Yang, Tianjun Liu, Youliang Tian

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract)

AI总结 MAPPO-LCR通过引入局部合作奖励,解决了空间公共物品游戏中个体收益耦合问题,提升了多智能体近端策略优化的群体协作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18604 2025-12-23 cs.LG 85%

Trajectory Planning for UAV-Based Smart Farming Using Imitation-Based Triple Deep Q-Learning

基于模仿学习的三重深度Q学习用于无人机智能农业的轨迹规划

Wencan Mao, Quanxi Zhou, Tomas Couso Coddou, Manabu Tsukada, Yunling Liu, Yusheng Ji

机构 * National Institute of Informatics(国立信息研究所) The University of Tokyo(东京大学) Pontificia Universidad Católica de Chile(智利天主教大学) China Agricultural University(中国农业大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出基于模仿学习的三重深度Q学习算法,用于提升无人机在智能农业中的轨迹规划性能,实验显示其在杂草识别和数据收集方面均优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18265 2025-12-23 cs.AI 83%

Intelligent Human-Machine Partnership for Manufacturing: Enhancing Warehouse Planning through Simulation-Driven Knowledge Graphs and LLM Collaboration

智能人机协作制造:通过仿真驱动的知识图谱与大语言模型协作提升仓库规划

Himabindu Thogaru, Saisubramaniam Gopalakrishnan, Zishan Ahmad, Anirudh Deodhar

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 本研究提出通过仿真驱动的知识图谱与大语言模型协作,提升制造业仓库规划的智能化水平,实现人机高效协作以优化运营决策。

Comments 13 pages, 2 figures, accepted for oral presentation at AAAI Human Machine Collaboration Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18202 2025-12-23 cs.AI 83%

Sophia: A Persistent Agent Framework of Artificial Life

Sophia:人工智能生命的一种持久代理框架

Mingyang Sun, Feng Hong, Weinan Zhang

机构 * Westlake University(西湖大学) Shanghai Innovation Institute(上海创新研究院) Project Cuddlepark Team(Project Cuddlepark团队) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 Sophia通过引入系统3,实现持久代理框架,使AI代理具备自我改进、身份连续性和透明行为解释能力,推动人工生命的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17629 2025-12-23 cs.LG math.OC 83%

Planning and Learning in Average Risk-aware MDPs

在平均风险感知马尔可夫决策过程中的规划与学习

Weikai Wang, Erick Delage

机构 * GERAD & HEC Montréal(GERAD与蒙特利尔HEC学院) Mila - Québec AI Institute(魁北克AI研究所)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG

AI总结 本文提出了一种相对价值迭代算法和两种基于多级蒙特卡洛方法的Q学习算法,用于在平均风险感知马尔可夫决策过程中实现最优策略的收敛与识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18440 2025-12-23 cs.CL cs.AI 81%

An Agentic AI Framework for Training General Practitioner Student Skills

一种用于培训全科医学生技能的代理AI框架

Victor De Marez, Jens Van Nooten, Luna De Bruyne, Walter Daelemans

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种代理AI框架,用于培训全科医学生技能,通过统一病例生成、角色驱动对话和基于标准的评估,提升医学教育中虚拟模拟患者的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19564 2025-12-23 cs.RO cs.AI 79%

Results of the 2024 CommonRoad Motion Planning Competition for Autonomous Vehicles

2024年自动驾驶车辆运动规划竞赛结果

Yanliang Huang, Xia Yan, Peiran Yin, Zhenduo Zhang, Zeyan Shao, Youran Wang, Haoliang Huang, Matthias Althoff

机构 * Technical University of Munich(慕尼黑技术大学) RWTH Aachen(亚琛工业大学) Harbin Institute of Technology(哈尔滨工业大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 2024年CommonRoad运动规划竞赛评估了自动驾驶车辆在高速公路和城市环境中的运动规划算法性能,通过四个维度比较了多种高性能规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18966 2025-12-23 cs.SE 79%

Scrum Sprint Planning: LLM-based and algorithmic solutions

Scrum迭代规划:基于大语言模型和算法的解决方案

Yuwon Yoon, Kevin Iwan, Madeleine Zwart, Xiaohan Qin, Hina Lee, Maria Spichkova

专题命中 规划决策 :planning(title,abstract);分类 cs.SE

AI总结 本文探讨了大语言模型在Scrum迭代规划中的应用,通过实验发现其结果质量不满足直接使用需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18703 2025-12-23 cs.RO cs.AI 79%

CauTraj: A Causal-Knowledge-Guided Framework for Lane-Changing Trajectory Planning of Autonomous Vehicles

CauTraj:一种融合因果知识的车道变换轨迹规划框架

Cailin Lei, Haiyang Wu, Yuxiong Ji, Xiaoyu Cai, Yuchuan Du

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 CauTraj通过整合因果知识提升自动驾驶车辆车道变换轨迹规划的精度与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18211 2025-12-23 cs.RO cs.AI 79%

LLaViDA: A Large Language Vision Driving Assistant for Explicit Reasoning and Enhanced Trajectory Planning

LLaViDA: 一种用于显式推理和增强轨迹规划的大型语言视觉驾驶助手

Yudong Liu, Spencer Hallyburton, Jiwoo Kim, Yueqian Lin, Yiming Li, Qinsi Wang, Hui Ye, Jingwei Sun, Miroslav Pajic, Yiran Chen, Hai Li

机构 * Duke University(杜克大学) Georgia State University(佐治亚州立大学) University of Florida(佛罗里达大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 LLaViDA通过视觉-语言模型实现显式推理和轨迹规划,提升自动驾驶的轨迹规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00251 2025-12-23 cs.AI 79%

Instruction-Level Weight Shaping: A Framework for Self-Improving AI Agents

指令级权重塑造:一种自我改进的AI代理框架

Rimom Costa

机构 * Adobe Commerce Cloud Support Engineering - EMEA Division(Adobe 商业云支持工程 - EMEA部门)

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI

AI总结 指令级权重塑造通过外部可审计伪参数提升AI代理的自我改进能力,实现低延迟部署和减少幻觉,适用于动态领域。

Comments 12 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19133 2025-12-23 cs.RO cs.CV 78%

WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving

WorldRFT: 通过强化微调的潜在世界模型进行自动驾驶的规划

Pengxuan Yang, Ben Lu, Zhongpu Xia, Chao Han, Yinfeng Gao, Teng Zhang, Kun Zhan, XianPeng Lang, Yupeng Zheng, Qichao Zhang

专题命中 规划决策 :planning(title,abstract)

AI总结 WorldRFT通过强化学习微调提升自动驾驶规划性能,实现安全性和效率的双重优化。

Comments AAAI 2026, first version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19029 2025-12-23 econ.GN q-fin.EC 78%

Backward Growth Accounting: An Economic Tool for Strategic Planning of Business Growth

反向增长会计:一种用于企业增长战略规划的经济工具

Ali Zeytoon-Nejad

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出反向增长会计方法,用于企业增长的结构化规划,以提升经济逻辑和数学工具的应用,识别增长驱动因素并评估增长过程中的不足。

Journal ref Managerial and Decision Economics, 2025; 0:1-22

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18863 2025-12-23 physics.med-ph 78%

A physics-informed, plug-and-play dose engine for gradient-based radiotherapy treatment planning

一种基于物理的、即插即用的剂量引擎用于基于梯度的放疗治疗计划

Attila Simkó, Matthias Kronsteiner, Simon Glatzer, Minh Vu, Josef A. Lundman, Joakim Jonsson, Jörgen Olofsson, Kristina Sandgren, Wolfgang Lechner, Dietmar Georg, Tommy Löfstedt, Tufve Nyholm, Anders Garpebring, Gerd Heilemann

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出PyDoseRT,一种基于物理的、GPU加速的剂量引擎,用于基于梯度的放疗治疗计划优化,无需依赖商业TPS,提高临床有效性与研究灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12220 2025-12-23 cs.RO 78%

Hybrid Dynamics Modeling and Trajectory Planning for a Cable-Trailer System with a Quadruped Robot

混合动力学建模与电缆-拖车系统四足机器人的轨迹规划

Wentao Zhang, Shaohang Xu, Gewei Zuo, Bolin Li, Jingbo Wang, Lijun Zhu

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(人工智能与自动化学院,华中科技大学) Department of Data Science, City University of Hong Kong(数据科学系,城市大学) Embodied AI Center of Shanghai AI Lab(上海人工智能实验室具身智能中心)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种混合动力学模型和搜索算法,用于四足机器人与电缆-拖车系统的轨迹规划,通过几何多边形碰撞避免约束实现安全高效的运动控制。

Comments 8 pages, 8 figures, Accept by RA-L 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05769 2025-12-23 cs.CV 75%

Digital Twin Buildings: 3D Modeling, GIS Integration, and Visual Descriptions Using Gaussian Splatting, ChatGPT/Deepseek, and Google Maps Platform

数字孪生建筑:利用高斯点扩散、ChatGPT/DeepSeek和Google地图平台进行3D建模、GIS集成和视觉描述

Kyle Gao, Dening Lu, Liangzhi Li, Nan Chen, Hongjie He, Linlin Xu, Jonathan Li

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于高斯点扩散、ChatGPT和Google地图平台的数字孪生建筑框架,用于实现建筑的3D建模、GIS集成和视觉描述。

Comments -Fixed minor typo

Journal ref IEEE Geoscience and Remote Sensing Letters 22 (2025) 6013405

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18619 2025-12-23 cs.AI cs.RO 74%

ChronoDreamer: Action-Conditioned World Model as an Online Simulator for Robotic Planning

ChronoDreamer:基于动作的动态世界模型作为机器人规划的在线模拟器

Zhenhao Zhou, Dan Negrut

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 ChronoDreamer通过时空变换器和视觉-语言模型,实现基于动作的动态世界模型,用于机器人规划中的安全动作预测与碰撞检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18309 2025-12-23 cs.LG cs.AI 73%

Embedded Safety-Aligned Intelligence via Differentiable Internal Alignment Embeddings

通过可微内部对齐嵌入实现嵌入式安全对齐智能

Harsh Rathva, Ojas Srivastava, Pruthwik Mishra

机构 * Sardar Vallabhbhai National Institute of Technology (SVNIT)(萨达尔·瓦拉布尔·尼尔达理工学院)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出嵌入式安全对齐智能框架,通过可微内部对齐嵌入实现多智能体强化学习中的安全对齐,探讨了反事实对齐惩罚、感知注意力等机制及理论性质。

Comments 32 pages, 1 figure. Theoretical framework; no empirical results

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00566 2025-12-23 cs.AI cs.CL 73%

Instructor-Worker Large Language Model System for Policy Recommendation: a Case Study on Air Quality Analysis of the January 2025 Los Angeles Wildfires

政策推荐用的Instructor-Worker大语言模型系统:以2025年1月洛杉矶野火空气质量分析为例

Kyle Gao, Dening Lu, Liangzhi Li, Nan Chen, Hongjie He, Linlin Xu, Jonathan Li

机构 * Department of Systems Design Engineering(系统设计工程系) College of Land Engineering(土地工程学院) School of Computer Science(计算机科学学院) Department of Geography and Environmental Management(地理与环境管理系) Department of Geomatics Engineering(测绘工程系)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出Instructor-Worker大语言模型系统,用于基于2025年1月洛杉矶野火期间空气质量数据的政策推荐研究。

Journal ref International Journal of Applied Earth Observation and Geoinformation 143 (2025) 104774

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18596 2025-12-23 cs.LG 70%

EIA-SEC: Improved Actor-Critic Framework for Multi-UAV Collaborative Control in Smart Agriculture

EIA-SEC:改进的Actor-Critic框架用于智能农业多无人机协同控制

Quanxi Zhou, Wencan Mao, Yilei Liang, Manabu Tsukada, Yunling Liu, Jon Crowcroft

机构 * The University of Tokyo(东京大学) National Institute of Informatics(国家信息研究所) The University of Cambridge(剑桥大学) China Agricultural University(中国农业大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.LG

AI总结 EIA-SEC框架通过精英模仿和共享批评机制,提升多无人机在智能农业中的协同控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01298 2025-12-23 cs.CV cs.AI 70%

Towards Enhanced Image Generation Via Multi-modal Chain of Thought in Unified Generative Models

通过统一生成模型中的多模态推理链提升图像生成

Yi Wang, Mushui Liu, Wanggui He, Hanyang Yuan, Longxiang Zhang, Ziwei Huang, Guanghao Zhang, Wenkai Fang, Haoze Jiang, Shengxuming Zhang, Dong She, Jinlong Liu, Weilong Dai, Mingli Song, Hao Jiang, Jie Song

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本文通过引入多模态推理链提升统一生成模型的复杂图像生成能力,提出FoXperts架构和MCoT方法,实现更高效的多模态生成。

详情

展开后加载摘要…

URL PDF HTML 收藏