arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-08 至 2026-01-08 共收录 102 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 29 篇

2601.00604 2026-01-08 cs.LG 57%

Cycling Race Time Prediction: A Personalized Machine Learning Approach Using Route Topology and Training Load

骑行时间预测:一种基于路线拓扑和训练负荷的个性化机器学习方法

Francisco Aguilera Moreno

机构 * BSc Computer Science (December 2025)(计算机科学学士(2025年12月))

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一种基于路线拓扑和训练负荷的个性化机器学习方法,通过历史数据学习运动员性能模式,以预测骑行时间,实验表明结合体能指标能显著提高预测精度。

Comments 29 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03460 2026-01-08 cs.CV cs.AI 57%

FROST-Drive: Scalable and Efficient End-to-End Driving with a Frozen Vision Encoder

FROST-Drive: 可扩展且高效的端到端驾驶方法,采用冻结的视觉编码器

Zeyu Dong, Yimin Zhu, Yu Wu, Yu Sun

机构 * Stony Brook University(石溪大学) Rutgers University(罗格斯大学) Sunrise Technology Inc.(Sunrise技术公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 FROST-Drive通过冻结预训练视觉编码器,结合适配器和解码器,实现高效端到端驾驶,优于全微调方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03376 2026-01-08 cs.LG 57%

Weather-Aware Transformer for Real-Time Route Optimization in Drone-as-a-Service Operations

考虑天气的变换器用于无人机即服务操作中的实时路线优化

Kamal Mohamed, Lillian Wassim, Ali Hamdi, Khaled Shaban

机构 * Dept. of Computer Science, Qatar University, Doha, Qatar(计算机科学系,卡塔尔大学,多哈)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一种天气感知的变换器框架,用于实时优化无人机即服务操作的路线,通过天气启发式方法提升动态环境下的路由决策效率与安全性。

Comments 2025 IEEE/ACS 22nd International Conference on Computer Systems and Applications (AICCSA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03956 2026-01-08 cs.RO 50%

CoINS: Counterfactual Interactive Navigation via Skill-Aware VLM

基于技能感知的反事实交互导航:通过技能感知视觉语言模型

Kangjie Zhou, Zhejia Wen, Zhiyong Zhuo, Zike Yan, Pengying Wu, Ieng Hou U, Shuaiyang Li, Han Gao, Kang Ding, Wenhan Cao, Wei Pan, Chang Liu

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系) College of Design and Engineering, National University Of Singapore(新加坡国立大学设计与工程学院) Department of Computer Science, The University of Manchester(曼彻斯特大学计算机科学系)

专题命中 规划决策 :planning(abstract)

AI总结 CoINS通过整合技能感知推理与稳健执行,提升机器人在复杂环境中的交互导航能力。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20617 2026-01-08 cs.CV 50%

SpatialTree: How Spatial Abilities Branch Out in MLLMs

SpatialTree: MLLMs中空间能力如何分支扩展

Yuxi Xiao, Longfei Li, Shen Yan, Xinhang Liu, Sida Peng, Yunchao Wei, Xiaowei Zhou, Bingyi Kang

机构 * Zhejiang University(浙江大学) Beijing Jiaotong University(北京交通大学)

专题命中 规划决策 :agentic(abstract)

AI总结 SpatialTree提出了一种受认知科学启发的分层结构,用于评估和提升多模态大语言模型中的空间能力。

Comments webpage: https://spatialtree.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26428 2026-01-08 cs.RO cs.SY eess.SY math.OC 50%

Real-time Velocity Profile Optimization for Time-Optimal Maneuvering with Generic Acceleration Constraints

实时速度剖面优化用于满足通用加速度约束的时间最优 maneuvering

Mattia Piazza, Mattia Piccinini, Sebastiano Taddei, Francesco Biral, Enrico Bertolazzi

专题命中 规划决策 :planning(abstract)

AI总结 FBGA通过前向-后向算法实现高精度快速的时间最优轨迹规划,适用于复杂加速度约束的自动驾驶赛车应用。

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 2, pp. 1674-1681, Feb. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11594 2026-01-08 stat.ME 50%

Rethinking the handling of method failure in comparison studies

重新思考比较研究中方法失败的处理

Milena Wünsch, Moritz Herrmann, Elisa Noltenius, Mattia Mohr, Tim P. Morris, Anne-Laure Boulesteix

专题命中 规划决策 :planning(abstract)

AI总结 本文提出在比较研究中应将方法失败视为多种因素相互作用的结果,并建议采用更现实的处理策略,如回退策略,以提高结果的可靠性。

Journal ref Statistics in Medicine 44 (2025):e70257

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03607 2026-01-08 cs.RO 50%

Locomotion Beyond Feet

超越双脚的运动

Tae Hoon Yang, Haochen Shi, Jiacheng Hu, Zhicong Zhang, Daniel Jiang, Weizhuo Wang, Yao He, Zhen Wu, Yuming Chen, Yifan Hou, Monroe Kennedy, Shuran Song, C. Karen Liu

专题命中 规划决策 :planning(abstract)

AI总结 本文提出Locomotion Beyond Feet系统,通过结合关键帧动画与强化学习,实现人形机器人在复杂地形中的稳健全身运动与泛化能力。

Comments Project website: https://locomotion-beyond-feet.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03449 2026-01-08 cs.RO 50%

FIRE-VLM: A Vision-Language-Driven Reinforcement Learning Framework for UAV Wildfire Tracking in a Physics-Grounded Fire Digital Twin

FIRE-VLM:一种基于视觉-语言驱动的强化学习框架,用于在物理基础火灾数字孪生中无人机火灾跟踪

Chris Webb, Mobin Habibpour, Mayamin Hamid Raha, Ali Reza Tavakkoli, Janice Coen, Fatemeh Afghah

机构 * Clemson University(克莱姆森大学) University of Nevada, Reno(内华达大学拉斯维加斯分校) NSF NCAR(国家科学基金会NCAR)

专题命中 规划决策 :agent(abstract)

AI总结 FIRE-VLM是一种基于视觉-语言模型的强化学习框架,用于在物理基础火灾数字孪生中实现无人机火灾跟踪,通过结合物理术语与VLM语义的奖励设计,提升了火灾检测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 16 篇

2601.03743 2026-01-08 cs.CL cs.AI 92%

O-Researcher: An Open Ended Deep Research Model via Multi-Agent Distillation and Agentic RL

O-Researcher: 通过多智能体蒸馏和智能体强化学习构建开放式深度研究模型

Yi Yao, He Zhu, Piaohong Wang, Jincheng Ren, Xinlong Yang, Qianben Chen, Xiaowan Li, Dingfeng Shi, Jiaxian Li, Qiexiang Wang, Sinuo Wang, Xinpeng Liu, Jiaqi Wu, Minghao Liu, Wangchunshu Zhou

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(title);AI agent(abstract)

AI总结 O-Researcher通过多智能体蒸馏和智能体强化学习,构建开放式深度研究模型,实现开源模型在多个基准上的性能提升。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04170 2026-01-08 cs.AI 89%

Agent Drift: Quantifying Behavioral Degradation in Multi-Agent LLM Systems Over Extended Interactions

智能体漂移:多智能体大语言模型系统在长时间交互中的行为退化量化

Abhishek Rath

机构 * Independent Researcher(独立研究者)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 本研究提出智能体漂移概念,通过理论框架和量化指标,探讨多智能体系统在长时间交互中的行为退化问题,并提出缓解策略以提升系统稳定性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16203 2026-01-08 cs.MA cs.AI 89%

Computing Universal Plans for Partially Observable Multi-Agent Routing Using Answer Set Programming

使用答案集编程计算部分可观测多智能体路由的通用计划

Fengming Zhu, Fangzhen Lin

机构 * Department of Computer Science(计算机科学系) Engineering Hong Kong University of Science(工程 香港理工大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文提出基于答案集编程的系统,用于计算部分可观测多智能体路由问题的通用计划,通过自定义动作偏好实现高效策略。

Comments In Proceedings ICLP 2025, arXiv:2601.00047

Journal ref EPTCS 439, 2026, pp. 143-166

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15755 2026-01-08 cs.AI cs.SE 89%

Multi-Agent LLM Orchestration Achieves Deterministic, High-Quality Decision Support for Incident Response

多智能体大语言模型协调实现确定性、高质量的事件响应决策支持

Philip Drammeh

机构 * Philip Drammeh, M.Eng(菲利普·德拉梅, 工程硕士)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 多智能体大语言模型协调显著提升事件响应的确定性和质量,实现100%可操作建议率,为生产环境提供可靠决策支持。

Comments 10 pages, 4 tables. v2: Expanded limitations, added threats to validity, clarified agent definition, added reproducibility notes, updated Phase 2 timeline with current models (GPT-5.2, Claude Sonnet 4.5, Llama 3.3 70B). No changes to experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03671 2026-01-08 cs.CL cs.LG 88%

NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models

NeuronScope:一种用于解释语言模型中多义神经元的多智能体框架

Weiqi Liu, Yongliang Miao, Haiyan Zhao, Yanguang Liu, Mengnan Du

机构 * Wuhan University(武汉大学) Hong Kong Baptist University(香港 Baptist大学) New Jersey Institute of Technology(新泽西理工学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL、cs.LG

AI总结 NeuronScope通过多智能体框架迭代优化神经元解释,揭示语言模型中隐藏的多义性并提升解释的激活相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03451 2026-01-08 stat.ML cs.AI cs.LG 88%

Microeconomic Foundations of Multi-Agent Learning

多代理学习的微观经济学基础

Nassim Helou

机构 * Harrisburg University(哈里斯堡大学) Harrisburg, USA(美国哈里斯堡) Thatch, New York, USA(美国纽约泰奇)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种两阶段激励机制,通过研究委托-代理互动,在马尔可夫决策过程中实现亚线性社会福利遗憾,从而在渐近上最优,突显激励意识设计在市场和保险中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03301 2026-01-08 cs.MA cs.AI 88%

PC2P: Multi-Agent Path Finding via Personalized-Enhanced Communication and Crowd Perception

PC2P:通过个性化增强通信与人群感知进行多智能体路径寻找

Guotao Li, Shaoyun Xu, Yuexing Hao, Yang Wang, Yuhui Sun

机构 * Institute of Microelectronics of the Chinese Academy of Sciences(中国科学院微电子研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 PC2P通过个性化增强通信与人群感知方法,提升多智能体路径寻找在复杂环境中的协同与扩展能力。

Comments 8 pages,7 figures,3 tables,Accepted to IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14803 2026-01-08 cs.CY cs.AI 88%

OnlineMate: An LLM-Based Multi-Agent Companion System for Cognitive Support in Online Learning

OnlineMate: 基于大语言模型的多智能体伴侣系统用于在线学习中的认知支持

Xian Gao, Zongyun Zhang, Ting Liu, Yuzhuo Fu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 OnlineMate通过基于LLM的多智能体系统,结合理论思维,为在线学习提供个性化认知支持,提升学习深度与情感参与。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01211 2026-01-08 cs.CR cs.AI cs.MA 88%

Web Fraud Attacks Against LLM-Driven Multi-Agent Systems

针对基于大语言模型的多智能体系统 的网络欺诈攻击

Dezhang Kong, Hujin Peng, Yilun Zhang, Lele Zhao, Zhenhua Xu, Shi Lin, Changting Lin, Meng Han

机构 * Zhejiang University(浙江大学) Changsha University of Science and Technology(长沙理工大学) Purdue University(普渡大学) University of California San Diego(加州大学圣地亚哥分校) Zhejiang Gongshang University(浙江工商大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出了一种针对基于大语言模型的多智能体系统的新攻击类型,通过网络链接的独特结构欺骗系统,展示了其在不同架构中的破坏潜力及逃避优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01193 2026-01-08 eess.SY cs.SY 88%

On Game based Distributed Approach for General Multi-agent Optimal Coverage with Application to UAV Networks

基于游戏的分布式方法用于一般多智能体最优覆盖问题及其在无人机网络中的应用

Zixin Feng, Wenchao Xue, Yifen Mu, Ming Wei, Bin Meng, Wei Cui

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出基于游戏的分布式方法,用于解决多智能体系统的大规模最优覆盖问题,通过局部信息算法实现高效收敛,应用于无人机网络覆盖优化,具有更高的计算效率和更快的收敛速度。

Comments 11 pages,11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03328 2026-01-08 cs.MA 88%

LLM-Enabled Multi-Agent Systems: Empirical Evaluation and Insights into Emerging Design Patterns & Paradigms

基于大语言模型的多智能体系统:对新兴设计模式与范式的实证评估与洞察

Harri Renney, Maxim N Nethercott, Nathan Renney, Peter Hayes

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文通过实证评估,探讨了基于大语言模型的多智能体系统在不同领域中的应用效果,揭示了新兴设计模式与范式的优劣及改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04034 2026-01-08 cs.CR cs.AI 84%

HoneyTrap: Deceiving Large Language Model Attackers to Honeypot Traps with Resilient Multi-Agent Defense

HoneyTrap: 通过坚韧的多智能体防御欺骗大语言模型攻击者以诱捕陷阱

Siyuan Li, Xi Lin, Jun Wu, Zehao Liu, Haoyu Li, Tianjie Ju, Xiang Chen, Jianhua Li

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI

AI总结 HoneyTrap通过多智能体协作防御机制,有效降低大语言模型劫持攻击的成功率,提升防御效率与资源消耗效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03777 2026-01-08 stat.ME cs.SY eess.SY 83%

Multi-agent Optimization of Non-cooperative Multimodal Mobility Systems

非合作多模式移动系统的多智能体优化

Md Nafees Fuad Rafi, Zhaomiao Guo

专题命中 多智能体 :agent(title);multi-agent(title)

AI总结 本文提出了一种多智能体优化框架,用于分析非合作多模式移动系统中旅行者和司机的市场互动,通过均衡定价平衡供需并优化系统效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22351 2026-01-08 cs.CV cs.AI 77%

VULCAN: Tool-Augmented Multi Agents for Iterative 3D Object Arrangement

VULCAN:工具增强的多智能体用于迭代3D物体排列

Zhengfei Kuang, Rui Lin, Long Zhao, Gordon Wetzstein, Saining Xie, Sanghyun Woo

机构 * Stanford University(斯坦福大学) Google(谷歌) New York University(纽约大学)

专题命中 多智能体 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 VULCAN通过引入MCP API、视觉工具和多智能体框架,提升了3D物体排列任务中MLLMs的视觉接地能力与迭代处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03436 2026-01-08 astro-ph.IM cs.AI 74%

MARVEL: A Multi Agent-based Research Validator and Enabler using Large Language Models

MARVEL:基于大语言模型的多智能体研究验证器与促进器

Nikhil Mukund, Yifang Luo, Fan Zhang, Lisa Barsotti, Erik Katsavounidis

机构 * MIT Kavli Institute for Astrophysics and Space Research and LIGO Laboratory(麻省理工学院凯斯利天文与空间研究所及LIGO实验室) Massachusetts Institute of Technology(麻省理工学院) State Key Laboratory of Ocean Sensing & Ocean College(海洋传感国家重点实验室) Zhejiang University(浙江大学) NSF AI Institute for Artificial Intelligence and Fundamental Interactions (IAIFI)(国家科学基金会人工智能与基本相互作用研究所) Cambridge, MA, USA(美国马萨诸塞州剑桥市)

专题命中 多智能体 :agent(title);分类 cs.AI

AI总结 MARVEL通过结合快速查询路径和深度搜索模式,为科学领域提供可部署的验证器,其在探测器操作内容上显著优于GPT-4o基线。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03413 2026-01-08 cs.LG cs.MA cs.SY eess.SY 70%

Sensor to Pixels: Decentralized Swarm Gathering via Image-Based Reinforcement Learning

传感器到像素:基于图像强化学习的去中心化蜂群聚集

Yigal Koifman, Eran Iceland, Erez Koifman, Ariel Barel, Alfred M. Bruckstein

机构 * Technion Israel Institute of Technology(技术学院以色列理工学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本研究提出了一种基于图像强化学习的去中心化蜂群聚集方法,通过结构化视觉输入提升多智能体系统的收敛效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 工作流自动化 15 篇

2601.03359 2026-01-08 cs.AI 88%

Enhancing LLM Instruction Following: An Evaluation-Driven Multi-Agentic Workflow for Prompt Instructions Optimization

增强大语言模型指令遵循:一种以评估为导向的多智能体工作流用于提示指令优化

Alberto Purpura, Li Wang, Sahil Badyal, Eugenio Beaufrand, Adam Faulkner

机构 * Card Intelligence, Capital One(卡德智能,Capital One)

专题命中 工作流自动化 :workflow(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 本文提出了一种多智能体工作流,通过评估驱动的方法优化提示指令,提升大语言模型对约束条件的遵循能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03768 2026-01-08 cs.PL 82%

Agentic Proof Automation: A Case Study

代理证明自动化:一个案例研究

Yichen Xu, Martin Odersky

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract)

AI总结 本研究提出代理证明自动化方案,利用LLM代理高效完成证明工程任务,通过案例研究展示其在形式化系统中的应用与成效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23010 2026-01-08 physics.comp-ph cond-mat.mtrl-sci 82%

Masgent: An AI-assisted Materials Simulation Agent

Masgent:一种辅助材料模拟的人工智能代理

Guanghen Liu, Songge Yang, Yu Zhong

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract)

AI总结 Masgent通过自然语言交互简化材料模拟流程,整合DFT、MLP等工具,提升计算效率与可重复性。

Comments 47 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03993 2026-01-08 cs.CV 78%

PosterVerse: A Full-Workflow Framework for Commercial-Grade Poster Generation with HTML-Based Scalable Typography

PosterVerse: 一个用于商业级海报生成的全流程框架,基于HTML的可扩展字体

Junle Liu, Peirong Zhang, Yuyi Zhang, Pengyu Yan, Hui Zhou, Xinyue Zhou, Fengjun Guo, Lianwen Jin

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 PosterVerse通过全流程框架和HTML驱动技术,实现商业级海报的高密度文本渲染与灵活设计。

Journal ref AAAI 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03867 2026-01-08 eess.SY cs.SY 78%

A Systems-Engineered ESP32 DAQ Architecture and FAIR Data Workflow for Small-Scale Wind Turbine Performance Measurement in Tropical Environments

面向热带环境的小型风力发电机性能测量的系统工程数据采集架构与FAIR数据工作流

Asitha Lakruwan Kulasekera

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文提出了一种面向热带环境的小型风力发电机性能测量的系统工程数据采集架构与FAIR数据工作流,通过整合V模型、硬件选择策略、嵌入式固件架构、混合存储设计和数据管理流程,提升数据完整性和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏