arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-08 至 2026-01-08 共收录 29 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 29 篇

2503.23314 2026-01-08 cs.AI cs.CL cs.LG cs.MA 92%

SPIO: Ensemble and Selective Strategies via LLM-Based Multi-Agent Planning in Automated Data Science

SPIO:基于LLM的多智能体规划的集成与选择策略在自动化数据科学中的应用

Wonduk Seo, Juhyeon Lee, Yanjun Shao, Qingshan Zhou, Seunghyun Lee, Yi Bu

机构 * Enhans Peking University(北京大学) Yale University(耶鲁大学)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 SPIO通过基于LLM的多智能体规划,在自动化数据科学中实现了集成与选择策略,提升了流程的灵活性和准确性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03164 2026-01-08 cs.CL 88%

WebAnchor: Anchoring Agent Planning to Stabilize Long-Horizon Web Reasoning

WebAnchor: 通过锚定代理规划稳定长周期网络推理

Xinmiao Yu, Liwen Zhang, Xiaocheng Feng, Yong Jiang, Bing Qin, Pengjun Xie, Jingren Zhou

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);分类 cs.CL

AI总结 WebAnchor通过两阶段强化学习框架,解决长周期网络推理中规划不稳定的问题,提升任务成功率和工具效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04301 2026-01-08 cs.LG cs.AR 85%

The Cost of Dynamic Reasoning: Demystifying AI Agents and Test-Time Scaling from an AI Infrastructure Perspective

动态推理的成本:从AI基础设施视角解密AI代理与测试时扩展

Jiin Kim, Byeongjun Shin, Jinha Chung, Minsoo Rhu

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.LG

AI总结 本文从AI基础设施视角解密AI代理与测试时扩展,揭示动态推理带来的高成本与可持续性问题,呼吁转向计算高效的代理设计。

Comments Accepted for publication at the 32nd IEEE International Symposium on High-Performance Computer Architecture (HPCA-32), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08930 2026-01-08 cs.GR 85%

How Does a Virtual Agent Decide Where to Look? Symbolic Cognitive Reasoning for Embodied Head Rotation

虚拟代理如何决定看向何处?基于具身头部旋转的符号认知推理

Juyeong Hwang, Seong-Eun Hong, JaeYoung Seon, Hyeongyeop Kang

专题命中 规划决策 :agent(title,abstract);workflow(abstract);multi-agent(abstract)

AI总结 本文提出SCORE框架,通过符号认知推理实现具身头部旋转,结合视觉-语言模型和大语言模型,使虚拟代理能合理预测头部运动及背后动机。

Comments 13 pages, 8 figures. Accepted to SIGGRAPH Asia Conference Papers '25

Journal ref SIGGRAPH Asia Conference Papers '25, December 15-18, 2025, Hongkong

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04191 2026-01-08 cs.RO cs.AI 84%

Embedding Autonomous Agents in Resource-Constrained Robotic Platforms

在资源受限的机器人平台上嵌入自主代理

Negar Halakou, Juan F. Gutierrez, Ye Sun, Han Jiang, Xueming Wu, Yilun Song, Andres Gomez

机构 * Institut für Datentechnik und Kommunikationsnetze, TU Braunschweig(数据技术与通信网络研究所, Braunschweig 技术大学)

专题命中 规划决策 :autonomous agent(title,abstract);agent(abstract,comments);分类 cs.AI;multi-agent(comments)

AI总结 本研究在资源受限的机器人平台上嵌入自主代理,通过AgentSpeak编程实现迷宫探索,展示高效推理过程适用于实时自主操作。

Comments This is an open-access, author-archived version of a manuscript published in European Conference on Multi-Agent Systems 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03287 2026-01-08 cs.CR cs.AI 81%

Automated Post-Incident Policy Gap Analysis via Threat-Informed Evidence Mapping using Large Language Models

通过大语言模型进行威胁感知证据映射的自动事后政策差距分析

Huan Lin Oh, Jay Yong Jun Jie, Mandy Lee Ling Siu, Jonathan Pan

机构 * Nanyang Technological University, Singapore(南洋理工大学)

专题命中 规划决策 :agent(abstract);workflow(abstract);agentic(abstract);multi-agent(abstract)

AI总结 本文提出利用大语言模型进行威胁感知证据映射,实现自动事后政策差距分析,提升网络安全事件审查的效率与可审计性。

Comments 5 pages, 1 figure. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03687 2026-01-08 cs.AI 79%

Personalized Medication Planning via Direct Domain Modeling and LLM-Generated Heuristics

通过直接领域建模和LLM生成的启发式方法实现个性化药物规划

Yonatan Vernik, Alexander Tuisov, David Izhaki, Hana Weitman, Gal A. Kaminka, Alexander Shleyfman

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文通过直接领域建模和LLM生成的启发式方法,提升了个性化药物规划的规模和效率,支持更接近临床应用的实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02757 2026-01-08 cs.AI 79%

LLM Agent Framework for Intelligent Change Analysis in Urban Environment using Remote Sensing Imagery

基于遥感影像的城市环境智能变化分析LLM代理框架

Zixuan Xiao, Jun Ma

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出基于LLM和视觉基础模型的ChangeGPT框架,通过分层结构提升变化检测的智能与适应性,实现在城市环境中的高效变化分析。

Journal ref Automation in Construction 177 (2025) 106341

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03904 2026-01-08 cs.RO 78%

Towards Safe Autonomous Driving: A Real-Time Motion Planning Algorithm on Embedded Hardware

迈向安全的自动驾驶:在嵌入式硬件上的实时运动规划算法

Korbinian Moller, Glenn Johannes Tungka, Lucas Jürgens, Johannes Betz

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种在嵌入式硬件上实时运行的轻量级轨迹规划算法,用于提升自动驾驶系统在故障情况下的安全性和可靠性。

Comments 7 pages, submitted to the IEEE Intelligent Vehicles Symposium (IV 2026), Detroit, MI, United States

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19486 2026-01-08 cs.RO cs.DC 78%

Supercomputing for High-speed Avoidance and Reactive Planning in Robots

为机器人提供高速避障与反应规划的超级计算

Kieran S. Lachmansingh, José R. González-Estrada, Jacob Chisholm, Ryan E. Grant, Matthew K. X. J. Pan

机构 * Ingenuity Labs Research Institute(创新实验室研究机构) Queen’s University(女王大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 SHARP通过HPC实现机器人毫秒级避障与反应规划,展示高并发计算在实时机器人中的可行性及混合控制架构的应用。

Comments Error in the graph size calculation, recalculated and resubmitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03398 2026-01-08 cs.RO 78%

Towards Zero-Knowledge Task Planning via a Language-based Approach

通过语言方法实现零知识任务规划

Liam Merz Hoffmeister, Brian Scassellati, Daniel Rakita

机构 * Department of Computer Science, Yale University(计算机科学系,耶鲁大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出利用大型语言模型实现零知识任务规划,通过分解自然语言指令生成行为树并实时调整,提升任务执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27251 2026-01-08 cs.MA 78%

FinPos: A Position-Aware Trading Agent System for Real Financial Markets

FinPos:一种面向真实金融市场的位置感知交易代理系统

Bijia Liu, Ronghao Dang

专题命中 规划决策 :agent(title,abstract)

AI总结 FinPos提出了一种位置感知的交易代理系统,通过专业信息解读、双代理决策结构和多时间尺度奖励信号,提升对连续仓位的管理能力,实验证明其在真实市场条件下的优越性。

Comments LLM Applications, LLM Agents, Financial Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23412 2026-01-08 cs.AI 77%

MindWatcher: Toward Smarter Multimodal Tool-Integrated Reasoning

MindWatcher:迈向更智能的多模态工具集成推理

Jiawei Chen, Xintian Shen, Lihao Zheng, Zhenwei Shao, Handong Cui, Chaoqun Du, Li Gong, Feng Gu, Xuefeng Hao, Wei He, Jiabang He, Yi Hu, Bin Huang, Shanshan Li, Qizhen Li, Jing Luo, Zide Liu, Xiaobo Liu, Ning Mao, Lifu Mu, Xuhao Pan, Zhiheng Qu, Chang Ren, Xudong Rao, Haoyi Sun, Qian Wang, Shuai Wang, Zhichao Wang, Wei Wang, Lian Wen, Jiqing Zhan, Hongfu Yang, Sheng Yang, Jiajun Yang, Pengfei Yu, Hongyuan Zhang, Bin Zhang, Chunpeng Zhou, Zheng Zhou, Shucheng Zhou, Shuo Xie, Yun Zhu, Hao Ma, Tao Wei, Pan Zhou, Wei Chen

机构 * Li Auto Inc(力汽车公司)

专题命中 规划决策 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 MindWatcher是一种能够自主调用工具并进行多模态推理的智能体,通过高效训练和高质量数据集提升了多步骤决策任务的性能。

Comments Technique Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04060 2026-01-08 cs.AI 70%

ComfySearch: Autonomous Exploration and Reasoning for ComfyUI Workflows

ComfySearch: 为ComfyUI工作流实现自主探索与推理

Jinwei Su, Qizhen Lan, Zeyu Wang, Yinghui Xia, Hairu Wen, Yiqun Duan, Xi Xiao, Tianyu Shi, Yang Jingsong, Lewei He

机构 * ComfyUI

专题命中 规划决策 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 ComfySearch通过验证引导的工作流构建,有效提升ComfyUI工作流的通过率和解决方案率,适用于复杂创意任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02144 2026-01-08 cs.LO 67%

VECSR: Virtually Embodied Common Sense Reasoning System

VECSR:虚拟具身常识推理系统

Alexis R. Tudor, Joaquín Arias, Gopal Gupta

专题命中 规划决策 :agent(abstract);autonomous agent(abstract)

AI总结 本文提出VECSR系统,通过基于答案集编程的s(CASP)推理器,将自主代理任务分解为中层指令并解释选择,提升家庭环境中的可信度与可解释性。

Comments In Proceedings ICLP 2025, arXiv:2601.00047

Journal ref EPTCS 439, 2026, pp. 76-88

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03676 2026-01-08 cs.CL cs.AI 62%

Towards Compositional Generalization of LLMs via Skill Taxonomy Guided Data Synthesis

通过技能分类引导的数据合成实现大语言模型的组合泛化

Yifan Wei, Li Du, Xiaoyan Yu, Yang Feng, Angsheng Li

机构 * State Key Laboratory of Complex & Critical Software Environment, Beihang University(复杂与关键软件环境国家重点实验室,北京航空航天大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Beijing Institute of Technology(北京理工大学) Institute of Computing Technology, CAS(中国科学院计算技术研究所)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 STEPS通过技能分类引导的数据合成提升大语言模型的组合泛化能力。

Comments The code and data for our methods and experiments are available at https://github.com/weiyifan1023/STEPS

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03306 2026-01-08 cs.AI cs.LG 62%

Mastering the Game of Go with Self-play Experience Replay

用自我对战经验回放掌握围棋游戏

Jingbin Liu, Xuechun Wang

机构 * NetEase AI Lab(网易人工智能实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 QZero通过自我对战和非策略经验回放,首次展示了无模型强化学习在掌握围棋中的高效性与可行性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11184 2026-01-08 cs.LG cs.CL 62%

Reinforcement Learning for Tool-Integrated Interleaved Thinking towards Cross-Domain Generalization

强化学习用于工具集成的交叉领域泛化思考

Zhengyu Chen, Jinluan Yang, Teng Xiao, Ruochen Zhou, Luan Zhang, Xiangyu Xi, Xiaowei Shi, Wei Wang, Jinggang Wang

机构 * Meituan(美团) Zhejiang University(浙江大学) Allen Institute for Artificial Intelligence(人工智能算法研究所) City University of Hong Kong(香港城市大学)

专题命中 规划决策 :agent(abstract);分类 cs.CL、cs.LG

AI总结 本文提出RITE方法,通过强化学习和交叉领域工具执行,提升LLM在跨领域推理中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04056 2026-01-08 cs.CL 57%

Bridging the Discrete-Continuous Gap: Unified Multimodal Generation via Coupled Manifold Discrete Absorbing Diffusion

弥合离散-连续鸿沟:通过耦合流形离散吸收扩散实现统一多模态生成

Yuanfeng Xu, Yuhao Chen, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Lab of Big Data Analysis & Processing(广东省大数据分析与处理重点实验室) X-Era AI Lab(X-Era AI实验室)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 CoM-DAD通过耦合流形离散吸收扩散框架,实现离散与连续数据的统一多模态生成,解决多模态对齐与训练稳定性问题。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03977 2026-01-08 cs.LG 57%

Stage-specific cancer survival prediction enriched by explainable machine learning

针对特定阶段的癌症生存预测通过可解释机器学习增强

Parisa Poorhasani, Bogdan Iancu

机构 * Department of Information Technology Faculty of Science and Engineering Åbo Akademi University(信息科技系科学与工程学院阿博阿卡迪米大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文通过可解释机器学习方法,针对不同癌症阶段的生存预测,揭示特征与癌症阶段的交互作用,提升模型透明性和临床应用价值。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00604 2026-01-08 cs.LG 57%

Cycling Race Time Prediction: A Personalized Machine Learning Approach Using Route Topology and Training Load

骑行时间预测:一种基于路线拓扑和训练负荷的个性化机器学习方法

Francisco Aguilera Moreno

机构 * BSc Computer Science (December 2025)(计算机科学学士(2025年12月))

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一种基于路线拓扑和训练负荷的个性化机器学习方法,通过历史数据学习运动员性能模式,以预测骑行时间,实验表明结合体能指标能显著提高预测精度。

Comments 29 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03460 2026-01-08 cs.CV cs.AI 57%

FROST-Drive: Scalable and Efficient End-to-End Driving with a Frozen Vision Encoder

FROST-Drive: 可扩展且高效的端到端驾驶方法,采用冻结的视觉编码器

Zeyu Dong, Yimin Zhu, Yu Wu, Yu Sun

机构 * Stony Brook University(石溪大学) Rutgers University(罗格斯大学) Sunrise Technology Inc.(Sunrise技术公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 FROST-Drive通过冻结预训练视觉编码器,结合适配器和解码器,实现高效端到端驾驶,优于全微调方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03376 2026-01-08 cs.LG 57%

Weather-Aware Transformer for Real-Time Route Optimization in Drone-as-a-Service Operations

考虑天气的变换器用于无人机即服务操作中的实时路线优化

Kamal Mohamed, Lillian Wassim, Ali Hamdi, Khaled Shaban

机构 * Dept. of Computer Science, Qatar University, Doha, Qatar(计算机科学系,卡塔尔大学,多哈)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一种天气感知的变换器框架,用于实时优化无人机即服务操作的路线,通过天气启发式方法提升动态环境下的路由决策效率与安全性。

Comments 2025 IEEE/ACS 22nd International Conference on Computer Systems and Applications (AICCSA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03956 2026-01-08 cs.RO 50%

CoINS: Counterfactual Interactive Navigation via Skill-Aware VLM

基于技能感知的反事实交互导航:通过技能感知视觉语言模型

Kangjie Zhou, Zhejia Wen, Zhiyong Zhuo, Zike Yan, Pengying Wu, Ieng Hou U, Shuaiyang Li, Han Gao, Kang Ding, Wenhan Cao, Wei Pan, Chang Liu

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系) College of Design and Engineering, National University Of Singapore(新加坡国立大学设计与工程学院) Department of Computer Science, The University of Manchester(曼彻斯特大学计算机科学系)

专题命中 规划决策 :planning(abstract)

AI总结 CoINS通过整合技能感知推理与稳健执行,提升机器人在复杂环境中的交互导航能力。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20617 2026-01-08 cs.CV 50%

SpatialTree: How Spatial Abilities Branch Out in MLLMs

SpatialTree: MLLMs中空间能力如何分支扩展

Yuxi Xiao, Longfei Li, Shen Yan, Xinhang Liu, Sida Peng, Yunchao Wei, Xiaowei Zhou, Bingyi Kang

机构 * Zhejiang University(浙江大学) Beijing Jiaotong University(北京交通大学)

专题命中 规划决策 :agentic(abstract)

AI总结 SpatialTree提出了一种受认知科学启发的分层结构,用于评估和提升多模态大语言模型中的空间能力。

Comments webpage: https://spatialtree.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26428 2026-01-08 cs.RO cs.SY eess.SY math.OC 50%

Real-time Velocity Profile Optimization for Time-Optimal Maneuvering with Generic Acceleration Constraints

实时速度剖面优化用于满足通用加速度约束的时间最优 maneuvering

Mattia Piazza, Mattia Piccinini, Sebastiano Taddei, Francesco Biral, Enrico Bertolazzi

专题命中 规划决策 :planning(abstract)

AI总结 FBGA通过前向-后向算法实现高精度快速的时间最优轨迹规划,适用于复杂加速度约束的自动驾驶赛车应用。

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 2, pp. 1674-1681, Feb. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11594 2026-01-08 stat.ME 50%

Rethinking the handling of method failure in comparison studies

重新思考比较研究中方法失败的处理

Milena Wünsch, Moritz Herrmann, Elisa Noltenius, Mattia Mohr, Tim P. Morris, Anne-Laure Boulesteix

专题命中 规划决策 :planning(abstract)

AI总结 本文提出在比较研究中应将方法失败视为多种因素相互作用的结果,并建议采用更现实的处理策略,如回退策略,以提高结果的可靠性。

Journal ref Statistics in Medicine 44 (2025):e70257

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03607 2026-01-08 cs.RO 50%

Locomotion Beyond Feet

超越双脚的运动

Tae Hoon Yang, Haochen Shi, Jiacheng Hu, Zhicong Zhang, Daniel Jiang, Weizhuo Wang, Yao He, Zhen Wu, Yuming Chen, Yifan Hou, Monroe Kennedy, Shuran Song, C. Karen Liu

专题命中 规划决策 :planning(abstract)

AI总结 本文提出Locomotion Beyond Feet系统,通过结合关键帧动画与强化学习,实现人形机器人在复杂地形中的稳健全身运动与泛化能力。

Comments Project website: https://locomotion-beyond-feet.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03449 2026-01-08 cs.RO 50%

FIRE-VLM: A Vision-Language-Driven Reinforcement Learning Framework for UAV Wildfire Tracking in a Physics-Grounded Fire Digital Twin

FIRE-VLM:一种基于视觉-语言驱动的强化学习框架,用于在物理基础火灾数字孪生中无人机火灾跟踪

Chris Webb, Mobin Habibpour, Mayamin Hamid Raha, Ali Reza Tavakkoli, Janice Coen, Fatemeh Afghah

机构 * Clemson University(克莱姆森大学) University of Nevada, Reno(内华达大学拉斯维加斯分校) NSF NCAR(国家科学基金会NCAR)

专题命中 规划决策 :agent(abstract)

AI总结 FIRE-VLM是一种基于视觉-语言模型的强化学习框架,用于在物理基础火灾数字孪生中实现无人机火灾跟踪,通过结合物理术语与VLM语义的奖励设计,提升了火灾检测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏