arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-26 至 2026-01-26 共收录 73 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 4 篇

2502.14693 2026-01-26 cs.CL 79%

I-MCTS: Enhancing Agentic AutoML via Introspective Monte Carlo Tree Search

I-MCTS:通过反思蒙特卡洛树搜索增强代理自动机器学习

Zujie Liang, Feng Wei, Wujiang Xu, Lin Chen, Yuxi Qian, Xinhui Wu

机构 * Ant Group(蚂蚁集团) Rutgers University(罗格斯大学)

专题命中 工具调用 :agentic(title,abstract);分类 cs.CL

AI总结 I-MCTS通过反思蒙特卡洛树搜索提升代理AutoML性能,实现4%的绝对性能提升。

Comments EACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12698 2026-01-26 cs.CL 77%

A Two-Stage GPU Kernel Tuner Combining Semantic Refactoring and Search-Based Optimization

一种结合语义重构和基于搜索的优化的双阶段GPU内核调优器

Qiuyi Qu, Yicheng Sui, Yufei Sun, Rui Chen, Xiaofei Zhang, Yuzhi Zhang, Haofeng Wang, Ge Lan

机构 * NanKai University(南开大学) Beijing Institute of Computer Technology and Applications(北京计算机技术与应用研究所)

专题命中 工具调用 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.CL

AI总结 本文提出一种结合语义重构和基于搜索的双阶段GPU内核调优器,通过模板化和参数优化提升内核性能,实现更稳定和高质量的加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16479 2026-01-26 cs.AI 70%

Doc2AHP: Inferring Structured Multi-Criteria Decision Models via Semantic Trees with LLMs

Doc2AHP: 通过语义树利用LLMs推断结构化的多准则决策模型

Hongjia Wu, Shuai Zhou, Hongxin Zhang, Wei Chen

机构 * State Key Laboratory of CAD&CG(计算机辅助设计与图形学国家重点实验室)

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 Doc2AHP通过结合AHP原理和LLMs,实现结构化多准则决策模型的高效推断,提升决策模型的逻辑完整性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16234 2026-01-26 cs.CR 50%

Algorithmic Identity Based on Metaparameters: A Path to Reliability, Auditability, and Traceability

基于元参数的算法身份:可靠性、可审计性与可追溯性的一条路径

Juliao Braga, Percival Henriques, Juliana C. Braga, Itana Stiubiener

专题命中 工具调用 :AI agent(abstract)

AI总结 本文提出通过DOI标识算法以提升AI应用的可靠性、可审计性和可追溯性,探讨了其在多模态LLMs中的应用及加密认证协议。

Comments 6 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 19 篇

2601.16965 2026-01-26 cs.AI 89%

Spatial-Agent: Agentic Geo-spatial Reasoning with Scientific Core Concepts

空间智能体:基于科学核心概念的地理空间推理

Riyang Bao, Cheng Yang, Dazhou Yu, Zhexiang Tang, Gengchen Mai, Liang Zhao

机构 * Emory University(埃默里大学) Rutgers University(罗格斯大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 规划决策 :agent(title,abstract);agentic(title);AI agent(abstract);planning(abstract)

AI总结 Spatial-Agent通过基于空间信息科学的理论框架,实现了可解释的地理空间推理,优于现有方法并产生可执行的工作流。

Comments 15pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16964 2026-01-26 cs.AI 85%

AgentDrive: An Open Benchmark Dataset for Agentic AI Reasoning with LLM-Generated Scenarios in Autonomous Systems

AgentDrive: 一个用于自主系统中基于LLM生成场景的代理AI推理开放基准数据集

Mohamed Amine Ferrag, Abderrahmane Lakas, Merouane Debbah

机构 * Department of Computer and Network Engineering, College of Information Technology, United Arab Emirates University(计算机与网络工程系,信息科技学院,阿联酋大学) Khalifa University of Science and Technology(科技大学)

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI

AI总结 AgentDrive是一个用于自主系统中基于LLM生成场景的代理AI推理开放基准数据集,包含300,000个驾驶场景和100,000个问题的多项选择基准,用于评估和训练自主代理。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16486 2026-01-26 cs.CL cs.AI 84%

Timely Machine: Awareness of Time Makes Test-Time Scaling Agentic

及时机器:时间意识使测试时间缩放成为代理

Yichuan Ma, Linyang Li, Yongkang chen, Peiji Li, Xiaozhe Li, Qipeng Guo, Dahua Lin, Kai Chen

机构 * Fudan University Shanghai AI Laboratory(复旦大学上海人工智能实验室) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 Timely Machine通过重新定义测试时间为实时时钟时间,提出Timely-RL方法提升时间预算意识,以应对高频工具调用和时间受限推理的挑战。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16649 2026-01-26 cs.AI 81%

LUMINA: Long-horizon Understanding for Multi-turn Interactive Agents

LUMINA:多轮交互智能体的长视图理解

Amin Rakhsha, Thomas Hehn, Pietro Mazzaglia, Fabio Valerio Massoli, Arash Behboodi, Tribhuvanesh Orekondy

机构 * University of Toronto(多伦多大学) Qualcomm AI Research(高通人工智能研究)

专题命中 规划决策 :agent(abstract);AI agent(abstract);planning(abstract);agentic(abstract)

AI总结 LUMINA研究通过oracle反事实框架分析多轮交互智能体中各基础能力的重要性,揭示了不同技能在不同环境下的有效性差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16405 2026-01-26 cs.RO cs.LG 79%

Reinforcement Learning-Based Energy-Aware Coverage Path Planning for Precision Agriculture

基于强化学习的能源感知覆盖路径规划用于精准农业

Beining Wu, Zihao Ding, Leo Ostigaard, Jun Huang

机构 * EECS Department, South Dakota State University(南达科他州立大学电子工程与计算机科学系)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出基于SAC强化学习的能源感知覆盖路径规划方法,通过CNN和LSTM优化覆盖效率与能耗,实验显示其在精准农业中覆盖效率和能耗控制优于传统算法。

Comments Accepted by RACS '25: International Conference on Research in Adaptive and Convergent Systems, November 16-19, 2025, Ho Chi Minh, Vietnam. 10 pages, 5 figures

Journal ref Proceedings of the 2025 International Conference on Research in Adaptive and Convergent Systems.(2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16400 2026-01-26 cs.CL 79%

Clarify or Answer: Reinforcement Learning for Agentic VQA with Context Under-specification

澄清或回答:基于上下文不充分的代理视觉问答强化学习

Zongwan Cao, Bingbing Wen, Lucy Lu Wang

机构 * University of Washington(华盛顿大学) Allen Institute for AI(人工智能研究院)

专题命中 规划决策 :agentic(title);agent(abstract);分类 cs.CL

AI总结 CoA通过强化学习解决上下文不充分的视觉问答问题,通过生成聚焦问题澄清歧义,提升问答准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16648 2026-01-26 eess.SY cs.SY 71%

A Cognitive Framework for Autonomous Agents: Toward Human-Inspired Design

自主代理的认知框架:迈向人机协同设计

Francesco Guidi, Jingfeng Shan, Mehrdad Saeidi, Enrico Testi, Elia Favarelli, Andrea Giorgetti, Davide Dardari, Alberto Zanella, Giorgio Li Pira, Francesca Starita, Anna Guerra

专题命中 规划决策 :autonomous agent(title)

AI总结 本文提出一种融合经典条件反射与工具性学习的强化学习框架,以提升自主系统在未知环境中的决策效率与合作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13976 2026-01-26 cs.CV cs.RO 67%

FantasyVLN: Unified Multimodal Chain-of-Thought Reasoning for Vision-Language Navigation

FantasyVLN: 一种统一的多模态链式推理框架用于视觉-语言导航

Jing Zuo, Lingzhou Mu, Fan Jiang, Chengcheng Ma, Mu Xu, Yonggang Qi

机构 * Fantasy AIGC Team(幻想AIGC团队) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 FantasyVLN通过统一的隐式推理框架实现视觉-语言导航的实时高效推理,结合多模态信息提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12856 2026-01-26 cs.AI cs.LG 62%

Mining Citywide Dengue Spread Patterns in Singapore Through Hotspot Dynamics from Open Web Data

通过开放网络数据挖掘新加坡城市登革热传播模式的热点动态

Liping Huang, Gaoxi Xiao, Stefan Ma, Hechang Chen, Shisong Tang, Flora Salim

机构 * Agency for Science, Technology and Research (A*STAR)(科技研究局) Nanyang Technological University(南洋理工大学) Jilin University(吉林大学) Tsinghua University(清华大学) University of New South Wales(新南威尔士大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 通过开放网络数据挖掘新加坡登革热传播模式,利用热点动态预测和验证传播动态,提升公共卫生规划与城市韧性。

Comments 9 pages, 9 figures. It's accepted by WWW 2026 Web4Good Track. To make accessible earlier, authors would like to put it on arxiv before the conference

Journal ref WWW 2026, i.e., The Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10492 2026-01-26 cs.LG cs.AI 62%

UACER: An Uncertainty-Adaptive Critic Ensemble Framework for Robust Adversarial Reinforcement Learning

UACER:一种用于鲁棒对抗强化学习的不确定性自适应批评者集合框架

Jiaxi Wu, Tiantian Zhang, Yuxing Wang, Yongzhe Chang, Xueqian Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 UACER通过多样化批评者集合和时间变化衰减不确定性机制,提升鲁棒对抗强化学习的稳定性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17458 2026-01-26 cs.LG cs.AI 62%

Blood Glucose Control Via Pre-trained Counterfactual Invertible Neural Networks

通过预训练的反事实可逆神经网络实现血糖控制

Jingchi Jiang, Rujia Shen, Boran Wang, Yi Guan

机构 * The Artificial Intelligence Institute(人工智能研究所) Harbin Institute of Technology(哈尔滨工业大学) Faculty of Computing(计算机学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于反事实可逆神经网络的反思强化学习方法,通过预训练模型提升血糖控制的稳定性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16480 2026-01-26 cs.CL 57%

TL-GRPO: Turn-Level RL for Reasoning-Guided Iterative Optimization

TL-GRPO:基于回合的强化学习用于推理引导的迭代优化

Peiji Li, Linyang Li, Handa Sun, Wenjin Mai, Yongkang Chen, Xiaozhe Li, Yue Shen, Yichuan Ma, Yiliu Sun, Jiaxi Cao, Zhishu He, Bo Wang, Xiaoqing Zheng, Zhaori Bi, Xipeng Qiu, Qipeng Guo, Kai Chen, Dahua Lin

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 TL-GRPO通过回合级分组采样优化解决迭代优化任务中的轨迹级强化学习问题,实现更精细的优化效果。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16425 2026-01-26 cs.LG 57%

Bayesian Experimental Design for Model Discrepancy Calibration: A Rivalry between Kullback--Leibler Divergence and Wasserstein Distance

贝叶斯实验设计用于模型偏差校准:KL散度与瓦瑟斯坦距离的较量

Huchen Yang, Xinghao Dong, Jin-Long Wu

机构 * Department of Mechanical Engineering, University of Wisconsin–Madison, Madison, WI 53706(机械工程系,威斯康星大学麦迪逊分校,麦迪逊,WI 53706)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文比较了KL散度与瓦瑟斯坦距离在贝叶斯实验设计中的应用,发现KL散度在无模型偏差时收敛更快,而瓦瑟斯坦距离在存在模型偏差时更稳健。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16394 2026-01-26 cs.CV cs.AI 57%

ResAgent: Entropy-based Prior Point Discovery and Visual Reasoning for Referring Expression Segmentation

ResAgent:基于熵的先验点发现与视觉推理的指称表达分割

Yihao Wang, Jusheng Zhang, Ziyi Tang, Keze Wang, Meng Yang

机构 * Sun Yat-sen University(中山大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 ResAgent通过熵引导的点发现和视觉推理方法,提升指称表达分割的准确性与效率。

Comments 23 pages, 7gigures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16378 2026-01-26 cs.CV cs.AI q-bio.NC 57%

Cognitively-Inspired Tokens Overcome Egocentric Bias in Multimodal Models

具有认知启发的标记克服了多模态模型中的自我中心偏差

Bridget Leonard, Scott O. Murray

机构 * Department of Psychology University of Washington(心理学系华盛顿大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本研究通过引入视角标记,提升多模态模型在空间推理任务中的表现,实现更人样的空间认知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14973 2026-01-26 cs.RO cs.AI 57%

HumanDiffusion: A Vision-Based Diffusion Trajectory Planner with Human-Conditioned Goals for Search and Rescue UAV

HumanDiffusion:一种基于视觉的扩散轨迹规划器,用于搜索与救援无人机的人类条件目标

Faryal Batool, Iana Zhura, Valerii Serpiva, Roohan Ahmed Khan, Ivan Valuev, Issatay Tokmurziyev, Dzmitry Tsetserukou

机构 * Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 HumanDiffusion通过基于视觉的扩散规划实现无人机在紧急情况中的人类意识导航,具备轻量级、高安全性和高效率的特点。

Comments This paper has been accepted at HRI, Late Breaking Report, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09631 2026-01-26 cs.CL 57%

LLMs Got Rhythm? Hybrid Phonological Filtering for Greek Poetry Rhyme Detection and Generation

LLMs Got Rhythm? 希腊诗歌押韵检测与生成的混合语音过滤

Stergios Chatzikyriakidis, Anastasia Natsina

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 本文提出混合语音学算法与LLMs结合,解决希腊诗歌押韵检测与生成问题,通过验证循环提升性能至73.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05092 2026-01-26 cs.LG 57%

Task Aware Dreamer for Task Generalization in Reinforcement Learning

面向任务泛化的任务感知梦者

Chengyang Ying, Xinning Zhou, Zhongkai Hao, Hang Su, Songming Liu, Dong Yan, Jun Zhu

机构 * Department of Computer Science and Technology(计算机科学与技术系) Beijing National Research Center for Information Science and Technology(北京信息科学国家研究中心) Tsinghua-Bosch Joint Center for Machine Learning, Institute for Artificial Intelligence(清华大学-博世联合机器学习中心,人工智能研究院) Tsinghua University(清华大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出任务感知梦者(TAD)方法,通过整合奖励引导的特征提升强化学习中任务泛化能力,尤其在高任务分布相关性任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16973 2026-01-26 cs.CV 50%

VisGym: Diverse, Customizable, Scalable Environments for Multimodal Agents

VisGym: 多模态代理的多样化、可定制化、可扩展环境

Zirui Wang, Junyi Zhang, Jiaxin Ge, Long Lian, Letian Fu, Lisa Dunlap, Ken Goldberg, XuDong Wang, Ion Stoica, David M. Chan, Sewon Min, Joseph E. Gonzalez

专题命中 规划决策 :planning(abstract)

AI总结 VisGym通过多样化环境评估多模态代理在多步视觉决策中的表现,揭示模型在长上下文处理和视觉化任务中的局限性。

Comments Project page: https://visgym.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多智能体 13 篇

2601.16280 2026-01-26 cs.AI 89%

When Agents Fail to Act: A Diagnostic Framework for Tool Invocation Reliability in Multi-Agent LLM Systems

当代理人失败时:多代理LLM系统工具调用可靠性的诊断框架

Donghao Huang, Gauri Malwe, Zhaoxia Wang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);tool-use(abstract);分类 cs.AI

AI总结 本文提出了一种多代理LLM系统工具调用可靠性的诊断框架,通过大数据分析评估程序可靠性,发现工具初始化故障是小模型的主要瓶颈,而qwen2.5:32b在性能上接近GPT-4.1。

Comments Accepted for publication in 2026 The 9th International Conference on Artificial Intelligence and Big Data (ICAIBD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16489 2026-01-26 cs.SE cs.AI cs.CL 89%

EvoConfig: Self-Evolving Multi-Agent Systems for Efficient Autonomous Environment Configuration

EvoConfig:用于高效自主环境配置的自演化多智能体系统

Xinshuai Guo, Jiayi Kuang, Linyue Pan, Yinghui Li, Yangning Li, Hai-Tao Zheng, Ying Shen, Di Yin, Xing Sun

机构 * Tsinghua University(清华大学) Sun-Yat Sen University(孙逸人大学) Tencent Youtu Lab(腾讯优图实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 EvoConfig通过自演化多智能体系统提升自主环境配置效率,实现更高成功率和更强调试能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16886 2026-01-26 cs.AI 88%

MAGE-KT: Multi-Agent Graph-Enhanced Knowledge Tracing with Subgraph Retrieval and Asymmetric Fusion

MAGE-KT:多智能体图增强的知识追踪与子图检索及非对称融合

Chi Yu, Hongyu Yuan, Zhiyi Duan

机构 * Department of Computer Science, Inner Mongolia University, Hohhot, China(内蒙古大学计算机科学系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 MAGE-KT通过多智能体图增强和非对称融合模块,提升知识追踪中学生与知识概念间关系的准确性及预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01238 2026-01-26 cs.AI 88%

Towards Open-World Retrieval-Augmented Generation on Knowledge Graph: A Multi-Agent Collaboration Framework

面向知识图谱的开放世界检索增强生成:一种多智能体协作框架

Jiasheng Xu, Mingda Li, Yongqiang Tang, Peijie Wang, Wensheng Zhang

机构 * School of Computer Science and Cyber Engineering(计算机科学与网络工程学院) Guangzhou University(广州大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 AnchorRAG通过多智能体协作框架,在无需预定义锚实体的情况下提升开放世界检索增强生成的鲁棒性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16835 2026-01-26 cs.GT 88%

Multi-Agent Non-Discriminatory Contracts

多智能体非歧视合同

Ke Ding, Bo Li, Ankang Sun

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文研究多智能体合同中委托人效用最大化与支付平等之间的权衡,提出非歧视价格的界并分析其与非歧视程度的关系。

Comments 22 pages, submitted to IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12492 2026-01-26 eess.SY cs.RO cs.SY 88%

Density-Driven Multi-Agent Coordination for Efficient Farm Coverage and Management in Smart Agriculture

基于密度的多智能体协调:用于智能农业高效耕作与管理的高效覆盖

Sungjun Seo, Kooktae Lee

机构 * Department of Mechanical Engineering, New Mexico Institute of Mining and Technology(机械工程系,新墨西哥矿业与技术研究院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出基于密度的最优控制框架,用于智能农业中高效覆盖与管理,通过非均匀资源分配减少化学物质使用,提升作业效率与可持续性。

Comments Author Accepted Manuscript (AAM) of a paper accepted for publication in the IEEE Transactions on Control Systems Technology (TCST)

Journal ref IEEE Transactions on Control Systems Technology, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16392 2026-01-26 cs.SE 86%

Toward Agentic Software Project Management: A Vision and Roadmap

迈向代理软件项目管理:愿景与路线图

Lakshana Iruni Assalaarachchi, Zainab Masood, Rashina Hoda, John Grundy

专题命中 多智能体 :agentic(title,abstract);agent(abstract,comments);multi-agent(abstract);分类 cs.SE

AI总结 本文提出了一种基于多代理系统的代理项目经理框架,旨在提升软件项目管理效率,并探讨了人类项目经理角色的演变及新技能需求。

Comments This version is the author's preprint of the article accepted for AGENT workshop at ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏