arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 93944 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5130 篇

2603.13244 2026-03-17 cs.CY cs.AI cs.CE 87%

Agentic AI, Retrieval-Augmented Generation, and the Institutional Turn: Legal Architectures and Financial Governance in the Age of Distributional AGI

代理AI、检索增强生成与制度转向:分布式AGI时代的法律架构与金融治理

Marcel Osmond

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool use(abstract);multi-agent(abstract)

AI总结 本文探讨代理AI与检索增强生成对法律问责和金融市场完整性的影响,主张通过制度设计问题重构对齐机制,以构建合规行为主导的机构环境。

Comments 35 pages, 92 references. Comprehensive interdisciplinary analysis integrating AI safety, mechanism design, legal regulation, and financial governance. Published on Zenodo (https://doi.org/10.5281/zenodo.18711509). Includes industry practitioner perspectives alongside peer-reviewed literature

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22511 2026-03-13 cs.CL 87%

Mock Worlds, Real Skills: Building Small Agentic Language Models with Synthetic Tasks, Simulated Environments, and Rubric-Based Rewards

假世界,真实技能:利用合成任务、模拟环境和评分标准奖励构建小型代理语言模型

Yuanjie Lyu, Chengyu Wang, Lei Shen, Jun Huang, Tong Xu

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool use(abstract);tool-use(abstract)

AI总结 SYNTHAGENT框架通过合成多样化任务和模拟环境,结合评分标准奖励,提升小型LLM在数学、搜索和工具使用等任务中的代理能力。

Comments The first author prefers the more commonly used English name "Yuanjie Lyu" over "Yuan-Jay Lü", so we have updated it; both refer to the same person

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09018 2026-03-11 cs.AI 87%

Meissa: Multi-modal Medical Agentic Intelligence

Meissa:多模态医疗代理智能

Yixiong Chen, Xinyi Bai, Yue Pan, Zongwei Zhou, Alan Yuille

机构 * Johns Hopkins University(约翰霍普金斯大学) Cornell University(康奈尔大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool use(abstract);multi-agent(abstract)

AI总结 Meissa是一种轻量级多模态医疗代理智能模型,通过离线学习策略选择与执行,实现高效医疗决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07264 2026-01-13 cs.CL 87%

The Confidence Dichotomy: Analyzing and Mitigating Miscalibration in Tool-Use Agents

置信二元性:分析和缓解工具使用代理中的校准偏差

Weihao Xuan, Qingcheng Zeng, Heli Qi, Yunze Xiao, Junjue Wang, Naoto Yokoya

专题命中 工具调用 :tool-use(title,abstract);agent(abstract);autonomous agent(abstract);agentic(abstract)

AI总结 本研究提出强化学习框架,通过优化任务准确性和校准,缓解工具使用代理中的校准偏差,提升其在不同领域和环境中的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15718 2025-12-08 cs.AI 87%

ToolMind Technical Report: A Large-Scale, Reasoning-Enhanced Tool-Use Dataset

ToolMind技术报告:一个大规模、推理增强的工具使用数据集

Chen Yang, Ran Le, Yun Xing, Zhenwei An, Zongchao Chen, Wayne Xin Zhao, Yang Song, Tao Zhang

机构 * Nanbeige Lab, BOSS Zhipin(纳米白实验室,BOSS智聘) Gaoling School of Artificial Intelligence, Renmin University of China(甘露人工智能学院,中国人民大学)

专题命中 工具调用 :tool-use(title,abstract);agent(abstract);agentic(abstract);multi-agent(abstract)

AI总结 ToolMind是一个大规模、高质量的工具使用数据集,通过合成和增强数据提升LLM代理的推理能力和工具使用性能。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17995 2025-10-22 cs.AI 87%

FABRIC: Framework for Agent-Based Realistic Intelligence Creation

Abhigya Verma, Seganrasan Subramanian, Nandhakumar Kandasamy, Naman Gupta

机构 * ServiceNow

专题命中 工具调用 :agent(title,abstract);tool use(abstract);tool-use(abstract);agentic(abstract)

Comments 51 Pages, 38 Listings, 5 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04518 2025-09-10 cs.CL 87%

Advancing SLM Tool-Use Capability using Reinforcement Learning

Dhruvi Paprunia, Vansh Kharidia, Pankti Doshi

机构 * Dept. of Computer Engineering MPSTME, NMIMS(计算机工程系 MPSTME、NMIMS)

专题命中 工具调用 :tool-use(title,abstract);AI agent(abstract);tool use(abstract);function calling(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20285 2025-05-28 cs.CL 87%

MaskSearch: A Universal Pre-Training Framework to Enhance Agentic Search Capability

Weiqi Wu, Xin Guan, Shen Huang, Yong Jiang, Pengjun Xie, Fei Huang, Jiuxin Cao, Hai Zhao, Jingren Zhou

机构 * Tongyi Lab , Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);planning(abstract);multi-agent(abstract)

Comments Code is available at https://github.com/Alibaba-NLP/MaskSearch

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12952 2025-03-04 cs.CL 87%

Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning

Mingyang Chen, Haoze Sun, Tianpeng Li, Fan Yang, Hao Liang, Keer Lu, Bin Cui, Wentao Zhang, Zenan Zhou, Weipeng Chen

专题命中 工具调用 :function calling(title,abstract);agent(abstract);planning(abstract);multi-agent(abstract)

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19629 2025-02-28 cs.AI 87%

Agentic Mixture-of-Workflows for Multi-Modal Chemical Search

Tiffany J. Callahan, Nathaniel H. Park, Sara Capponi

专题命中 工具调用 :agentic(title,abstract);agent(abstract);AI agent(abstract);multi-agent(abstract)

Comments PDF includes supplemental material

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06153 2025-02-28 cs.CL 87%

AgentSquare: Automatic LLM Agent Search in Modular Design Space

Yu Shang, Yu Li, Keyu Zhao, Likai Ma, Jiahe Liu, Fengli Xu, Yong Li

机构 * Tsinghua University(清华大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 工具调用 :agent(title,abstract);tool use(abstract);planning(abstract);agentic(abstract)

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14849 2026-06-02 cs.LG cs.AI cs.DC cs.MA 87%

Atomix: Timely, Transactional Tool Use for Reliable Agentic Workflows

Atomix: 用于可靠智能体工作流的及时事务性工具使用

Bardia Mohammadi, Nearchos Potamitis, Lars Klein, Akhil Arora, Laurent Bindschaedler

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) Aarhus University(奥胡斯大学) EPFL(苏黎世联邦理工学院)

专题命中 工具调用 :tool use(title);agentic(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 针对LLM智能体多步工作流中因故障、推测和并发导致的状态不一致问题,提出Atomix系统,通过进度感知事务将效果分组与冲突解决分离,实现可靠提交与回滚。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09730 2026-05-19 cs.LG cs.SE 87%

RubricRefine: Improving Tool-Use Agent Reliability with Training-Free Pre-Execution Refinement

RubricRefine: 通过无训练预执行细化提升工具使用代理的可靠性

Will LeVine, Brendan Evers, Sam Saltwick, Abhay Venkatesh

机构 * Anduril(安杜里尔)

专题命中 工具调用 :agent(title);tool-use(title);tool use(abstract);分类 cs.LG、cs.SE

AI总结 RubricRefine通过预执行语义合同验证,在无执行尝试的情况下提升工具使用代理的可靠性,平均在M3ToolEval上达到0.86,比现有推理时间基线低2.6倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05262 2026-05-08 stat.ML cs.AI cs.LG 87%

Maximizing Rollout Informativeness under a Fixed Budget: A Submodular View of Tree Search for Tool-Use Agentic Reinforcement Learning

在固定预算下最大化 rollout 信息量:一种用于工具使用代理强化学习的子模性视角的树搜索

Yuelin Hu, Zhenbo Yu, Zhengxue Cheng, Wei Liu, Li Song

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Maritime University(上海 Maritime 大学)

专题命中 工具调用 :tool-use(title,abstract);agentic(title);分类 cs.AI、cs.LG

AI总结 本文提出在固定预算下最大化 rollout 信息量的问题,通过将中间状态选择转化为单调子模最大化问题,提出 InfoTree 框架,结合 UUCB 和 ABA,提升性能。

Comments Preprint, 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01714 2026-03-03 cs.LG cs.CL 87%

TopoCurate:Modeling Interaction Topology for Tool-Use Agent Training

TopoCurate:基于交互拓扑的工具使用代理训练建模

Jinluan Yang, Yuxin Liu, Zhengyu Chen, Chengcheng Han, Yueqing Sun, Qi Gu, Hui Su, Xunliang Cai, Fei Wu, Kun Kuang

机构 * Zhejiang University, Hangzhou, China(浙江大学)

专题命中 工具调用 :tool-use(title,abstract);agent(title);分类 cs.CL、cs.LG

AI总结 TopoCurate通过交互拓扑建模提升工具使用代理训练效果,采用双选择机制优化SFT和RL性能。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04566 2026-01-13 cs.AI cs.CL 87%

BackdoorAgent: A Unified Framework for Backdoor Attacks on LLM-based Agents

BackdoorAgent: 一个统一框架用于针对基于LLM的代理的后门攻击

Yunhao Feng, Yige Li, Yutao Wu, Yingshui Tan, Yanming Guo, Yifan Ding, Kun Zhai, Xingjun Ma, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Singapore Management University(新加坡管理大学) Alibaba Group(阿里巴巴集团) Deakin University(德肯大学) Hunan Institute of Advanced Technology(湖南高级技术研究所)

专题命中 工具调用 :agent(abstract);tool use(abstract);tool-use(abstract);planning(abstract)

AI总结 BackdoorAgent提出一个统一框架,分析LLM代理中后门攻击的跨阶段传播和触发器持续性,揭示代理工作流的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04436 2026-08-06 cs.CV 新提交 87%

ToolArtist: Tool-Using Unified Multimodal Models for Agentic Image Generation

ToolArtist:用于智能体图像生成的工具使用统一多模态模型

Jiahao Zhao, Xiaomin Yu, Zhongxiang Sun, Fengwei Teng, Chengwei Qin, Xiaobin Hu, Jun Xu, Shuicheng Yan

机构 * RUC(中国人民大学) HKUST(GZ)(香港科技大学(广州)) NUS(新加坡国立大学) UCD(加州大学戴维斯分校)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool use(abstract);workflow(abstract)

AI总结 本文提出ToolArtist,一种全智能体图像生成模型,通过后训练UMM实现,采用RAD-GRPO方法优化,将完整开放世界图像生成过程置于智能体控制下,性能优于部分控制方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20491 2026-07-27 cs.AI cs.CL cs.LG 版本更新 87%

DFAH-Bench: Benchmarking Observable Agent Instability in Financial Decision-Making

DFAH-Bench:金融决策中可观测智能体不稳定性的基准测试

Raffi Khatchadourian

专题命中 工具调用 :agent(title,abstract);AI agent(abstract);tool use(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究金融决策中智能体行为稳定性,引入DFAH-Bench基准,通过多渠道衡量。发现仅结果一致性不能完全反映稳定性,前沿模型存在决策与工具路径一致性差距,识别出三种行为模式,并开源相关代码和数据。

Comments 15 pages, 3 figures. Code, sanitized replay logs, one-command reproduction (make reproduce-paper), and an interactive results explorer: https://github.com/ibm-client-engineering/output-drift-financial-llms

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21129 2026-06-23 cs.CR cs.OS 新提交 87%

AgenticOS: An Intent-Oriented Secure Operating System Architecture for Autonomous AI Agents

AgenticOS: 面向自主AI代理的意图导向安全操作系统架构

Zhen Zhao, Yu Zhang, Yanpeng Zhu, Jia Wang, Songqiao Tao, Xin Cheng, Jiexin Gao

专题命中 工具调用 :AI agent(title);agent(abstract);autonomous agent(abstract);tool use(abstract)

AI总结 针对LLM驱动代理面临的结构性安全挑战,提出AgenticOS架构,将OS从资源管理器重构为意图过滤器,通过四层架构和意图ABI实现最小权限环境。

Comments 11 pages,5 figures,1 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18789 2026-06-18 eess.SY cs.SY 新提交 87%

PowerAgentBench-SS: A Benchmark for Agentic AI in Power System Steady-State Studies

PowerAgentBench-SS:电力系统稳态研究中智能体AI的基准测试

Costas Mylonas, Magda Foti, Andrea Pomarico, Matheus Duarte, Qian Zhang, Emmanouel Varvarigos

专题命中 工具调用 :agentic(title);agent(abstract);tool-use(abstract);planning(abstract)

AI总结 提出PowerAgentBench-SS基准框架,用于评估LLM智能体在电力系统稳态研究中执行工程工作流的能力,通过工具API、验证预算和风险敏感指标区分智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28480 2026-05-28 eess.AS cs.SD 87%

Audio-Mind: An Auditable Agentic Framework for Audio Understanding

Audio-Mind: 一种可审计的音频理解智能体框架

Yucheng Wang, Jing Peng, Hanqi Li, Chenghao Wang, Wenming Tu, Yu Xi, Zhaokai Sun, Kai Yu, Shuai Wang

机构 * School of Intelligence Science and Technology, Nanjing University, China(南京大学智能科学与技术学院) Department of Computer Science, ETH Zürich, Switzerland(苏黎世联邦理工学院计算机科学系) X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University, China(上海交通大学计算机科学学院X-LANCE实验室) School of Automation Science and Engineering, Xi’an Jiaotong University, China(西安交通大学自动化科学与工程学院) School of Computer Science, Northwestern Polytechnical University, China(西北工业大学计算机科学学院)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool use(abstract);workflow(abstract)

AI总结 提出Audio-Mind框架,通过条件性证据获取动态结合强前端与规划器引导的工具使用,解决音频理解中智能体证据获取的时机问题,在MMAR和MSU-Bench上分别达到80.4%和82.8%的准确率,并生成可审计的推理轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24220 2026-05-26 cs.DC 87%

Polar: Agentic RL on Any Harness at Scale

Polar: 任意框架下的大规模智能体强化学习

Binfeng Xu, Hao Zhang, Shaokun Zhang, Songyang Han, Mingjie Liu, Jian Hu, Shizhe Diao, Zhenghui Jin, Yunheng Zou, Michael Demoret, Jan Kautz, Yi Dong

专题命中 工具调用 :agentic(title);agent(abstract,abstract_cn);tool use(abstract);multi-agent(abstract)

AI总结 提出Polar框架,通过异步回滚和黑盒代理框架实现任意智能体框架上的可扩展强化学习,在软件工程任务中显著提升模型性能。

Comments 17 pages, 6 figures. 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18748 2026-05-19 cs.CV 87%

Aurora: Unified Video Editing with a Tool-Using Agent

Aurora: 一种基于工具使用的统一视频编辑框架

Yongsheng Yu, Ziyun Zeng, Zhiyuan Xiao, Zhenghong Zhou, Hang Hua, Wei Xiong, Jiebo Luo

机构 * MIT-IBM(MIT-IBM研究院) NVIDIA(NVIDIA公司)

专题命中 工具调用 :agent(title,abstract);tool use(abstract);planning(abstract);agentic(abstract)

AI总结 本文提出Aurora框架,通过结合增强的视觉语言模型(VLM)代理和统一视频扩散变换器,解决视频编辑中的文本和视觉不充分问题,提升了视频编辑的灵活性和准确性。

Comments Code: https://github.com/yeates/Aurora

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16178 2026-05-18 physics.ao-ph 87%

Probabilistic Seasonal Streamflow Forecasting Across California's Sierra Nevada Watersheds with Agentic AI

基于代理AI的加州Sierra Nevada流域概率季节性径流预测

Ignacio Lopez-Gomez, Michael P. Brenner, Tapio Schneider

专题命中 工具调用 :agentic(title,abstract);agent(abstract);AI agent(abstract);workflow(abstract)

AI总结 本文提出利用代理AI与自动代码突变系统结合的方法,提升Sierra Nevada流域季节性径流预测的准确性,通过适应性集成三个XGBoost分模型,减少预测误差达29%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14932 2026-05-15 cs.CR 87%

Toward Securing AI Agents Like Operating Systems

向操作系统一样安全地保护AI代理

Lukas Pirch, Micha Horlboge, Patrick Großmann, Syeda Mahnur Asif, Klim Kireev, Thorsten Holz, Konrad Rieck

专题命中 工具调用 :AI agent(title);agent(abstract);autonomous agent(abstract);tool use(abstract)

AI总结 本文通过操作系统视角研究LLM代理的安全性,分析了现有开源代理的攻击面,并提出安全设计建议。

Comments 17 pages, under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06296 2026-04-17 cs.LG cs.AI cs.MA cs.SE 87%

AgentOpt v0.1 Technical Report: Client-Side Optimization for LLM-Based Agent

AgentOpt v0.1 技术报告:基于LLM的代理的客户端优化

Wenyue Hua, Sripad Karne, Qian Xie, Armaan Agrawal, Nikos Pagonas, Kostis Kaffes, Tianyi Peng

机构 * Microsoft Research, AI Frontiers(微软研究院,人工智能前沿) Cornell University(康奈尔大学) Columbia University(哥伦比亚大学)

专题命中 工具调用 :agent(title,abstract);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文提出AgentOpt框架,用于解决LLM代理客户端资源分配问题,通过多种搜索算法优化模型选择和资源分配,提升效率与效果。

Comments 24 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20458 2025-12-29 cs.IR 87%

Laser: Governing Long-Horizon Agentic Search via Structured Protocol and Context Register

激光:通过结构化协议和上下文寄存器治理长 horizon 的代理搜索

Shuting Wang, Qiaolin Xia, Vich Wang, Herberttli, Bobsimons, Zhicheng Dou

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool use(abstract);planning(abstract)

AI总结 Laser通过结构化协议和上下文寄存器稳定并扩展代理搜索,提升多跳问答性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10613 2025-03-14 cs.CV 87%

CoSTA$\ast$: Cost-Sensitive Toolpath Agent for Multi-turn Image Editing

Advait Gupta, NandaKiran Velaga, Dang Nguyen, Tianyi Zhou

专题命中 工具调用 :agent(title);tool use(abstract);planning(abstract);workflow(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07324 2024-02-19 cs.AI cs.CL 87%

Small LLMs Are Weak Tool Learners: A Multi-LLM Agent

Weizhou Shen, Chenliang Li, Hongzhan Chen, Ming Yan, Xiaojun Quan, Hehong Chen, Ji Zhang, Fei Huang

专题命中 工具调用 :agent(title,comments);tool use(abstract);tool-use(abstract);planning(abstract)

Comments On progress, github repo: https://github.com/X-PLUG/Multi-LLM-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12650 2026-07-28 cs.CV cs.AI 版本更新 86%

AutoMat: Enabling Automated Crystal Structure Reconstruction from Microscopy via Agentic Tool Use

AutoMat:通过智能工具使用实现从显微镜图像自动重建晶体结构

Yaotian Yang, Yiwen Tang, Yizhe Chen, Xiao Chen, Jiangjie Qiu, Hao Xiong, Haoyu Yin, Zhiyao Luo, Yifei Zhang, Sijia Tao, Wentao Li, Qinghua Zhang, Yuqiang Li, Wanli Ouyang, Bin Zhao, Xiaonan Wang, Fei Wei

专题命中 工具调用 :agentic(title,abstract);tool use(title);分类 cs.AI

AI总结 研究旨在从有噪声的STEM投影重建晶体结构,提出AutoMat智能控制器,通过闭环验证和多模块组合实现。引入基准数据集评估,结果显示其性能优于现有方法,建立了从微观到原子尺度建模的途径。

Comments The code and dataset are publicly available at https://github.com/yyt-2378/AutoMat and https://huggingface.co/datasets/yaotianvector/STEM2Mat

详情

展开后加载摘要…

URL PDF HTML 收藏