arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-21 至 2026-01-21 共收录 22 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 22 篇

2508.17281 2026-01-21 cs.CL 91%

From Language to Action: A Review of Large Language Models as Autonomous Agents and Tool Users

从语言到行动:大型语言模型作为自主代理和工具使用者的综述

Sadia Sultana Chowa, Riasad Alvi, Subhey Sadi Rahman, Md Abdur Rahman, Mohaimenul Azam Khan Raiaan, Md Rafiqul Islam, Mukhtar Hussain, Sami Azam

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Faculty of Science and Technology(科学与技术学院)

专题命中 工具调用 :autonomous agent(title,abstract);tool use(title,abstract);agent(abstract);planning(abstract)

AI总结 本文综述了大型语言模型作为自主代理和工具使用者的发展,探讨了其架构设计、认知机制及未来研究方向。

Comments Submitted to Artificial Intelligence Review for peer review

Journal ref Artif. Intell. Rev. (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12449 2026-01-21 cs.CR cs.AI 85%

AgenTRIM: Tool Risk Mitigation for Agentic AI

AgenTRIM:代理AI的工具风险缓解

Roy Betser, Shamik Bose, Amit Giloni, Chiara Picardi, Sindhu Padakandla, Roman Vainshtein

机构 * Fujitsu Research of Europe (FRE)(富士通欧洲研究(FRE)) Fujitsu Research of India Pvt. Ltd. (FRIPL)(富士通印度私人有限公司(FRIPL))

专题命中 工具调用 :agentic(title);agent(abstract);AI agent(abstract);tool use(abstract)

AI总结 AgenTRIM通过离线和在线阶段检测并缓解代理AI中工具驱动的风险,减少攻击成功率同时保持任务性能。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11893 2026-01-21 cs.CR 85%

Taming Various Privilege Escalation in LLM-Based Agent Systems: A Mandatory Access Control Framework

驯服各种基于大语言模型的代理系统中的特权提升:一种强制访问控制框架

Zimo Ji, Daoyuan Wu, Wenyuan Jiang, Pingchuan Ma, Zongjie Li, Yudong Gao, Shuai Wang, Yingjiu Li

专题命中 工具调用 :agent(title,abstract);tool use(abstract);multi-agent(abstract)

AI总结 本文提出SEAgent框架,通过强制访问控制解决LLM代理系统中的特权提升问题,有效阻止攻击并保持低误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01576 2026-01-21 cs.IR cs.AI cs.CL 81%

OpenNovelty: An LLM-powered Agentic System for Verifiable Scholarly Novelty Assessment

OpenNovelty: 一种基于大语言模型的代理系统,用于可验证的学术新颖性评估

Ming Zhang, Kexin Tan, Yueyuan Huang, Yujiong Shen, Chunchun Ma, Li Ju, Xinran Zhang, Yuhui Wang, Wenqing Jing, Jingyi Deng, Huayu Sha, Binze Hu, Jingqi Tong, Changhao Jiang, Yage Geng, Yuankai Ying, Yue Zhang, Zhangyue Yin, Zhiheng Xi, Shihan Dou, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学) Claremont McKenna College(克莱蒙特麦肯纳学院)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 OpenNovelty通过基于大语言模型的代理系统,提供可验证的学术新颖性评估,提升同行评审的公平性和证据支持性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11958 2026-01-21 q-fin.GN q-fin.PM q-fin.TR 78%

Autonomous Market Intelligence: Agentic AI Nowcasting Predicts Stock Returns

自主市场智能:代理AI现在预测股票回报

Zefeng Chen, Darcy Pu

专题命中 工具调用 :agentic(title,abstract)

AI总结 该研究利用自主AI预测股票回报,发现AI在识别顶级赢家方面具有选股能力,但扩展范围会稀释收益,且低排名股票回报与市场无异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11540 2026-01-21 cs.HC 75%

Exploring General-Purpose Autonomous Multimodal Agents for Pathology Report Generation

探索通用型自主多模态代理用于病理报告生成

Marc Aubreville, Taryn A. Donovan, Christof A. Bertram

专题命中 工具调用 :agent(abstract);tool use(abstract);agentic(abstract)

AI总结 研究探索通用型自主多模态代理在病理报告生成中的应用,发现其在无额外信息时诊断准确率较低,但提供形态学描述时表现更佳,但仍不及人类专家。

Comments 6 pages, 1 figure, accepted paper for BVM 2026

Journal ref BVM 2026, https://bvm-conf.org

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12762 2026-01-21 cs.SE cs.AI 73%

Teaching LLMs to Learn Tool Trialing and Execution through Environment Interaction

通过环境交互教授LLMs学习工具尝试与执行

Xingjie Gao, Pengcheng Huang, Zhenghao Liu, Yukun Yan, Shuo Wang, Zulong Chen, Chen Qian, Ge Yu, Yu Gu

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Alibaba Group(阿里巴巴集团) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

专题命中 工具调用 :tool use(abstract);planning(abstract);分类 cs.AI、cs.SE

AI总结 ToolMaster通过环境交互主动学习工具使用,提升LLMs在新工具上的泛化与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12701 2026-01-21 cs.RO cs.CG 71%

RPT*: Global Planning with Probabilistic Terminals for Target Search in Complex Environments

RPT*: 带概率终端的全局规划用于复杂环境中的目标搜索

Yunpeng Lyu, Chao Cao, Ji Zhang, Howie Choset, Zhongqiang Ren

机构 * Global College, Shanghai Jiao Tong University(上海交通大学全球学院) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 工具调用 :planning(title)

AI总结 RPT*通过动态规划和新启发式方法解决复杂环境中的目标搜索问题,实现最优路径规划与高效探索的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14246 2026-01-21 cs.AI 70%

Mxplainer: Explain and Learn Insights by Imitating Mahjong Agents

Mxplainer: 通过模仿麻将代理解释和学习洞察

Lingfeng Li, Yunlong Lu, Yongyi Wang, Qifan Zheng, Wenxin Li

机构 * Peking University, Beijing 100871, China(北京大学)

专题命中 工具调用 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 Mxplainer通过模仿麻将代理,利用参数化搜索算法学习并解释黑箱代理的决策过程,提升动作预测准确率和可解释性。

Comments https://doi.org/10.3390/a18120738

Journal ref Algorithms 2025, 18(12), 738

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21486 2026-01-21 cs.AI 70%

Hypothesis Generation via LLM-Automated Language Bias for ILP

通过LLM自动语言偏见进行假设生成

Yang Yang, Jiemin Wu, Yutao Yue

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出通过LLM自动设计语言偏见,结合ILP求解器生成可解释的逻辑规则,提升假设生成的性能和鲁棒性。

Comments accepted by AAAI 2026 Bridge LMReasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12272 2026-01-21 cs.CV 67%

AgenticPruner: MAC-Constrained Neural Network Compression via LLM-Driven Strategy Search

AgenticPruner: 通过LLM驱动的策略搜索实现MAC约束的神经网络压缩

Shahrzad Esmat, Mahdi Banisharif, Ali Jannesari

机构 * Iowa State University(爱荷华州立大学)

专题命中 工具调用 :agent(abstract);workflow(abstract)

AI总结 AgenticPruner通过LLM驱动策略搜索实现MAC约束的神经网络压缩,通过三个专门代理协调优化,提升收敛成功率并实现精确的MAC预算控制。

Comments 38 pages, 2 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13564 2026-01-21 cs.LG cs.AI physics.chem-ph q-bio.BM 62%

Multi-objective fluorescent molecule design with a data-physics dual-driven generative framework

具有数据-物理双驱生成框架的多目标荧光分子设计

Yanheng Li, Zhichen Pu, Lijiang Yang, Zehao Zhou, Yi Qin Gao

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 LUMOS通过结合数据与物理驱动的生成框架,实现了多目标荧光分子的高效反向设计与优化。

Comments Total 43 pages: 32 pages Main Text + 11 pages SI

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13384 2026-01-21 cs.SE cs.CL 62%

From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning

从补全到编辑:通过搜索和替换指令微调解锁上下文感知的代码填充

Jiajun Zhang, Zeyu Cui, Jiaxi Yang, Lei Zhang, Yuheng Jing, Zeyao Ma, Tianyi Bai, Zilei Wang, Qiang Liu, Liang Wang, Binyuan Hui, Junyang Lin

机构 * USTC(University of Science and Technology of China) Alibaba Group(阿里巴巴集团) CASIA(Chinese Academy of Sciences Institute of Automation) SIAT(Institute of Automation, Chinese Academy of Sciences)

专题命中 工具调用 :agentic(abstract);分类 cs.CL、cs.SE

AI总结 通过搜索和替换指令微调,SRI框架实现了上下文感知的代码填充,提升了补全性能并保持低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20156 2026-01-21 cs.CL cs.AI cs.SD eess.AS 62%

Fun-Audio-Chat Technical Report

Fun-Audio-Chat 技术报告

Tongyi Fun Team, Qian Chen, Luyao Cheng, Chong Deng, Xiangang Li, Jiaqing Liu, Chao-Hong Tan, Wen Wang, Junhao Xu, Jieping Ye, Qinglin Zhang, Qiquan Zhang, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 工具调用 :function calling(abstract);分类 cs.AI、cs.CL

AI总结 Fun-Audio-Chat通过双分辨率语音表示和核心鸡尾酒训练,解决语音-文本模型的时间分辨率不匹配和灾难性遗忘问题,实现高效且高质量的音频理解与生成。

Comments Authors are listed in alphabetical order, 21 pages, open-source at https://github.com/FunAudioLLM/Fun-Audio-Chat

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13075 2026-01-21 cs.LG cs.AI 62%

METIS: Mentoring Engine for Thoughtful Inquiry & Solutions

METIS:面向深入探究与解决方案的导师引擎

Abhinav Rajeev Kumar, Dhruv Trehan, Paras Chopra

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 METIS通过工具增强和阶段意识功能,帮助本科生从想法发展到论文,优于GPT-5和Claude Sonnet 4.5,在文档基础阶段表现更佳。

Comments 12 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11560 2026-01-21 cs.IR cs.AI cs.LG 62%

DeepEvidence: Empowering Biomedical Discovery with Deep Knowledge Graph Research

DeepEvidence: 通过深度知识图谱研究赋能生物医学发现

Zifeng Wang, Zheng Chen, Ziwei Yang, Xuan Wang, Qiao Jin, Yifan Peng, Zhiyong Lu, Jimeng Sun

机构 * Keiji AI Institute of Scientific and Industrial Research, Osaka University(大阪大学科学工业研究所) Bioinformatics Center, Institute for Chemical Research, Kyoto University(京都大学化学研究所生物信息中心) Division of Intramural Research, National Library of Medicine, National Institutes of Health(国家卫生研究院生物医学图书馆内部研究部) Department of Population Health Sciences, Weill Cornell Medicine(韦尔·科恩医学中心流行病学与健康科学系) School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机与数据科学学院)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 DeepEvidence通过深度知识图谱研究框架,系统化地连接异构生物医学资源,提升科学发现的效率和证据综合能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26854 2026-01-21 cs.AI cs.LG 62%

Inverse Knowledge Search over Verifiable Reasoning: Synthesizing a Scientific Encyclopedia from a Long Chains-of-Thought Knowledge Base

反向知识搜索与可验证推理:从长推理链知识库合成科学百科全书

Yu Li, Yuan Huang, Tao Wang, Caiyu Fan, Xiansheng Cai, Sihan Hu, Xinzijian Liu, Cheng Shi, Mingjun Xu, Zhen Wang, Yan Wang, Xiangqi Jin, Tianhan Zhang, Linfeng Zhang, Lei Wang, Youjin Deng, Pan Zhang, Weijie Sun, Xinyu Li, Weinan E, Linfeng Zhang, Zhiyuan Yao, Kun Chen

机构 * Lanzhou Center for Theoretical Physics, Key Laboratory of Theoretical Physics of Gansu Province, Key Laboratory of Quantum Theory and Applications of MoE, Gansu Provincial Research Center for Basic Disciplines of Quantum Physics(兰州理论物理中心、甘肃省理论物理重点实验室、教育部量子理论与应用重点实验室、甘肃省量子物理基础学科研究省重点中心) Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所) DP Technology(DP技术) Institute of Physics, Chinese Academy of Sciences(中国科学院物理研究所) Département d’Informatique, École normale supérieure(巴黎高等师范大学计算机系)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于长推理链知识库的反向知识搜索方法,通过生成可验证的科学百科全书,实现了跨领域科学合成。

Comments 43 pages, 4 figures. This work is part of the SciencePedia project (sciencepedia.bohrium.com). Corrected author name spelling

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13778 2026-01-21 cs.HC 50%

Fit Matters: Format-Distance Alignment Improves Conversational Search

格式距离对齐:提升会话搜索体验

Yitian Yang, Yugin Tan, Jung-Tai King, Yang Chen Lin, Yi-Chieh Lee

专题命中 工具调用 :planning(abstract)

AI总结 本文通过实验发现,格式与距离的对齐能有效提升会话搜索体验,减少用户风险感知并提高决策信心及信息可信度。

Comments Accepted to CHI 2026. 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00278 2026-01-21 cond-mat.mtrl-sci 50%

Search for Active and Inactive Ion Insertion Sites in Organic Crystalline Materials

在有机晶体材料中寻找活跃和非活跃离子插入位点

Harshan Reddy Gopidi, Alae Eddine Lakraychi, Abhishek A. Panchal, Yiming Chen, V. S. Chaitanya Kolluru, Jiaqi Wang, Ying Chen, Liu Jue, Kamila Wiaderek, Maria K. Y. Chan, Yan Yao, Pieremanuele Canepa

专题命中 工具调用 :workflow(abstract)

AI总结 本研究提出两种算法,利用基于原理的计算方法,结合SIIE工作流程,准确确定有机晶体中的离子插入位点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12985 2026-01-21 cs.IR 50%

Rules, Resources, and Restrictions: A Taxonomy of Task-Based Information Request Intents

规则、资源与限制:任务导向信息请求意图的分类

Melanie A. Kilian, David Elsweiler

专题命中 工具调用 :planning(abstract)

AI总结 本文提出任务导向信息请求意图的分类,以弥补传统查询方法与AI任务支持需求之间的差距。

Comments 11 pages, 1 figure, to be published in: 2026 ACM SIGIR Conference on Human Information Interaction and Retrieval (CHIIR '26), March 22-26, 2026, Seattle, WA, USA. ACM, New York, NY, USA, 11 pages. https://doi.org/10.1145/3786304.3787863

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12488 2026-01-21 econ.GN cs.CY q-fin.EC 50%

Generative AI as a Non-Convex Supply Shock: Market Bifurcation and Welfare Analysis

生成式人工智能作为非凸供给冲击:市场分裂与福利分析

Yukun Zhang, Tianyang Zhang

专题命中 工具调用 :agent(abstract)

AI总结 本文研究生成式人工智能作为非凸供给冲击对市场结构和福利的影响,揭示其导致市场分裂及福利波动的机制,强调需转向输出侧拥堵管理以优化治理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12123 2026-01-21 cs.DB 50%

Is Quantum Computing Ready for Real-Time Database Optimization?

量子计算是否准备好用于实时数据库优化?

Hanwen Liu, Ibrahim Sabek

专题命中 工具调用 :workflow(abstract)

AI总结 Q2O是首个量子增强型查询优化器,通过量子退火技术实时优化数据库查询。

Comments ICDE 2026 Lightning Talk (42nd IEEE International Conference on Data Engineering)

详情

展开后加载摘要…

URL PDF HTML 收藏