arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-27 至 2026-01-27 共收录 10 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 10 篇

2510.25423 2026-01-27 cs.SE 90%

What Challenges Do Developers Face in AI Agent Systems? An Empirical Study on Stack Overflow & GitHub Issues

人工智能代理系统中开发者面临哪些挑战?对Stack Overflow和GitHub问题的实证研究

Ali Asgari, Annibale Panichella, Pouria Derakhshanfar, Mitchell Olsthoorn

专题命中 工具调用 :agent(title,abstract);AI agent(title,abstract);tool use(abstract);planning(abstract)

AI总结 本研究通过分析Stack Overflow和GitHub问题,识别出人工智能代理系统开发中的五大主要挑战,包括环境管理、检索与记忆、协调控制、交互契约及运行时可靠性。

Comments v2: Adds GitHub Issues analysis; expands dataset and taxonomy; updates results and discussion. (15 pages, 5 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18202 2026-01-27 cs.AI 83%

SAGE: Steerable Agentic Data Generation for Deep Search with Execution Feedback

SAGE: 用于深度搜索的可调节代理数据生成与执行反馈

Fangyuan Xu, Rujun Han, Yanfei Chen, Zifeng Wang, I-Hung Hsu, Jun Yan, Vishy Tirumalashetty, Eunsol Choi, Tomas Pfister, Chen-Yu Lee

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 SAGE通过生成高质量、难度可控的深度搜索问题-答案对,提升深度搜索代理的性能和适应性

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24330 2026-01-27 cs.CV 82%

SenseNova-MARS: Empowering Multimodal Agentic Reasoning and Search via Reinforcement Learning

SenseNova-MARS: 通过强化学习赋能多模态代理推理与搜索

Yong Xien Chng, Tao Hu, Wenwen Tong, Xueheng Li, Jiandong Chen, Haojia Yu, Jiefan Lu, Hewei Guo, Hanming Deng, Chengjun Xie, Gao Huang, Dahua Lin, Lewei Lu

机构 * SenseTime Research(商汤科技研究院) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学)

专题命中 工具调用 :agentic(title,abstract);tool-use(abstract)

AI总结 SenseNova-MARS通过强化学习赋能多模态代理推理与搜索,提升视觉-语言模型在复杂视觉任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17548 2026-01-27 cs.CR 78%

Prompt Injection Attacks on Agentic Coding Assistants: A Systematic Analysis of Vulnerabilities in Skills, Tools, and Protocol Ecosystems

针对代理编码助手的提示注入攻击:对技能、工具和协议生态系统漏洞的系统分析

Narek Maloyan, Dmitry Namiot

专题命中 工具调用 :agentic(title,abstract)

AI总结 本文系统分析了代理编码助手的提示注入攻击漏洞,提出三维分类法并揭示防御不足,强调需架构级防护而非碎片化措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18207 2026-01-27 cs.LG cs.AI cs.CL cs.IR 75%

PaperSearchQA: Learning to Search and Reason over Scientific Papers with RLVR

PaperSearchQA: 基于强化学习与验证奖励的学习科学论文搜索与推理

James Burgess, Jan N. Hansen, Duo Peng, Yuhui Zhang, Alejandro Lozano, Min Woo Sun, Emma Lundberg, Serena Yeung-Levy

机构 * Stanford University(斯坦福大学) Chan Zuckerberg Biohub Network(查纳·泽克拜尔生物枢纽网络) KTH Royal Institute of Technology(皇家理工学院)

专题命中 工具调用 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 PaperSearchQA通过训练搜索代理在科学论文中进行搜索与推理,提升技术问答能力,为未来的人工智能科学家系统奠定基础。

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11266 2026-01-27 cs.SE cs.AI 73%

Live API-Bench: 2500+ Live APIs for Testing Multi-Step Tool Calling

Benjamin Elder, Anupama Murthi, Jungkoo Kang, Ankita Rajaram Naik, Kiran Kate, Kinjal Basu, Danish Contractor

机构 * IBM Research AI(IBM人工智能研究实验室)

专题命中 工具调用 :agent(abstract);tool use(abstract);分类 cs.AI、cs.SE

Comments 11+32 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17829 2026-01-27 cs.CL cs.AI 62%

Linguistic and Argument Diversity in Synthetic Data for Function-Calling Agents

合成数据中语言和论证多样性用于功能调用代理

Dan Greenstein, Zohar Karnin, Chen Amiraz, Oren Somekh

机构 * Technion(技术学院) TII(技术研究所)

专题命中 工具调用 :function calling(abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种生成合成数据集的方法,通过优化通用多样性度量标准,提高功能调用代理训练数据的语言和论证多样性,从而提升模型在分布外任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15058 2026-01-27 cs.CR cs.LG cs.SE 62%

LibLMFuzz: LLM-Augmented Fuzz Target Generation for Black-box Libraries

LibLMFuzz: 用于黑盒库的LLM增强模糊目标生成

Ian Hardgrove, John D. Hastings

机构 * The Beacom College of Computer and Cyber Sciences(计算机与网络科学学院) Dakota State University(达科他州立大学)

专题命中 工具调用 :agentic(abstract);分类 cs.LG、cs.SE

AI总结 LibLMFuzz通过结合LLM和轻量级工具链,实现对闭源库的自动模糊测试,生成正确驱动程序并提高覆盖率。

Comments 6 pages, 2 figures, 1 table, 2 listings

Journal ref 2025 IEEE Cyber Awareness and Research Symposium (CARS'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17549 2026-01-27 cs.CR cs.AI 57%

Breaking the Protocol: Security Analysis of the Model Context Protocol Specification and Prompt Injection Vulnerabilities in Tool-Integrated LLM Agents

打破协议:模型上下文协议规范的安全分析及工具集成LLM代理中的提示注入漏洞

Narek Maloyan, Dmitry Namiot

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文分析了模型上下文协议的安全漏洞,提出MCPSec协议扩展以提升安全性,减少攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17231 2026-01-27 cs.RO cs.AR 50%

Real-Time, Energy-Efficient, Sampling-Based Optimal Control via FPGA Acceleration

基于FPGA加速的实时、节能的采样最优控制

Tanmay Desai, Brian Plancher, R. Iris Bahar

机构 * Colorado School of Mines(科罗拉多矿业学院) Barnard College(巴纳德学院) Columbia University(哥伦比亚大学) Dartmouth College(达特茅斯学院)

专题命中 工具调用 :planning(abstract)

AI总结 本文提出一种基于FPGA加速的MPPI控制方法,通过深度流水线和并行性优化,实现嵌入式平台上的高效能和低能耗控制。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏