arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 7434 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 569 篇

2608.02097 2026-08-04 cs.AI cs.IR 新提交 57%

Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents

先获取再探索:面向搜索智能体的持久工作空间上选择与提取解耦

Qi Liu, Yiqun Chen, Zidan Chen, Yan Gao, Yi Wu, Yao Hu, Jiaxin Mao, Fengbin Zhu, Tat-Seng Chua

机构 * Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司) National University of Singapore(新加坡国立大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 该研究针对搜索智能体提出Fetch-then-Explore方法,将页面选择与证据提取解耦,在两个基准测试中提升了智能体的搜索性能,核心是通过持久工作空间实现页面复用与证据累积。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01904 2026-08-04 cs.AI 新提交 57%

CoEvoKG: Co-Evolving Knowledge Graphs with Self-Evolving Search Agents

CoEvoKG:用自演进搜索智能体协同演进知识图谱

Zhaoyang Li, Zenghuang Fu, Qiuyuan Ai, Ping Jiang, Haoyu Wu, Minghui Wu, Chenxu Zhao, Jie Song, Guannan He

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 CoEvoKG框架将知识图谱作为训练任务源与智能体演进的持久证据记忆,联合训练任务生成器与搜索智能体,形成自演进与知识积累闭环,在六个问答基准上提升了三款骨干模型的准确率。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01744 2026-08-04 cs.AI cs.GR 新提交 57%

RL-Lock: Reinforcement Learning for Generating Interlocking Assemblies

RL-Lock:用于生成互锁组件的强化学习

Xuyang Ma, Chaewoon Kim, Haonan Zhang, Rulin Chen, Ziqi Wang, Peng Song

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 针对现有互锁组件生成方法依赖手工启发式、难处理复杂案例的问题,研究人员提出强化学习框架RL-Lock,结合结构化动作分块与MCTS学习,高效生成互锁组件,在复杂场景表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01565 2026-08-04 cs.CL 新提交 57%

DocNavRAG: Document-Structured Graph RAG with Stateful Evidence Construction for Complex Document Question Answering

DocNavRAG:面向复杂文档问答的、具有状态化证据构建能力的文档结构化图RAG

Dongyang Xie, Yao Tian, Hao Zhang, Yifei Yuan, Tieyun Qian, Ming Zhong, Jiawei Jiang, Yuanyuan Zhu

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 工具调用 :agentic(abstract);分类 cs.CL

AI总结 本文提出DocNavRAG,将文档结构组织为可导航图并维护证据状态,在四个文档QA基准上,相比最强基线平均提升答案质量7.8%、上下文充分性17.7%。

Comments 19 pages, 5 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00974 2026-08-04 cs.AI 新提交 57%

Search-GRT: Guided Retrieval Training of Search Agents to Optimize for Complex Question Answering

Search-GRT:面向复杂问答任务优化的搜索智能体引导检索训练

Aounon Kumar, Sudipta Paul, Vivek Kulkarni, Vijay Srinivasan, Srinivas Chappidi

机构 * AI Center-Mountain View, Samsung Electronics(三星电子山景城AI中心)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 针对LLM搜索的奖励稀疏问题,提出GRT方法,通过真实信息限制检索过程,在多跳问答等任务上实现超40%性能提升并提高训练效率。

Comments Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00902 2026-08-04 cs.CL 新提交 57%

Practical Online KV Cache Compaction for LLM Agents: An Empirical Study

面向LLM智能体的实用在线KV缓存压缩:一项实证研究

Yujian Liu, Jiabao Ji, Li An, Rohit Jain, Gungor Polatkan, Siyu Zhu, Shiyu Chang

机构 * UC Santa Barbara(加州大学圣巴巴拉分校) LinkedIn(领英公司)

专题命中 工具调用 :agent(abstract);分类 cs.CL

AI总结 该研究针对LLM智能体的KV缓存瓶颈,实证对比了令牌驱逐与注意力匹配两类在线压缩方法,发现延迟压缩可恢复性能,令牌驱逐在代理不完善时更鲁棒,能大幅压缩KV缓存并提升吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29468 2026-08-03 cs.AI 新提交 57%

Self-Play Meets Skill Evolution: Self-Evolving Search Agents that Pose, Solve, and Remember

自博弈与技能演化:能提出、解决并记忆的自演化搜索智能体

Zenghuang Fu, Zhaoyang Li, Qiuyuan Ai, Haoyu Wu, Minghui Wu, Chenxu Zhao, Ante Wang, Guannan He, Changwei Wang

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本研究提出SESA智能体,通过任务生成与技能记忆的双向循环协同演化,在7个问答基准上较SSP、SkillRL等基线实现准确率提升,且支持无记忆部署与可选推理检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28854 2026-08-03 cs.LG 新提交 57%

An analysis of machine learning approaches for enhancing decision-making in complex discrete choice tasks

用于增强复杂离散选择任务决策的机器学习方法分析

Sheng Lun Christine Cao, Destenie Nock, Alex Davis

专题命中 工具调用 :tool use(abstract);分类 cs.LG

AI总结 本研究分析四种机器学习模型在复杂离散选择任务中学习和预测五类选择规则的性能,发现半参数及非参数模型总体优于参数模型,孪生神经网络在能源政策偏好案例中表现最佳。

Comments Published in Decision Analytics Journal, Dec 16 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27258 2026-07-31 q-bio.GN cs.LG 新提交 57%

PlantBGC: Transformer for Plant BGC Discovery via Label-Free Domain Adaptation and Weak Supervision

PlantBGC:基于无标签领域自适应与弱监督的植物生物合成基因簇发现Transformer

Yuhan Zhao, Nidhi Grover, Zhishan Guo, Ning Sui

机构 * North Carolina State University(北卡罗来纳州立大学)

专题命中 工具调用 :workflow(abstract);分类 cs.LG

AI总结 该研究针对植物BGC标签稀缺问题,提出PlantBGC模型,通过无标签领域自适应与弱监督实现植物BGC的精准发现,提升了已知BGC的恢复率并缩短了基因座长度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28050 2026-07-31 cs.AI 新提交 57%

IndustryForge-27B: A Domain-Enhanced Multimodal Foundation Model for Industrial CAD

IndustryForge-27B:面向工业CAD的领域增强多模态基础模型

Nianchen Deng, Jiaxin Ai, Tao Hu, Shu Zou, Yurui Dong, Siqi Li, Xinyu Cai, Xuemeng Yang, Licheng Wen, Hongbin Zhou, Hairong Zhang, Pinlong Cai, Botian Shi

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 该研究构建基于Qwen3.5-VL-27B的IndustryForge-27B多模态基础模型,整合6个工业CAD子语料库训练,在CAD基准测试中性能远超基础模型与GPT-5.4,可作为工业智能体的通用基础。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27686 2026-07-31 cs.AI 新提交 57%

Evaluating and Pricing Advertisements in AI-Generated Responses

评估和定价AI生成响应中的广告

John L. Turner-Smith, Zimeng Huang, Yuhan Fu, Yihang Zhang, Tonghan Wang

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 针对AI生成响应中广告评估与定价的核心挑战,该研究构建智能体模拟框架生成监督,提炼出高效评估器,实现更优的点击意图预测,还推导了最优支付规则并扩展了广告生成的训练目标。

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26642 2026-07-30 cs.AI 新提交 57%

AlphaSchema: Exploring the Space of Trading Semantics for LLM-Based Alpha Mining

AlphaSchema:探索基于大语言模型(LLM)的阿尔法挖掘的交易语义空间

Jingyang Yi, Jian Yang, Yifei Jin, Yuqi Li, Jian Li

机构 * X-Tech Monash University(莫纳什大学) PandaAI(熊猫AI) IIIS, Tsinghua University(清华大学智能产业研究院(IIIS))

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 AlphaSchema构建并探索结构化交易语义空间,通过解耦探索与实施、结合代理模型平衡探索与利用,在中国股市挖掘出强预测与投资组合表现的因子池,且对LLM选择具鲁棒性。

Comments Initial Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25590 2026-07-29 cs.CL 新提交 57%

PILA: Plug-and-Play Insertion for LLM-native Advertising

PILA:用于大语言模型原生广告的即插即用插入法

Zhaowei Zhang, Yuhan Fu, Yihang Zhang, Xiaohan Liu, Ceyao Zhang, Xiaoyuan Zhang, Yipeng Kang, Tonghan Wang, Yaodong Yang

专题命中 工具调用 :workflow(abstract);分类 cs.CL

AI总结 研究如何通过自然整合赞助内容实现大语言模型盈利的问题,提出PILA方法,将广告插入重构成条件响应重写问题并解耦为轻量级边车模块,实验证明该方法能在保持回复质量的同时提高广告效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25554 2026-07-29 cs.AI 新提交 57%

Distilling Temporal Search and Reasoning: Evolving LLMs for Future Prediction via Harness-Assisted Efficient Data Synthesis

提炼时间搜索与推理:通过 harness 辅助的高效数据合成发展用于未来预测的大语言模型

Wanxu Cai, Zhengyu Chen, Huaisheng Zhu, Wei Wang, Jingang Wang, Qiang Xu

机构 * The Chinese University of Hong Kong(香港中文大学) Meituan LongCat Team(美团龙猫团队)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 研究未来事件预测难题,提出时间截断 harness 方法,通过强制时间截断减少时间泄漏与对拒绝采样等的依赖,构建相关语料库和度量标准,经蒸馏实验验证该方法能提升模型表现,将高质量数据转化为模型参数提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23963 2026-07-28 cs.SE 新提交 57%

RESTOR: Automated Test Oracle Generation for RESTful APIs via Reinforcement Learning

RESTOR:通过强化学习自动生成RESTful API的测试预言机

Xun Zhou, Zhen Dong, Mingyu Ren, Qiang Li, JunJie Li, Sifan Wang, Xiaolong Yu, Chaofeng Sha, Xin Peng

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 针对RESTful API测试中定义可靠测试预言机的挑战,Restor框架利用强化学习,通过数据增强管道微调大语言模型生成测试断言,在工业数据集和生产工作流程中表现出色,提升测试用例采用率并减少人工QA工作。

Comments Accepted to ISSTA 2026. 22 pages, 8 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23273 2026-07-28 cs.IR cs.AI cs.ET 新提交 57%

Statistically Supported LLM Ingredient and Recipe Data Collection in Computational Nutrition

计算营养中统计支持的大语言模型成分与食谱数据收集

James Izzard, Hassan Eshkiki, Fabio Caraffini

机构 * Swansea University(斯旺西大学)

专题命中 工具调用 :workflow(abstract);分类 cs.AI

AI总结 研究针对计算营养中成分数据问题,提出结合统计估计、不变性检查和网络获取的大语言模型管道。通过该管道可获取精确数据,在参考集上实现高匹配度并大幅降低误差,将大语言模型辅助数据库构建变为可控流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22161 2026-07-27 cs.SE cs.CR 新提交 57%

HarnessLLM: Rust Verification Harness Generation with Large Language Models

HarnessLLM:使用大语言模型生成Rust验证框架

Minghua Wang, Yuwei Liu, Lin Huang

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 研究针对Rust代码内存安全验证开发验证框架难的问题,提出HarnessLLM自动化工作流程,利用大语言模型从测试套件生成框架,经实验评估效果良好,能检测内存安全漏洞,是首个用大语言模型为Rust项目内存安全验证生成框架的工作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19739 2026-07-23 cs.IR cs.AI 新提交 57%

Personalized Recommendation Tool Learning via Autonomous Language Agents

通过自主语言智能体进行个性化推荐工具学习

Mingdai Yang, Zhiwei Liu, Weizhi Zhang, Yibo Wang, Hao Peng, Philip Yu

机构 * Microsoft(微软公司)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 研究针对基于大语言模型的智能体在推荐系统中的局限性,提出PRTA框架,让LLM作中央规划器与多推荐模型交互,负责高级推理和个性化工具选择,传统模型进行全排序评分,设计反射机制,实验表明该框架提升了全排序推荐性能。

Comments 6 pages. Accepted by RecSys'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19518 2026-07-23 cs.AI 新提交 57%

Sophisticated Policies from Epistemic Priors

基于认知先验的复杂策略

Wouter W. L. Nuijten, Bert de Vries

机构 * Eindhoven University of Technology(埃因霍温理工大学) Lazy Dynamics(懒动力学)

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 研究探讨复杂推理在主动推理中的作用,通过在反应迷宫中评估,发现单独要素不足,复杂推理和全联合认知先验主动推理结合认知驱动与闭环推理解决环境问题,优势源于闭环形式,可在认知先验变分推理中表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19506 2026-07-23 quant-ph cs.AI 新提交 57%

Hybrid LLM-Guided Search for Quantum Reservoir Architecture Design

用于量子储层架构设计的混合大语言模型引导搜索

Krishna Bhatia, Gautami Sanjay Naik

机构 * QuantumAI Lab, Fractal Analytics India(量子AI实验室,Fractal Analytics印度)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 研究量子储层计算架构设计问题,提出基于模拟器的基准测试\method,比较五种策略,其中\hybrid策略表现出色,在多任务中优于随机搜索,证明生成模型嵌入混合搜索循环可作高级控制器。

Comments 4 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18045 2026-07-21 cs.AI cs.GT cs.MA 新提交 57%

The Shared Discovery Paradox: How a One-Answer Rule Turns Better Information into Worse Search

共享发现悖论:单答案规则如何将更好的信息转化为更差的搜索

Yohei Nakajima

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 研究共享信息时单答案规则导致的发现悖论,通过可精确求解的十六盒模型对比不同情况,指出这是协议失败。还探讨了自利搜索者博弈及共同线索模型,贡献是分离信息等因素为精确可复用量的紧凑基准。

Comments 29 pages, 4 figures. Code, data, and an interactive guide: https://github.com/yoheinakajima/shared-discovery-paradox

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17558 2026-07-21 cs.AI 新提交 57%

Why Does Feedback-Augmented Self-Distillation Fail to Improve Retrieval-Interleaved Search Agents?

为什么反馈增强的自蒸馏不能改进检索交织搜索智能体?

Fan Yang, Rui Meng, Yuxin Wen

机构 * Chapman University(查普曼大学) Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室)

专题命中 工具调用 :agentic(abstract);分类 cs.AI

AI总结 研究反馈增强的自蒸馏在智能体搜索中失效的原因,发现模型存在解码崩溃现象,因监督信号不一致致学习不稳定,将其分解为模型和提示不一致,引入EMA教师减轻不一致,最终提高模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16851 2026-07-21 cs.AI 新提交 57%

AgentBrew: Lifelong Knowledge Brewing from Strong Teachers to Weak LLM Agents

AgentBrew:从强大教师到弱小语言模型智能体的终身知识酿造

Yangqin Jiang, Chao Huang

机构 * The University of Hong Kong(香港大学)

专题命中 工具调用 :tool-use(abstract);分类 cs.AI

AI总结 研究语言模型智能体知识酿造问题,提出AgentBrew方法,含失败触发教师和学生感知合成两个组件,无需训练,能将教师交互经验提炼到学生外部记忆,经实验验证可产生强大且可部署的智能体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14093 2026-07-17 cs.AI 新提交 57%

Intelligent Three Level Learning Architecture for Autonomous UAV Swarms in Search and Rescue

用于自主无人机群搜索和救援的智能三级学习架构

Oleksii Bychkov

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文针对无人机群搜索和救援提出智能三级学习架构,集成三种学习机制,通过架构契约形式化,引入群体元认知,有进展函数和主整合定理,解决了现有分层强化学习方法的五个基本限制。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11913 2026-07-15 cs.NE cs.AI 新提交 57%

Towards Self-Evolving Agents: A Human-Inspired Adaptive Exploration-Exploitation Framework for Genetic Network Programming

迈向自我进化智能体:一种受人类启发的遗传网络编程自适应探索-利用框架

Ali Kohan, Mohamad Roshanzamir, Roohallah Alizadehsani, Seyedali Mirjalili

专题命中 工具调用 :agentic(abstract);分类 cs.AI

AI总结 该研究受人类发育模式启发,提出人类启发的遗传网络编程(HGNP)框架,通过新型自适应交叉、变异算子及循环消除机制,动态调节遗传网络编程中探索与利用的平衡,提升了智能体策略性能,且可应用于多种GNP变体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10198 2026-07-14 cs.CL 新提交 57%

Equal Accuracy, Unequal Evidence: Search APIs as Decision Surfaces for Tool-Using Agents

同等准确性,不同证据:作为工具使用代理决策表面的搜索 API

Sriram Selvam, Anneswa Ghosh

专题命中 工具调用 :agent(abstract);分类 cs.CL

AI总结 研究以搜索 API 为决策表面,用冻结的 GPT - 5.4 代理、两个工具及 100 个问题测试不同搜索提供商。发现虽答案准确性相近,但证据经济性不同,还引入新比率,指出提供商选择是检索预算和策略决策,非单纯召回决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09428 2026-07-13 cs.CV cs.LG 新提交 57%

Multimodal Scenario Similarity Search for Autonomous Driving

用于自动驾驶的多模态场景相似性搜索

Tamás Matuszka, András Tamásy, Balázs Szolár

机构 * aiMotive(爱莫提夫)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 研究自动驾驶场景相似性搜索,提出多模态框架结合视觉与轨迹表示,对比两种基于轨迹的方法与视觉基线,实验表明轨迹表示在运动事件中性能强,视觉嵌入在外观线索丰富时出色,结合二者可提升检索质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09632 2026-07-13 quant-ph cs.AI 新提交 57%

Lean-QIT: Towards a Formal Infrastructure for Quantum Information Theory

Lean-QIT:迈向量子信息理论的形式化基础设施

Chengkai Zhu, Ziao Tang, Guocheng Zhen, Yimeng Cao, Yusheng Zhao, Ranyiliu Chen, Xuanqiang Zhao, Lei Zhang, Xin Wang

机构 * QudeLeap Research(QudeLeap研究院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Quantum Science Center of Guangdong-Hong Kong-Macao Greater Bay Area(粤港澳大湾区量子科学中心) The University of Hong Kong(香港大学)

专题命中 工具调用 :agentic(abstract);分类 cs.AI

AI总结 研究旨在为量子信息理论构建形式化基础设施,通过Lean 4库LeanQIT提供相关接口,将多个重要定理形式化,分离操作定义与解析表征,为形式化QIT及相关推理提供基础和知识底物。

Comments 24+5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08274 2026-07-10 cs.HC cs.SE 新提交 57%

How Analysts Use AI in High-Stakes Crime Linkage: An Industrial Study

分析师如何在高风险犯罪关联中使用人工智能:一项行业研究

Jessica Woodhams, Amy Burrell, Wanyin Li, Fahim Ahmed, Matthew Tonkin, Jan Lemeire, Arkady Konovalov, Steven Frisson, Mark Webb, Sarah Galambos, Vesna Nowack, Dalal Alrajeh

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 研究探讨分析师在高风险犯罪关联中如何用AI,通过与英国执法机构合作开发工具并进行混合方法可用性研究,发现分析师有选择地用AI预测且常验证,还关注模型特征,强调AI决策支持工具要整合解释与传统方法及现场评估的重要性。

Comments 12 pages, 6 figures, FSE Industry

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07461 2026-07-09 cs.CR cs.SE 新提交 57%

Mitigating Taint-Style Vulnerabilities in MCP Servers via Security-Aware Tool Descriptions

通过安全感知工具描述减轻MCP服务器中的污点式漏洞

Yang Shi, Jiaheng Fu, Yihe Huang, Ruixiang Wu, Chengyao Sun, Kaifeng Huang

专题命中 工具调用 :autonomous agent(abstract);分类 cs.SE

AI总结 研究MCP服务器污点式漏洞,提出SPELLSMITH,通过分析服务器高风险能力,结合工具描述等识别潜在风险,利用协议属性和大语言模型自我反思能力迭代优化输出,有效减轻污点式漏洞利用。

详情

展开后加载摘要…

URL PDF HTML 收藏