arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5112 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5112 篇

2608.16824 2026-08-24 cs.LG cs.CR cs.IR 版本更新 70%

GEO-Flag: Detecting and Measuring GEO-Optimized Web Content

GEO-Flag:检测与测量经GEO优化的网页内容

Junjie Chu, Ye Leng, Mingjie Li, Yun Shen, Xinyue Shen, Yang Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA亥姆霍兹信息安全中心) HPE(慧与科技) University of Waterloo(滑铁卢大学)

专题命中 工具调用 :agent(abstract,abstract_cn);分类 cs.LG

AI总结 本研究针对生成式引擎优化(GEO)网页检测不足的问题,构建GEOFlagBench基准,提出干预配对训练(IPT)方法,开发GEO门控智能体系统,还部署流程测量出GEO总体流行率为8.90%。

Comments 23 pages, 8 figures, 23 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18543 2026-08-20 cs.AI 新提交 70%

Bridging Search and CRM: Productionizing AI Product Research Agents for Customer Re-Engagement

打通搜索与客户关系管理(CRM):将AI产品研究智能体应用于客户再互动的生产部署

Mandar Kulkarni, Pooja A., Samir Shah

机构 * Flipkart Internet Pvt Ltd(Flipkart互联网私人有限公司)

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究提出打通搜索与CRM的AI产品研究智能体框架,在23天生产部署中验证其可提升WhatsApp推荐的CTR、带来GMV增长,实现客户再互动与旅程优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26722 2026-08-13 cs.MA cs.LG 版本更新 70%

DREvo: Distilling Recalibrated Historical Experience for Harness Self-Evolution

DREvo:提炼重校准的历史经验以实现工具链自主进化

Hanghui Guo, Weijie Shi, Zhangze Chen, Shengxiang Xu, Yishu Wang, Yimei Zhang, Wangze Ni, Jia Zhu, Shimin Di

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.LG

AI总结 针对现有工具链自主进化方法的两个局限,提出DREvo方法,通过整合三项技术提升进化稳定性,在五个基准上取得最优准确率,在两类任务上较基线实现显著性能提升。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10743 2026-08-12 cs.CL 新提交 70%

Mitigating Context Interference for Reliable and Efficient Search Agents

缓解可靠高效搜索智能体的上下文干扰

Boyang Xue, Bin Wu, Shuofei Qiao, Sheng Wang, Rui Wang, Yiming Du, Hongru Wang, Jeff Z. Pan, Emine Yilmaz, Kam-Fai Wong, Aldo Lipani

机构 * The Chinese University of Hong Kong(香港中文大学) University College London(伦敦大学学院) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) The University of Edinburgh(爱丁堡大学)

专题命中 工具调用 :agent(abstract);AI agent(abstract);分类 cs.CL

AI总结 本文针对多轮搜索智能体的上下文干扰问题,提出基于蒸馏的上下文优化器,将其纳入RL训练后可显著提升搜索智能体的可靠性与效率,开创了AI智能体“先优化上下文再生成”的新范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17798 2026-08-11 cs.SE cs.CR 版本更新 70%

CognixShield: PoV-Guided Vulnerable API Usage Detection in Large Codebases via LLMs

CognixShield:基于LLM的、面向大型代码库的PoV引导式漏洞API使用检测

Quanzhi Fu, Wang Lingxiang, Wenjia Song, Gelei Deng, Yi Liu, Dan Williams, Ying Zhang

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 CognixShield是一款LLM驱动的框架,通过保留语义的AST碎片化、感知漏洞的多智能体RAG、PoV引导的语义推理三个核心组件,在57个Java应用上实现了优于现有工具的漏洞API使用检测性能。

Comments accepted in ESEM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06370 2026-08-07 cs.CL 新提交 70%

The Bitter Lesson of Tool Calling

工具调用的惨痛教训

Ishan Patel, Sahil Sen, Elias Lumer, Vamse Kumar Subbiah

专题命中 工具调用 :agent(abstract);tool use(abstract);分类 cs.CL

AI总结 本研究在BFCL v4上对比14种模型的程序化工具调用与JSON工具调用,发现程序化工具调用在多数场景下性能更优且鲁棒性更强,是可行的替代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02518 2026-08-04 cs.AI cs.CY 新提交 70%

Magnet: Detecting Cross-Session AI Misuse Through Capability Accumulation

Magnet:通过能力累积检测跨会话的AI滥用

Natalie Isak, Matthew Dressman

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究针对AI集成体的跨会话滥用风险,提出Magnet方法,通过聚合跨会话累积的相关能力来检测此类滥用,填补了现有单会话检测的缺口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01822 2026-08-04 cs.AI 新提交 70%

SearchMaster: Grounded and Regulated Self-Play for Search Agents

SearchMaster:面向搜索智能体的基于接地与调控的自博弈框架

Wentao Tan, Qiong Cao, Jiaqi Wang, Nan Duan

专题命中 工具调用 :agent(abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出SearchMaster自博弈框架,通过ECG、SDR、OOP三项调控措施优化LLM搜索智能体训练,在六个深度搜索基准上显著提升Qwen3.5-9B模型的平均准确率,无需人工标注数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28459 2026-07-31 cs.AI cs.LO 新提交 70%

LeanCSP: A Framework for Certifying Constraint Reformulation and Solving in Lean

LeanCSP:Lean中用于验证约束重构与求解的框架

Pablo Manrique, Stefan Szeider

机构 * TU Wien(维也纳技术大学)

专题命中 工具调用 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究在Lean定理证明器中提出LeanCSP框架,可验证约束重构的语义正确性与求解器结果,其已验证对称性破缺能大幅减少求解搜索工作量,且Lean内认证成本可承受。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23524 2026-07-28 cs.AI 新提交 70%

Delegation Intelligence in Deep Search: A Controllable Framework for Disentangled Capability Diagnosis

深度搜索中的委托智能:一种用于解缠能力诊断的可控框架

Xinhao Yao, Yuanzhuo Liu, Changhao Wang, Yunfei Yu, Haoran Tan, Yuyao Zhang, Ruifeng Ren, Minlong Peng, Yong Liu

机构 * UCAS(中国科学院大学) Renmin University of China(中国人民大学)

专题命中 工具调用 :agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 研究深度搜索中委托智能,将其分解为搜索决策和信息合成与验证维度。通过开发可控合成管道构建DelegSearchBench及评估协议,实验证明仅用最终答案准确性不能充分表征深度搜索能力。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22651 2026-07-28 cs.AI 新提交 70%

ARdena: Scenario-driven control of real-time LLM agents

ARdena:实时大语言模型智能体的场景驱动控制

Luka Borozan, Domagoj Matijević

机构 * Faculty of Applied Mathematics and Informatics, University of Osijek Croatia(奥西耶克大学应用数学与信息学院,克罗地亚) Meet Intelligent Innovations LLC(Meet智能创新有限责任公司)

专题命中 工具调用 :agent(abstract);tool use(abstract);分类 cs.AI

AI总结 研究如何在实时交互环境中控制大语言模型智能体行为,提出分层场景驱动的LLM控制框架,通过结构化提示实现运行时行为控制,在ARDena中实现该框架并评估,结果显示场景驱动提示能有效控制LLM智能体。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22529 2026-07-27 cs.CL 新提交 70%

Skill Self-Play: Pushing the Frontier of LLM Capability with Co-Evolving Skills

技能自我博弈:通过协同进化技能拓展大语言模型能力边界

Siyuan Huang, Pengyu Cheng, Haotian Liu, Tao Chen, Yihao Liu, Jingwei Ni, Shijie Zhou, Ziyi Yang, Gangwei Jiang, Mengyu Zhou, Yu Cheng, Xiaoxi Jiang, Guanjun Jiang

专题命中 工具调用 :agent(abstract);tool-use(abstract);分类 cs.CL

AI总结 研究针对大语言模型训练困境,引入Skill Self-Play协同进化框架,由提议者、求解器和控制器构成,经强化学习循环使组件协同进化,有效弥合验证与探索差距,推动模型性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13026 2026-07-24 cs.LG cs.CR 版本更新 70%

PISmith: Reinforcement Learning-based Red Teaming for Prompt Injection Defenses

PISmith: 基于强化学习的提示注入防御红队测试

Chenlong Yin, Runpeng Geng, Yanting Wang, Jinyuan Jia

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 工具调用 :autonomous agent(abstract);agentic(abstract);分类 cs.LG

AI总结 本文提出PISmith框架,通过强化学习评估现有提示注入防御的鲁棒性,发现标准GRPO在攻击强防御时表现不佳,引入自适应熵正则化和动态优势加权以提升探索能力,实验表明最新防御仍易受适应性攻击影响。

Comments To appear in COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07055 2026-07-22 cs.AI 版本更新 70%

Dr. Zero: Self-Evolving Search Agents without Training Data

零博士:无需训练数据的自我进化搜索智能体

Zhenrui Yue, Kartikeya Upasani, Xianjun Yang, Suyu Ge, Shaoliang Nie, Yuning Mao, Zhe Liu, Dong Wang

机构 * Meta Superintelligence Labs(Meta超级智能实验室) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 工具调用 :tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 研究在高质量数据难获取时智能体自我进化问题,提出零博士框架,通过自我进化反馈循环和HRPO方法,使搜索智能体无需训练数据自我进化,在问答基准测试中表现出色,证明可仅通过自我进化实现强大智能搜索和推理。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14582 2026-07-17 cs.AI 新提交 70%

MathCoPilot: An Interactive System for Human-AI Symbiotic Paradigm of Mathematical Research

MathCoPilot:一种用于数学研究的人机共生范式的交互式系统

Junjie Zhang, Jiayu Liu, Wenbin Liu, Zhenya Huang, Doudou Wang, Yan Jiang, Leiye Xu, Tao Xiong, Wen Huang, Qi Liu, Guoping Hu, Enhong Chen, Mengping Zhang, Xiangdong Ye

机构 * University of Science and Technology of China(中国科学技术大学) School of Mathematical Sciences, University of Science and Technology of China(中国科学技术大学数学科学学院)

专题命中 工具调用 :AI agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 研究提出MathCoPilot这人机共生的数学研究系统,统一三项核心能力。通过它在特定子集和定理上比较四个大语言模型,发现当前模型处理本科问题成功率高,但在特定领域定理上仍面临挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13021 2026-07-15 cs.SE 新提交 70%

Software Supply Chains are Dead: Use-Case-Oriented Regeneration

软件供应链已死:面向用例的再生

Tanmay Singla, James C. Davis

专题命中 工具调用 :workflow(abstract);agentic(abstract);分类 cs.SE

AI总结 研究现代软件开发中构建与复用权衡因软件供应链攻击及生成式人工智能而改变,提出面向用例的再生范式,评估智能工作流程,通过对180个存储库-依赖对测量,证明该方法可行,推动软件采购向可验证的特定于存储库的代码合成发展。

Comments [ESEM'26-ERVR] Proceedings of the 20th International Symposium on Empirical Software Engineering and Measurement (ESEM 2026 Emerging Results, Vision, and Reflection Papers)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11444 2026-07-14 cs.CL 新提交 70%

UMoE:Unlocking Every Expert in Domain-Specific Training

UMoE:在特定领域训练中解锁每个专家

Xuefeng Li, Pengfei Liu

机构 * Qwen Team(通义千问团队) DeepSeek-AI(渊亭科技) Thinking Machines Lab(思维机器实验室) LLM-Core Xiaomi(小米大语言模型核心团队)

专题命中 工具调用 :tool-use(abstract);agentic(abstract);分类 cs.CL

AI总结 研究针对特定领域训练中专家池不合理问题,提出UMoE流程,先修剪低显著性专家,再扩展专家池,最后应用标准SFT,该方法在多架构、多领域及多基准测试中优于直接SFT,能转化冗余容量,提升训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10508 2026-07-14 cs.DB cs.AI 新提交 70%

Confining Nondeterminism: AI-Driven Research Systems as DBMSs for Reliable, Non-Wasteful, Transparent, and Collaborative Research [Vision]

限制非确定性:作为数据库管理系统的人工智能驱动研究系统,实现可靠、无浪费、透明和协作式研究 [愿景]

Kyoungmin Kim, Anastasia Ailamaki

机构 * EPFL(瑞士联邦理工学院)

专题命中 工具调用 :agent(abstract);tool use(abstract);分类 cs.AI

AI总结 研究指出大语言模型代理在研究中存在不可信问题,根源是代理循环的随机调用无法检查内部状态。借鉴数据库经验,建议用确定性带版本的数据流引擎组织研究项目,大语言模型作查询编译器,五条设计规则确保研究可靠、透明且协作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10487 2026-07-14 cs.CR cs.AI 新提交 70%

Temporary Authority, Permanent Effects: Commit-Time Authorization for LLM Agents

临时权限,永久影响:大型语言模型代理的提交时间授权

Igor Santos-Grueiro

机构 * International University of La Rioja(拉里奥ja国际大学)

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究大型语言模型代理提交时间授权问题,构建受控失效套件实验,发现端点成功率高但授权完成率低,评估缓解措施,提出CommitGuard可阻止过时持久影响尝试,指出端点成功是实用指标,授权提交是安全属性。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07820 2026-07-14 cs.CL 版本更新 70%

DeepSearch-World: Self-Distillation for Deep Search Agents in a Verifiable Environment

深度搜索世界:可验证环境中深度搜索智能体的自蒸馏

Xinyu Geng, Xuanhua He, Sixiang Chen, Yanjing Xiao, Fan Zhang, Shijue Huang, Haitao Mi, Zhenwen Liang, Tianqing Fang, Yi R. Fung

专题命中 工具调用 :tool-use(abstract);agentic(abstract);分类 cs.CL

AI总结 研究训练工具使用智能体从自身经验改进的难题,提出基于深度搜索世界的自蒸馏框架深度搜索进化,通过迭代操作训练智能体,该框架无需更强大模型蒸馏,性能有竞争力,还将发布相关资源促进后续研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23525 2026-07-14 cs.CL 版本更新 70%

Self-Compacting Language Model Agents

自压缩语言模型智能体

Tianjian Li, Jingyu Zhang, William Jurayj, Xi Wang, Chuanyang Jin, Mehrdad Farajtabar, Eric Nalisnick, Daniel Khashabi

机构 * Johns Hopkins University(约翰霍普金斯大学) Apple(苹果公司)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 提出SelfCompact框架,让语言模型自主决定何时及如何压缩上下文,通过调用压缩工具和轻量级规则实现自适应压缩,无需微调或外部监督,在多个基准上以更低成本匹配或超越固定间隔压缩。

Comments 25 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20297 2026-07-13 cs.AI 版本更新 70%

Improving Language Agents through BREW: Bootstrapping expeRientially-learned Environmental knoWledge

通过BREW改进语言智能体:引导式经验学习环境知识

Shashank Kirtania, Param Biyani, Priyanshu Gupta, Yasharth Bajpai, Roshni Iyer, Sumit Gulwani, Gustavo Soares

机构 * University of Michigan(密歇根大学) Independent(独立研究者) Microsoft(微软) Apple(苹果公司)

专题命中 工具调用 :agent(abstract);tool use(abstract);分类 cs.AI

AI总结 研究基于LLM的智能体无法从经验学习的问题,提出BREW框架,通过提炼交互轨迹成知识库、引入EG-MCTS算法及适应事后重标记等方法,在多基准测试中提升任务成功率并减少执行步骤,且知识库具有良好特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07548 2026-07-09 cs.CL 新提交 70%

Think Big, Search Small: Where Capacity Matters in Hierarchical Search Agents?

想得大,搜得小:分层搜索智能体中容量的关键所在?

Qinnan Cai, Yibo Zhao, Xiang Li

机构 * School of Data Science and Engineering(数据科学与工程学院)

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 研究基于大语言模型的分层搜索智能体中模型容量分配问题,通过角色分解和受控容量扫描实验,发现容量敏感性不对称,分解是瓶颈,还给出了集中容量于委托、缩减执行容量且不牺牲精度的构建分层搜索智能体方法。

Comments 21pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04708 2026-07-07 econ.TH cs.AI cs.CY cs.GT cs.HC 新提交 70%

Strategic Buying Agents

战略性购买智能体

Mingyang Fu, Ming Hu

机构 * Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究面向自主代客购物场景,分三类信息场景设计有限购物窗口内的最优购买策略,经真实电商价格数据验证,大模型更适配场景选择而非直接购买决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03220 2026-07-07 cs.CR cs.AI 新提交 70%

CONTRA: Red-Teaming Configurations of Personalizable Agents

CONTRA:可个性化代理的红队配置

Jonathan Nöther, Adish Singla, Goran Radanovic

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件研究所)

专题命中 工具调用 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 探讨代理配置与执行危险行为风险的关系,提出CONTRA算法,通过推理评估良性但危险的配置发现导致恶意行为的代理配置,构建数据集分析发现多数技能有恶意配置,CONTRA能成功识别部分危险配置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01793 2026-07-07 cs.AI 新提交 70%

Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification

大规模安全测试LLM智能体:从风险发现到基于证据的验证

Yunhao Feng, Ruixiao Lin, Ming Wen, Qinqin He, Yanming Guo, Yifan Ding, Yutao Wu, Jialuo Chen, Zhuoer Xu, Xiaohu Du, Jianan Ma, Zixing Chen, Xingjun Ma, Yunhao Chen, Xinhao Deng

机构 * AntGroup(蚂蚁集团) Zhejiang University(浙江大学) Fudan University(复旦大学) Alibaba Group(阿里巴巴集团) Hunan Institute of Advanced Technology(湖南先进技术研究院) Deakin University(迪肯大学)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 提出Vera框架,通过文献驱动的风险发现、组合生成可执行安全用例和自适应执行与证据验证三阶段流水线,实现端到端自动化安全测试,在四个生产级智能体框架上发现严重漏洞,平均攻击成功率93.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30441 2026-07-03 cs.MA cs.AI 版本更新 70%

Translating Natural Language to Strategic Temporal Specifications via LLMs

通过大语言模型将自然语言翻译为策略时序规范

Marco Aruta, Francesco Improta, Vadim Malvone, Aniello Murano, Vladana Perlić

机构 * University of Naples Federico II(那不勒斯费德里科二世大学) LTCI, Télécom Paris, Institut Polytechnique de Paris(LTCI,巴黎电信,巴黎理工学院)

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出利用大语言模型将自然语言描述的策略需求翻译为ATL/ATL*公式,构建专家验证数据集,通过领域内微调小模型达到与强少样本专有API基线相当的语义准确性(0.84 vs 0.86),并集成到模型检查器中支持非专家用户。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14157 2026-07-03 cs.AI cs.CV 版本更新 70%

Ophiuchus: Incentivizing Tool-augmented "Think with Images" for Joint Medical Segmentation, Understanding and Reasoning

Ophiuchus: 激励工具增强的“图像思考”用于联合医学分割、理解与推理

Yankai Jiang, Yujie Zhang, Peng Zhang, Wenjie Li, Yichen Li, Jintai Chen, Xiaoming Shi, Shihui Zhen

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Information Hub, HKUST (Guangzhou)(信息枢纽,香港科技大学(广州))

专题命中 工具调用 :AI agent(abstract);agentic(abstract);分类 cs.AI

AI总结 提出Ophiuchus框架,通过三阶段训练策略(冷启动SFT、自反思微调、工具强化学习)使MLLM动态聚焦细粒度视觉区域,实现精准医学分割与诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01063 2026-07-02 cs.SE 新提交 70%

AutoRestTest at the SBFT 2026 Tool Competition

AutoRestTest 在 SBFT 2026 工具竞赛中

Tyler Stennett, Myeongsoo Kim, Saurabh Sinha, Alessandro Orso

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 提出结合语义属性依赖图、多智能体强化学习和大型语言模型的AutoRestTest方法,在SBFT 2026 REST联赛中11个API上三项评估均获第一。

Comments 2 pages, 1 figure. Published in the 19th Search-Based and Fuzz Testing Workshop (SBFT '26), co-located with ICSE 2026

Journal ref Proceedings of the 19th Search-Based and Fuzz Testing Workshop (SBFT '26), April 12-18, 2026, Rio de Janeiro, Brazil. ACM, New York, NY, USA, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12887 2026-07-02 cs.IR cs.AI 版本更新 70%

EcoGEO: Trajectory-Aware Evidence Ecosystems for Web-Enabled LLM Search Agents

EcoGEO:基于轨迹的证据生态系统用于网络增强的大语言模型搜索代理

Hengwei Ye, Jiasheng Mao, Zhenhan Guan, Zheng Tian

机构 * ShanghaiTech University(上海科技大学)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出EcoGEO,一种基于轨迹的证据生态系统,用于研究网络增强的大语言模型搜索代理在多步骤浏览中的证据获取过程,通过协调导航页面与支持页面提升产品推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏