arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 93669 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5112 篇

2601.11598 2026-03-03 cs.CY cs.AI cs.HC 57%

Toward Youth-Centered Privacy-by-Design in Smart Devices: A Systematic Review

面向以青少年为中心的隐私设计在智能设备中的探索:一项系统综述

Molly Campbell, Mohamad Sheikho Al Jasem, Ajay Kumar Shrestha

专题命中 工具调用 :workflow(abstract);分类 cs.AI

AI总结 本文系统综述了智能设备中保护青少年隐私的设计框架,指出技术方案为主但实施不足,建议多方合作构建隐私生态系统。

Comments Published in the IEEE CCWC 2026 proceedings

Journal ref 2026 IEEE 16th Annual Computing and Communication Workshop and Conference (CCWC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18487 2026-03-03 cs.CL 57%

Actions Speak Louder than Prompts: A Large-Scale Study of LLMs for Graph Inference

行动胜于提示:大型语言模型在图推断中的大规模研究

Ben Finkelshtein, Silviu Cucerzan, Sujay Kumar Jauhar, Ryen White

机构 * University of Oxford(牛津大学) Microsoft Research(微软研究院)

专题命中 工具调用 :tool-use(abstract);分类 cs.CL

AI总结 研究通过大规模评估揭示LLM在图推断中的表现,发现代码生成在长文本图中表现最佳,异质图上交互策略仍有效,且方法能灵活适应不同输入类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00204 2026-03-03 eess.IV cs.CV cs.LG 57%

Optimisation of SOUP-GAN and CSR-GAN for High Resolution MR Images Reconstruction

优化SOUP-GAN和CSR-GAN用于高分辨率MRI图像重建

Muneeba Rashid, Hina Shakir, Humaira Mehwish, Asarim Amir, Reema Qaiser Khan

专题命中 工具调用 :tool use(abstract);分类 cs.LG

AI总结 本研究通过优化SOUP-GAN和CSR-GAN模型,提升高分辨率MRI图像重建质量,以改善疾病诊断效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00078 2026-03-03 cs.CY cs.AI 57%

Alignment Is Not Enough: A Relational Framework for Moral Standing in Human-AI Interaction

对齐不足以:人类-人工智能互动中的道德地位关系框架

Faezeh B. Pasandi, Hannah B. Pasandi

专题命中 工具调用 :tool use(abstract);分类 cs.AI

AI总结 本文提出Relate框架,通过关系能力和具身互动重新定义人工智能的道德资格,强调现有伦理词汇无法应对人类-人工智能互动的复杂性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05179 2026-03-02 cs.LG 57%

DRL-ORA: Distributional Reinforcement Learning with Online Risk Adaption

DRL-ORA: 带在线风险适应的分布式强化学习

Yupeng Wu, Wenyun Li, Wenjie Huang, Chin Pang Ho

机构 * London Business School(伦敦商学院) The University of Hong Kong(香港大学) City University of Hong Kong(城市大学)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 DRL-ORA通过动态调整风险水平,在安全关键任务中提升强化学习的效率和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19128 2026-02-27 cs.AI 57%

K-Search: LLM Kernel Generation via Co-Evolving Intrinsic World Model

K-Search: 通过共进化内在世界模型生成LLM内核

Shiyi Cao, Ziming Mao, Joseph E. Gonzalez, Ion Stoica

机构 * UC Berkeley(加州大学伯克利分校)

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 K-Search通过共进化内在世界模型生成LLM内核,显著优于现有进化搜索方法,实现高效内核优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22216 2026-02-27 cs.IR cs.AI 57%

Retrieval-Augmented Generation Assistant for Anatomical Pathology Laboratories

增强检索生成的解剖病理实验室助手

Diogo Pires, Yuriy Perezhohin, Mauro Castelli

机构 * Nova Information Management School (NOVA IMS), Universidade Nova de Lisboa, Campus de Campolide(诺瓦信息管理学院(NOVA IMS),里斯本新大学,坎波利德校区)

专题命中 工具调用 :workflow(abstract);分类 cs.AI

AI总结 本研究提出一种专为解剖病理实验室设计的检索增强生成助手,通过领域专用嵌入模型提升答案相关性和准确性,优化实验室规程查询效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04575 2026-02-24 cs.LG 57%

Bootstrapping Task Spaces for Self-Improvement

通过任务空间的提升实现自我改进

Minqi Jiang, Andrei Lupu, Yoram Bachrach

机构 * Meta Superintelligence Labs(Meta超智能实验室) University of Oxford(牛津大学)

专题命中 工具调用 :tool-use(abstract);分类 cs.LG

AI总结 ExIt通过自适应课程强化学习方法,使大语言模型在推理时实现多步骤自我改进,提升任务性能。

Comments TMLR, February 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18425 2026-02-23 cs.CL cs.IR 57%

RVR: Retrieve-Verify-Retrieve for Comprehensive Question Answering

RVR:用于综合问答的检索-验证-检索

Deniz Qian, Hung-Ting Chen, Eunsol Choi

机构 * Courant Institute School of Mathematics, Computing, and Data Science, New York University(纽约大学Courant研究所数学、计算与数据科学学院) Courant Institute School of Mathematics, Computing(纽约大学Courant研究所数学、计算与数据科学学院) Data Science, New York University(纽约大学数据科学学院)

专题命中 工具调用 :agentic(abstract);分类 cs.CL

AI总结 RVR提出了一种多轮检索框架,通过验证器和检索器优化,提升多答案检索的召回率和覆盖范围。

Comments 18 pages, 12 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14118 2026-02-20 cs.LG stat.AP stat.ML 57%

Selecting Critical Scenarios of DER Adoption in Distribution Grids Using Bayesian Optimization

利用贝叶斯优化选择分布式能源接入的关键场景

Olivier Mulkin, Miguel Heleno, Mike Ludkovski

机构 * Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室) Department of Statistics & Applied Probability, UC Santa Barbara(统计与应用概率系,加州大学圣巴巴拉分校)

专题命中 工具调用 :planning(abstract);分类 cs.LG

AI总结 本文提出基于贝叶斯优化的方法,用于高效选择配电网络中关键的分布式能源接入场景,提升电网风险预测的准确性和效率。

Comments 12 pages, 4 tables, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16105 2026-02-19 cs.AI 57%

GPSBench: Do Large Language Models Understand GPS Coordinates?

GPSBench: 大型语言模型是否理解GPS坐标?

Thinh Hung Truong, Jey Han Lau, Jianzhong Qi

机构 * University of Melbourne(墨尔本大学)

专题命中 工具调用 :tool use(abstract);分类 cs.AI

AI总结 GPSBench通过评估14种LLMs在地理空间推理中的表现,揭示了其在GPS坐标理解和现实地理推理上的挑战与差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09349 2026-02-13 cs.LG 57%

Large Language Models for Designing Participatory Budgeting Rules

基于大型语言模型的设计参与式预算规则

Nguyen Thach, Xingchen Sha, Hau Chan

机构 * University of Nebraska-Lincoln(内布拉斯加大学林肯分校) Northwestern University(西北大学)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 本文提出LLMRule框架,利用大型语言模型自动化设计参与式预算规则,提升预算分配的效用同时保持公平性。

Comments Accepted as full paper to AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10986 2026-02-12 cs.LG 57%

TVCACHE: A Stateful Tool-Value Cache for Post-Training LLM Agents

TVCACHE: 一种具有状态的工具-价值缓存用于训练后LLM代理

Abhishek Vijaya Kumar, Bhaskar Kataria, Byungsoo Oh, Emaad Manzoor, Rachee Singh

机构 * cornell(康奈尔大学)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 TVCACHE通过维护工具调用序列树和最长前缀匹配,实现LLM代理训练后的高效缓存,提高缓存命中率并减少工具调用时间。

Comments Abhishek Vijaya Kumar and Bhaskar Kataria have equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09517 2026-02-11 cs.CL 57%

Knowledge Integration Decay in Search-Augmented Reasoning of Large Language Models

在大语言模型的搜索增强推理中知识整合衰减

Sangwon Yu, Ik-hwan Kim, Donghun Kang, Bongkyu Hwang, Junhwa Choi, Suk-hoon Jung, Seungki Hong, Taehee Lee, Sungroh Yoon

机构 * Department of Electrical and Computer Engineering, Seoul National University, Seoul, Korea(电气与计算机工程系,首尔国立大学,韩国首尔) Interdisciplinary Program in Artificial Intelligence, Seoul National University, Seoul, Korea(人工智能交叉学科项目,首尔国立大学,韩国首尔)

专题命中 工具调用 :agentic(abstract);分类 cs.CL

AI总结 本研究提出SAKE方法,通过在推理过程前后锚定检索知识,缓解大语言模型在搜索增强推理中的知识整合衰减问题,提升多跳问答和复杂推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.03449 2026-02-11 cs.SE 57%

GHTraffic: A Dataset for Reproducible Research in Service-Oriented Computing

GHTraffic:面向服务计算的可重复研究数据集

Thilini Bhagya, Jens Dietrich, Hans Guesgen, Steve Versteeg

专题命中 工具调用 :tool use(abstract);分类 cs.SE

AI总结 GHTraffic是一个包含大量HTTP事务的数据集,用于支持服务计算领域的可重复研究,通过提取GitHub数据和合成数据构建,提供了一种新的研究工具和评估标准。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01075 2026-02-05 cs.AI 57%

ConvexBench: Can LLMs Recognize Convex Functions?

ConvexBench: LLMs能否识别凸函数?

Yepeng Liu, Yu Huang, Yu-Xiang Wang, Yingbin Liang, Yuheng Bu

机构 * UC Santa Barbara(加州大学圣芭芭拉分校) University of Pennsylvania(宾夕法尼亚大学) UC San Diego(加州大学圣地亚哥分校) The Ohio State University(俄亥俄州立大学)

专题命中 工具调用 :agentic(abstract);分类 cs.AI

AI总结 ConvexBench通过分治框架解决LLM在深度函数组合中识别凸性的挑战,显著提升大深度下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03593 2026-02-04 cs.SE 57%

Beyond the Commit: Developer Perspectives on Productivity with AI Coding Assistants

超越提交:开发者对AI代码助手生产力的看法

Valerie Chen, Jasmyn He, Behnjamin Williams, Jason Valentino, Ameet Talwalkar

专题命中 工具调用 :tool use(abstract);分类 cs.SE

AI总结 本研究通过混合方法分析了AI代码助手对开发者生产力影响的多维评估因素,强调长期指标的重要性,为未来研究和工业实践提供参考。

Comments ICSE SEIP

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22431 2026-02-03 cs.SE 57%

TreeMind: Automatically Reproducing Android Bug Reports via LLM-empowered Monte Carlo Tree Search

TreeMind: 通过LLM赋能的蒙特卡洛树搜索自动重现Android bug报告

Zhengyu Chen, Zhaoyi Meng, Wenxiang Zhao, Wansen Wang, Wenchao Huang, Jie Cui, Hong Zhong, Yan Xiong

专题命中 工具调用 :planning(abstract);分类 cs.SE

AI总结 TreeMind结合LLM与MCTS算法,通过语义推理和反馈导航,高效重现Android bug报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00460 2026-02-03 cs.LG 57%

Search Inspired Exploration in Reinforcement Learning

受搜索启发的强化学习探索

Georgios Sotirchos, Zlatan Ajanović, Jens Kober

机构 * Faculty of Mechanical Engineering, Delft University of Technology, The Netherlands(达特穆斯大学机械工程学院) Chair of Machine Learning and Reasoning, RWTH Aachen University, Germany(亚琛工业大学机器学习与推理研究所)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 SIERL通过子目标选择机制在稀疏奖励环境中提升探索效率,有效引导智能体探索最有信息的区域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22183 2026-02-02 cs.DB cs.AI cs.DS 57%

COL-Trees: Efficient Hierarchical Object Search in Road Networks

COL-Trees: 路网中高效的层次对象搜索

Tenindra Abeywickrama, Muhammad Aamir Cheema, Sabine Storandt

机构 * Center for Computational Science, RIKEN(计算科学中心,RIKEN) Faculty of Information Technology, Monash University(信息科技学院,墨尔本大学) Department of Computer and Information Science, University of Konstanz(计算机与信息科学系,康斯坦茨大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 COL-Trees通过高效的层次图遍历方法,提升了道路网络中多代理POI搜索的效率,实现高达4个数量级的性能改进。

Comments Submitted to Artificial Intelligence (AIJ)

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.13860 2026-01-30 cs.AI math.PR q-bio.NC 57%

Active Inference Tree Search in Large POMDPs

大规模POMDPs中的主动推断树搜索

Domenico Maisto, Francesco Gregoretti, Karl Friston, Giovanni Pezzulo

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 本文提出主动推断树搜索方法,结合神经科学与人工智能的规划理论,实现大规模POMDP问题的高效解决。

Comments 47 pages, 9 figures, 1 Appendix of two sections with pseudocodes and one encoding example, submitted preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11311 2026-01-30 cs.AI cs.CY 57%

Prompts to Proxies: Emulating Human Preferences via a Compact LLM Ensemble

通过紧凑的LLM集合模拟人类偏好:提示到代理

Bingchen Wang, Zi-Yu Khoo, Jingtan Wang

机构 * Independent Researcher, China(中国独立研究者) School of Computing, National University of Singapore(新加坡国立大学计算机学院)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 通过紧凑的LLM集合模拟人类偏好,P2P方法在无需微调和敏感数据的情况下,有效重建目标人群偏好并实现高质量预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17549 2026-01-27 cs.CR cs.AI 57%

Breaking the Protocol: Security Analysis of the Model Context Protocol Specification and Prompt Injection Vulnerabilities in Tool-Integrated LLM Agents

打破协议:模型上下文协议规范的安全分析及工具集成LLM代理中的提示注入漏洞

Narek Maloyan, Dmitry Namiot

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文分析了模型上下文协议的安全漏洞,提出MCPSec协议扩展以提升安全性,减少攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11078 2026-01-19 cs.RO cs.AI 57%

Visual Marker Search for Autonomous Drone Landing in Diverse Urban Environments

面向异质城市环境的自主无人机着陆视觉标记搜索

Jiaohong Yao, Linfeng Liang, Yao Deng, Xi Zheng, Richard Han, Yuankai Qi

机构 * School of Computing, Macquarie University(计算学院,麦考瑞大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文提出基于模拟的评估套件,研究异质城市环境中自主无人机着陆的视觉标记搜索问题,通过对比启发式策略与强化学习方法,探讨复杂场景对着陆性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22023 2026-01-19 cs.LG 57%

Teaching Transformers to Solve Combinatorial Problems through Efficient Trial & Error

通过高效试错教学变压器解决组合问题

Panagiotis Giannoulis, Yorgos Pantis, Christos Tzamos

机构 * National Technical University of Athens(希腊雅典国家技术大学) National and Kapodistrian University of Athens(希腊雅典国家与卡波迪斯特里亚大学) Archimedes, Athena Research Center(阿提卡研究中心阿基米德)

专题命中 工具调用 :function calling(abstract);分类 cs.LG

AI总结 本研究通过高效试错方法,利用Transformer解决数独问题,达到99%的准确率,无需外部工具,结合模仿学习与DFS探索策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08970 2026-01-15 cond-mat.mtrl-sci cs.LG 57%

Machine Learning-Driven Creep Law Discovery Across Alloy Compositional Space

基于机器学习的合金成分空间中的蠕变定律发现

Hongshun Chen, Ryan Zhou, Rujing Zha, Zihan Chen, Wenpan Li, Rowan Rolark, John Patrick Reidy, Jian Cao, Ping Guo, David C. Dunand, Horacio D. Espinosa

专题命中 工具调用 :workflow(abstract);分类 cs.LG

AI总结 本文提出了一种基于机器学习的高通量框架,用于在合金成分空间中发现蠕变定律,结合DABI实验实现高效、高精度的蠕变特性表征。

Comments 27 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22256 2026-01-15 cs.CR cs.AI cs.OS 57%

Secure and Efficient Access Control for Computer-Use Agents via Context Space

通过上下文空间实现计算机使用代理的安全高效访问控制

Haochen Gong, Chenxiao Li, Rui Chang, Wenbo Shen

机构 * Zhejiang University(浙江大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 CSAgent通过引入意图和上下文感知策略,实现对计算机使用代理的安全高效访问控制,有效抵御攻击并保持系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04888 2026-01-09 cs.AI 57%

SmartSearch: Process Reward-Guided Query Refinement for Search Agents

SmartSearch: 基于过程奖励的查询优化用于搜索代理

Tongyu Wen, Guanting Dong, Zhicheng Dou

机构 * Renmin University of China(中国人民大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 SmartSearch通过过程奖励和查询优化机制提升搜索代理的查询质量与效率。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04620 2026-01-09 cs.AI 57%

AgentDevel: Reframing Self-Evolving LLM Agents as Release Engineering

AgentDevel: 将自演化大语言模型代理重新定义为发布工程

Di Zhang

机构 * Fudan University(复旦大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 AgentDevel将LLM代理改进重新定义为发布工程,通过无实现偏见的批评者、可执行诊断和翻转中心门控,实现稳定改进和可审计的发布流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03782 2026-01-08 cs.RO cs.AI cs.CV 57%

PointWorld: Scaling 3D World Models for In-The-Wild Robotic Manipulation

PointWorld: 为真实世界机器人操作扩展3D世界模型

Wenlong Huang, Yu-Wei Chao, Arsalan Mousavian, Ming-Yu Liu, Dieter Fox, Kaichun Mo, Li Fei-Fei

机构 * Stanford University(斯坦福大学) NVIDIA(英伟达)

专题命中 工具调用 :tool use(abstract);分类 cs.AI

AI总结 PointWorld通过统一状态和动作的3D点流模型,实现了在真实世界中机器人操作的高效预测与控制,无需额外演示或训练。

详情

展开后加载摘要…

URL PDF HTML 收藏