arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 522 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 522 篇

2608.19933 2026-08-21 cond-mat.mtrl-sci 新提交 50%

Building atomistic models of heterointerfaces with optimal transport

基于最优传输构建异质界面的原子模型

Yuxuan Tang, Keith T. Butler

专题命中 工具调用 :workflow(abstract)

AI总结 本文提出融合格罗莫夫-瓦瑟斯坦(FGW)距离结合贝叶斯优化的工作流,构建异质界面原子模型,可高效筛选界面晶格匹配关系,性能优于随机搜索及预训练MACE能量引导方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18673 2026-08-20 cs.CV 新提交 50%

DynCur-Geo: Dynamic Curiosity Reward Shaping for Multimodal Active Geo-Localization

DynCur-Geo:面向多模态主动地理定位的动态好奇心奖励塑造

Yiming Sun, Yang Zhang, Pengfei Zhu

专题命中 工具调用 :agent(abstract)

AI总结 本文提出DynCur-Geo动态好奇心框架,通过距离感知门与势能奖励塑造优化多模态主动地理定位,在多场景实验中较基线方法取得一致性能提升。

Comments 24 pages, 18 figures, 15 tables. The main paper is 7 pages, with supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18454 2026-08-20 cs.RO 新提交 50%

Backward Layout Search for Sequence-Constrained Robotic Assembly

面向序列约束机器人装配的反向布局搜索

Xi Zhang, Jiancong Dai, Hao Chen, Zhengtao Hu, Changcai Yang, Weiwei Wan

机构 * College of Computer and Information Sciences, Fujian Agriculture and Forestry University(福建农林大学计算机与信息学院) School of Mechatronic Engineering and Automation, Shanghai University(上海大学机电工程与自动化学院) Department of System Innovation, Graduate School of Engineering Science, Osaka University(大阪大学工程科学研究生院系统创新系)

专题命中 工具调用 :planning(abstract)

AI总结 针对序列约束机器人装配布局规划的挑战,提出反向布局搜索(BLS)算法,通过反向分配零件初始位姿并结合多维度检查与波束选择,在5个装配模型上实现了更优的无碰撞布局规划,减少了评估次数与搜索时间。

Comments Submit to ROBIO2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18309 2026-08-20 cs.CV 新提交 50%

XRF-to-Optical Field-of-View Localization with Vision Language Models

基于视觉语言模型的X射线荧光(XRF)与光学显微镜视场(FOV)定位

Xiangyu Yin, Tatjana Paunesku, Letonia Copeland-Hardin, Martina Ralle, Zichao Wendy Di, Si Chen, Gayle E. Woloschak, Barry Lai, Mathew J. Cherukara, Stefan Vogt

机构 * Northwestern University(西北大学) University of Chicago(芝加哥大学) Oregon Health and Science University(俄勒冈健康与科学大学) Argonne National Laboratory(阿贡国家实验室)

专题命中 工具调用 :workflow(abstract)

AI总结 本文针对跨模态显微图像的视场定位难题,提出结合视觉语言模型(VLM)的候选生成-验证工作流,在低对应度的相邻切片成像数据中实现了有效定位,为关联XRF与光学显微测量提供了支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19008 2026-08-20 physics.ao-ph 新提交 50%

Extremes on Rewind: Generating 1,000-Member Ensembles Initialized at a Final Condition

回溯极端事件:在最终状态条件下初始化生成1000成员集合

Jerry Lin, Mu-Ting Chien, Mansi Sakarvadia, Elizabeth A. Barnes

专题命中 工具调用 :planning(abstract)

AI总结 本研究使用非自回归基础模型cBottle-video生成1000成员集合,针对三个极端事件验证了终点约束集合的多样性与有效性,为罕见高影响事件的情景规划提供了高效方案。

Comments 38 pages, 21 figures; includes 17 pages of Supporting Information with 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17446 2026-08-19 econ.TH 新提交 50%

Searchable Menus

可搜索菜单

Frank Yang, Piotr Dworczak

专题命中 工具调用 :agent(abstract)

AI总结 本文研究代理人视角下受可处理性约束的最优筛选机制,提出可搜索菜单要求,在多产品垄断等不同场景推导最优可搜索菜单形式,得出多维筛选中可搜索性限制可实施结果集合的结论。

Comments 83 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17889 2026-08-19 cs.IR 新提交 50%

VisDocAgentBench: Benchmarking Agents for Visually Rich Document Retrieval

VisDocAgentBench:面向视觉丰富文档检索的智能体基准测试

Lexiang Hu, Yanzhao Zhang, Mingxin Li, Dingkun Long, Yikang Li, Fuwei Zhang, Yisen Wang, Zhouchen Lin

专题命中 工具调用 :agentic(abstract)

AI总结 该研究提出VisDocAgentBench基准,对比静态与智能体检索,发现视觉检索优于OCR文本检索,智能体可改善双桥项检索性能,为检索智能体发展提供方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16041 2026-08-18 cs.RO 新提交 50%

ScenarioCharacterization: A Modular Toolkit for Characterizing Safety across Trajectory Datasets

ScenarioCharacterization:用于刻画轨迹数据集安全性的模块化工具包

Ingrid Navarro, Yutong Duan, Jonathan Francis, Jean Oh

机构 * Robotics Institute, School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机学院机器人研究所) Stack AV Bosch Center for Artificial Intelligence(博世人工智能中心)

专题命中 工具调用 :agent(abstract)

AI总结 本文提出开源模块化框架ScenarioCharacterization,可自动刻画轨迹数据集的驾驶场景安全性,适配多数据集,在Waymo等数据集上验证,支持下游应用。

Comments 9 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12872 2026-08-14 eess.SP 新提交 50%

Efficient and Accurate Surrogate-Assisted Electromagnetic Parameter Calibration for 6G Digital Twin Channels

面向6G数字孪生信道的高效高精度代理辅助电磁参数校准方法

Xiaofan Zou, Pan Tang, Peijie Liu, Changyou Tai

专题命中 工具调用 :workflow(abstract)

AI总结 针对6G数字孪生信道电磁参数校准的效率与精度瓶颈,提出SGWO-IM算法,通过代理模型预筛选与优化策略,使RT仿真调用量降62.5%、RMSE降至2.97 dB,实现效率与精度的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12039 2026-08-13 cs.DM 新提交 50%

Search and Rescue on the Plane

平面上的搜索与救援问题

Jared Coleman, Evangelos Kranakis, Danny Krizanc, Oscar Morales-Ponce

专题命中 工具调用 :agent(abstract)

AI总结 该研究针对平面搜索与救援问题,确定临界角$\theta^* \approx 15.6^\circ$,据此给出不同角度下智能体的最优检查点,推导竞争比闭式表达式,优化搜索与交付的竞争性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09993 2026-08-12 eess.IV cs.CV 新提交 50%

APCReg: Anatomical-Prior-Guided Coarse-to-Fine CBCT--IOS Registration via Multi-View Projection and Reliability-Controlled Residual Correction

APCReg:基于解剖先验的、经多视图投影与可靠性控制残差校正的CBCT与口腔内扫描(IOS)粗到精配准方法

Xincan Zheng, Yaqi Wang, Zhi Li, Jiahao Bao, Lan Feng, Yiru Xia, Shuai Wang

专题命中 工具调用 :planning(abstract)

AI总结 针对CBCT与IOS自动配准不可靠的问题,提出APCReg框架,通过多视图解剖粗配准、重叠感知残差配准及牙弓结构假设选择等技术,在60个颌骨对的评估中多项指标优于开源基线。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10281 2026-08-12 cs.CR 新提交 50%

From Prompt Injection to Web Exploitation: Revisiting Classic Vulnerabilities in LLM-Integrated Applications

从提示注入到Web漏洞利用:重新审视集成大语言模型的应用中的经典漏洞

Spiros Tsigkopoulos, Christoforos Ntantogian

专题命中 工具调用 :agentic(abstract)

AI总结 本文研究集成大语言模型的Web应用的新型攻击LLM介导的Web攻击,提出LLM2X系列攻击类型,通过实现TicketOracle实验发现模型易感性差异,给出多层缓解策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09682 2026-08-11 cs.CV 新提交 50%

Thinking With Tools, Not With Pixels: Tool Calls as Text Scaffolds for Visual Reasoning

用工具思考,而非用像素思考:工具调用作为视觉推理的文本支架

Jiahao Shao, Yuanbo Yang, Yiyi Liao, Yujun Shen, Ceyuan Yang, Yinghao Xu

机构 * Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Zhejiang University(浙江大学)

专题命中 工具调用 :tool use(abstract)

AI总结 该研究提出工具调用支架假设,引入TextCall方法验证返回图像冗余,仅用结构化文本支架即可实现视觉推理,降低延迟并消除工具API调用,结论适用于现有相关基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08261 2026-08-11 cs.DB 新提交 50%

Scout: Scalable Document Extraction via Data Similarity

Scout:基于数据相似度的可扩展文档提取工具

Yiming Lin, Chiyu Hao, Shreya Shankar, Aditya G. Parameswaran

专题命中 工具调用 :agent(abstract)

AI总结 Scout是一款基于文档相似度的可扩展文档提取工具,通过生成优化规则集实现高性价比数据提取,在多个真实数据集上达到与前沿LLM相当的准确率,成本大幅降低且优于同类基于程序的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08347 2026-08-11 math.NT 新提交 50%

Machine-Guided Recurrence Boundary Theory for Nahm Sums

用于纳姆和(Nahm sums)的机器引导递推边界理论

Ankush Goswami

专题命中 工具调用 :agent(abstract)

AI总结 该研究开发了机器引导的递推边界理论,结合符号搜索与Q学习发现关键结果,证明了Shi和Wang的猜想3.8,得到Zagier第十二个三阶秩示例对偶纳姆和的二阶递推与五单元证明。

Comments Comments Welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06680 2026-08-10 physics.chem-ph 新提交 50%

Physics-Grounded Materials Artificial Intelligence for Reliable Materials Discovery

基于物理学原理的材料人工智能用于可靠的材料发现

Yuhang Wang, Qian Wang, Seong-Hoon Jang, Hao Li

专题命中 工具调用 :AI agent(abstract)

AI总结 该研究提出PhysMat AI框架,整合物理知识用于材料发现,通过多领域示例说明其应用,还规划了从物理感知到自主AI的发展路线,助力可靠材料发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05301 2026-08-07 stat.ME 新提交 50%

Precision and Decisiveness as Goals: Reliable Sequential Hypothesis Testing with a Dual Stopping Criterion

以精度和决断性为目标:采用双重停止准则的可靠序贯假设检验

Eyal A. Kazin

专题命中 工具调用 :planning(abstract)

AI总结 该研究提出DPitG方法,结合精度目标与明确裁决,将PitG的不确定率从62%降至2%且零假阳性,符合预注册标准,适用于需可靠裁决的场景。

Comments Main section 17 pages and 9 figures, Seven Abstracts in 7 pages and 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06007 2026-08-07 cs.DC 新提交 50%

TensorCast: The Missing Tensor Management Layer in Large Language Model Infrastructure

TensorCast:大语言模型基础设施中缺失的张量管理层

Yuhan Zhou, Yuchu Luo, Hao Nie, Wangrunze Lv, Yu Zhou, Yibo Zhu, Daxin Jiang, Chenren Xu

专题命中 工具调用 :agent(abstract)

AI总结 该研究针对LLM基础设施中张量管理策略复用受阻的问题,提出TensorCast分布式张量管理层,将张量状态管理与计算逻辑解耦,在保持性能的同时提升多轮智能体工作负载的TTFT达93.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04198 2026-08-06 econ.GN q-fin.EC 新提交 50%

Does generative AI narrow education-based productivity gaps? Evidence from a randomized experiment

生成式人工智能是否缩小了基于教育背景的生产力差距?来自随机实验的证据

Guillermo Cruces, Diego Fernandez Meijide, Sebastian Galiani, Ramiro Galvez, Maria Lombardi

专题命中 工具调用 :tool use(abstract)

AI总结 通过对1174名成年人的随机实验发现,生成式AI缩小了不同教育背景劳动者的任务执行生产力差距,且提升效果并非完全源于任务委托。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04280 2026-08-06 math.AP 新提交 50%

Full-Density Degenerate Stagnation Points for Water Waves with General Vorticity

带一般涡量的水波的全密度退化驻点

Lili Du, Chunlei Yang

专题命中 工具调用 :tool use(abstract)

AI总结 本文针对带一般涡量的二维行进重力水波,利用改进的Weiss型单调性公式与Almgren型频率公式,证明了严格双侧线性增长区域外不存在全密度退化驻点,并推广了旋转波的Stokes猜想。

Comments 26 Pages. Comments and suggestions are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02414 2026-08-04 cs.DC cs.PF 新提交 50%

Analyzing GPU Performance in Virtualized Environments: A~Case Study

虚拟化环境中的GPU性能分析:一项案例研究

Adel Belkhiri, Michel Dagenais

专题命中 工具调用 :tool use(abstract)

AI总结 本文针对当前性能工具不支持虚拟GPU(vGPU)的问题,提出一款兼容Intel GVT-g的新型性能分析工具,通过软件追踪技术收集数据并生成指标,助力识别vGPU虚拟机的性能瓶颈。

Comments 18 pages, 12 figures, 5 tables

Journal ref Future Internet 2024, 16, 72

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01789 2026-08-04 cs.NE 新提交 50%

Towards Autonomous Formulaic Alpha Discovery: An Evolutionary Computation Perspective

面向自主公式化阿尔法发现:进化计算视角

Xinwei Yu, Yiyang Fu, Mingcheng Fan, Enqi Li, Yilin Gao, Shugong Xu

专题命中 工具调用 :agentic(abstract)

AI总结 本文从进化计算视角,提出自动化公式化阿尔法发现的统一分析与评估框架,为开发可靠的自主阿尔法发现系统奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01526 2026-08-04 cs.NI 新提交 50%

An Internet for the KV Cache: Rethinking Classical Infrastructure Boundaries in the LLM Inference Age

面向KV缓存的互联网:在大语言模型推理时代重新思考经典基础设施边界

Siddhant Ray, Nick Feamster, Junchen Jiang

专题命中 工具调用 :tool-use(abstract)

AI总结 该研究提出面向KV缓存的互联网愿景,主张跨云与数据中心解耦计算与KV缓存存储,将KV缓存管理作为内容分发系统,以最小化大语言模型推理的延迟与成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26402 2026-07-30 cs.CY 新提交 50%

From Micro-Cognition to Self-Construction: A Four-Layer Integrative Review of Psychological Theories in HCI

从微观认知到自我建构:人机交互中心理学理论的四层整合综述

Xiaohe Bie, Bo Wang, Xinyu Long

专题命中 工具调用 :tool use(abstract)

AI总结 本文针对HCI从“工具使用”向“心智共生”的范式转变,提出四层整合心理学理论框架,明确其对生成式AI等场景的启示及核心挑战与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25342 2026-07-29 astro-ph.EP astro-ph.IM 新提交 50%

GRaTer-JAX: An Accelerated Package for Debris Disk Modeling

GRaTer-JAX:用于碎屑盘建模的加速软件包

Mihir Kondapalli, Briley L. Lewis, Jaren N. Ashcraft, Maxwell A. Millar-Blanchaer

专题命中 工具调用 :workflow(abstract)

AI总结 GRaTer-JAX是用于碎屑盘建模的Python软件包,结合GRaTer框架与JAX的高性能计算能力,提供强大高效的建模框架,能统一正向建模等工作流程,还能进行更高级建模,推动相关研究发展。

Comments 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24610 2026-07-28 cs.GT 新提交 50%

CAP-DO: Learned Contextual Action Proposals for Certified Double-Oracle Solving Across Related Zero-Sum Games

CAP-DO:用于跨相关零和博弈的认证双预言机求解的学习上下文动作提议

Mu Wang, Zhenkun Liu, Liang Liang, Guofu Zhang

专题命中 工具调用 :planning(abstract)

AI总结 研究针对解决一系列相关零和博弈问题,提出CAP-DO框架,通过离线训练排序器、在线提议动作集,结合学习与当前博弈确定输出,理论上保留认证保证且有限收敛,实验中在多规模基准测试里有更好表现。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22894 2026-07-28 physics.app-ph 新提交 50%

A Single-Tuning-Element Loaded Pixelated Tunable Band-Pass Filters with Low Loss via Inverse Synthesis on Massive-Scale Dataset

通过大规模数据集上的逆合成实现具有低损耗的单调谐元件加载像素化可调带通滤波器

Woojun Lee, Pouya Faeghi, Jeffrey S. Walling

专题命中 工具调用 :workflow(abstract)

AI总结 该论文提出三相逆设计流程合成可调像素化带通滤波器,先获取大规模数据集,经暴力搜索识别初始种子,再用直接二分搜索算法微调。考虑4G和5G频段目标,设计的滤波器实现28%调谐范围,且仅用单个变容二极管,是微波领域首次连续可重构逆设计演示。

Comments 4 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20175 2026-07-23 cs.CV 新提交 50%

PerceptDrive: Perception Prior World-Action Modeling with Adaptive Expert Routing for End-to-End Autonomous Driving

PerceptDrive:用于端到端自动驾驶的具有自适应专家路由的感知先验世界-动作建模

Yushan Liu, Tianxiong Lv, Bohua Wang, Hangqi Fan, Chenxu Zhao, He Zheng, Xuchang Zhong, Yifan Xie, Congyang Zhao, Zhihao Liao, Leigang Luo, Yang Cai, Xiao-Ping Zhang, Wenbo Ding

机构 * Tsinghua University(清华大学) AMap, Alibaba Group(高德软件有限公司,阿里巴巴集团)

专题命中 工具调用 :planning(abstract)

AI总结 研究针对自动驾驶中感知基础模型的问题,提出PerceptDrive框架,将教师提炼先验和观察潜变量输入可训练模型,经特定分支处理、先验保留及场景条件路由,实验表明其性能领先,证实相关方法的有效性及对先验的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19545 2026-07-23 cs.CR 新提交 50%

When HTTP 402 Meets the Blockchain: Risks on Emerging x402 Payments

当HTTP 402遇上区块链:新兴x402支付的风险

Qinying Wang, Yong Yang, Yuan Chen, Shouling Ji, Mathias Payer

专题命中 工具调用 :AI agent(abstract)

AI总结 研究x402支付协议,通过系统研究确定促进者的安全规则,基于规则违规分析得出新攻击向量,提出半自动黑盒工具评估安全性,发现部署均有违规,还通过实证测量量化相关指标,揭示其安全风险。

Journal ref USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18362 2026-07-22 cs.RO 新提交 50%

FARO: Feasibility-Aware Robot Motion Optimization

FARO:可行性感知机器人运动优化

Michal Ciebielski, Shafeef Omar, Aaron Johnson, Majid Khadiv

机构 * Munich Institute of Robotics and Machine Intelligence (MIRMI), Technical University of Munich (TUM)(慕尼黑工业大学慕尼黑机器人与机器智能研究所) Institute for Advanced Study, Technical University of Munich(慕尼黑工业大学高级研究所) Carnegie Mellon University(卡内基梅隆大学) SIEMENS AG(西门子公司) Huawei-TUM joint laboratory(华为-慕尼黑工业大学联合实验室)

专题命中 工具调用 :planning(abstract)

AI总结 针对机器人在未知场景快速规划新行为的挑战,提出嵌套运动动力学框架,结合可行性引导树搜索和大语言模型采样策略,能改善搜索过程,生成的轨迹可用强化学习控制器跟踪,质量高可用于实际运动操作场景。

详情

展开后加载摘要…

URL PDF HTML 收藏