arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-02 至 2026-07-02 共收录 158 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 30 篇

2607.01044 2026-07-02 cs.RO 新提交 67%

Robots Ask the Way: Communication-Enabled Social Navigation

机器人问路:支持通信的社交导航

Valentino Sacco, Luca Scofano, Indro Spinelli, Fabio Galasso

机构 * Sapienza University of Rome(罗马大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出CommNav任务,让机器人通过主动与居民通信获取信息来定位目标个体,在Habitat 3.0c环境中评估,通信模块使导航成功率提升10个百分点,且对自然语言鲁棒。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00604 2026-07-02 math.OC 新提交 67%

Vehicle Routing Problem Meets Large Language Models: An Overview and Perspectives

车辆路径问题遇上大语言模型:综述与展望

Xianchao Xiu, Chong Shen, Yanjiao Zhu, Wanquan Liu

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 综述大语言模型在车辆路径问题中的应用,涵盖模型构建、算法设计、协调工具等角色,并讨论基准测试与实验。

Comments working in process

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00359 2026-07-02 math.RA 新提交 67%

The Equivalence Problem for Generalized Airy Operators

广义Airy算子的等价问题

Yichuan Cao, Ruyong Feng, Yunfei Li, Ruichen Qiu

专题命中 多智能体 :agent(abstract,abstract_cn)

AI总结 本文建立了同类型广义Airy算子等价的度障碍,并回答了Katz在1987年提出的问题,主要结果通过人机协作获得。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16719 2026-07-02 cs.CV 67%

Emotion-Aware Classroom Quality Assessment Leveraging IoT-Based Real-Time Student Monitoring

基于物联网的实时学生监控情感感知教室质量评估

Hai Nguyen, Hieu Dao, Hung Nguyen, Nam Vu, Cong Tran

机构 * Posts and Telecommunications Institute of Technology (PTIT)(邮电技术学院(PTIT))

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出一个高吞吐量的多智能体情感计算框架,通过实时监控学生情绪状态提升课堂教学质量,利用教室情绪数据集验证了系统在实时处理和情感分类中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00654 2026-07-02 cs.CV 版本更新 67%

RC-GeoCP: Geometric Consensus for Radar-Camera Collaborative Perception

RC-GeoCP:雷达-相机协同感知的几何一致性

Xiaokai Bai, Lianqing Zheng, Runwei Guan, Siyuan Cao, Songkai Wang, Huiliang Shen

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) School of Automotive Studies, Tongji University(同济大学汽车学院) Thrust of Artificial Intelligence, Hong Kong University of Science and Technology(香港科技大学人工智能研究所)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出首个4D雷达与相机协同感知框架RC-GeoCP,通过雷达锚定几何一致性解决深度模糊和空间分散导致的错位,实现高效通信与全局一致表示。

Comments 11 pages, 6 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00481 2026-07-02 cs.CR cs.AI 新提交 57%

Beyond the Prompt: Jailbreaking Function-Calling LLMs via Simulated Moderation Traces

超越提示:通过模拟审核轨迹越狱函数调用大语言模型

Junlong Liu, Haobo Wang, Weiqi Luo, Xiaojun Jia

专题命中 多智能体 :workflow(abstract);分类 cs.AI

AI总结 针对函数调用大语言模型的结构性漏洞,提出基于模拟审核轨迹的黑盒攻击框架SMT,通过多轮交互绕过安全约束,在多个商业模型上实现高攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00910 2026-07-02 cs.MA 新提交 50%

Calibrating the Instrument: Controllability of an LLM-Driven Synthetic Population

校准仪器:LLM驱动的合成人群的可控性

Mirko Degli Esposti

专题命中 多智能体 :agent(abstract)

AI总结 提出SIVE实验,通过七项预注册标准评估LLM驱动合成人群对已知效价刺激的响应可控性,发现弱阳性消息被识别为阴性,经重新设计后恢复预期排序,并揭示噪声特性与微观动力学。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 13 篇

2604.18752 2026-07-02 hep-ph hep-ex 版本更新 82%

A Scientific Human-Agent Reproduction Pipeline

一种科学人机再生产流水线

Joschka Birk, Gregor Kasieczka, Siddharth Mishra-Sharma, Benjamin Nachman, Dennis Noll, Tanvi Wamorkar

专题命中 工作流自动化 :agent(title,abstract);AI agent(abstract)

AI总结 本文提出SHARP框架,通过人机协作实现科学分析的再生产,通过AI代理自动执行代码生成、测试和质量保证,研究人员在关键节点提供反馈和指导,提升科学理解而非替代人类。

Comments 6 pages, 1 figure, submitted to 2026 Conference on Physics and AI (PAI26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01102 2026-07-02 cs.SE 新提交 79%

SAGE: Structured Agentic Graph Editing for Software Diagrams

SAGE: 结构化智能体图编辑用于软件图表

Tyler Sivertsen, Neal Singh, James C. Davis

专题命中 工作流自动化 :agentic(title);workflow(abstract);分类 cs.SE

AI总结 提出SAGE工具,通过自然语言提示编辑软件图表,将图表映射为可编辑图结构,翻译请求为结构化编辑意图并执行操作,支持验证修复和版本管理,通过单元测试和Kubernetes案例评估有效性。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00989 2026-07-02 cs.HC cs.AI 新提交 79%

SenseWalk: Agent-Based Semantic Trajectory Simulation Powered by Large Language Models in Zoned Environments

SenseWalk: 基于智能体的语义轨迹模拟——由大型语言模型在分区环境中驱动

Ziyue Lin, Xinhang Xie, Kangyi Wang, Siming Chen

机构 * School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 工作流自动化 :agent(title);workflow(abstract);分类 cs.AI

AI总结 提出SenseWalk系统,结合大语言模型与社会力模型,通过智能体模拟语义轨迹,并提供用户界面以简化配置与分析,实验验证了其有效性和效率。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00941 2026-07-02 cs.CY 新提交 78%

From Runtime Records to Legal Findings: An Evidentiary-Adequacy Criterion for Agentic AI Oversight

从运行时记录到法律认定:面向智能体AI监管的证据充分性标准

Jeroen Janssen

专题命中 工作流自动化 :agentic(title,abstract)

AI总结 提出一个证据充分性标准,要求运行时记录必须包含事件类型和关系(如来源、权限)才能支持法律认定,并基于欧盟AI法案监管义务实例化该标准。

Comments 12 pages, technical report; companion materials deposited on Zenodo, DOI: 10.5281/zenodo.21025237

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17041 2026-07-02 cs.CL cs.IR 新提交 70%

MetaSyn: A Benchmark for LLM Agents on Meta-Analysis Articles from Nature Portfolio

对Nature Portfolio元分析文章进行LLM代理基准测试

Anzhe Xie, Weihang Su, Yujia Zhou, Yiqun Liu, Min Zhang, Qingyao Ai

机构 * Tsinghua University(清华大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 提出MetaSyn数据集,包含442篇专家策划的元分析,用于评估LLM代理在检索-筛选-综合全流程中的表现,发现当前系统在筛选阶段存在严重瓶颈。

Comments 17 pages, 8 figures, 11 tables. Code and evaluation: https://github.com/THUIR/MetaSyn Dataset: https://huggingface.co/datasets/THUIR/MetaSyn Model: https://huggingface.co/BFTree/MA-Retriever

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16085 2026-07-02 cs.CV cs.AI 版本更新 57%

Interact3D: Compositional 3D Generation of Interactive Objects

Interact3D: 交互式物体的组合3D生成

Hui Shan, Keyang Luo, Ming Li, Sizhe Zheng, Yanwei Fu, Zhen Chen, Xiangru Huang

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Westlake University(西湖大学) Adobe Fudan University(复旦大学)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 提出Interact3D框架,通过统一3D引导场景、两阶段组合流水线(全局到局部几何对齐和基于SDF的优化)以及闭环智能体修正策略,从单张图像生成物理合理的交互式3D组合物体,解决遮挡和空间关系保持问题。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11046 2026-07-02 cs.LG 版本更新 57%

OpFML: Pipeline for ML-based Operational Inference

OpFML:基于机器学习的业务推理管道

Shahbaz Alvi, Giusy Fedele, Gabriele Accarino, Italo Epicoco, Ilenia Manco, Pasquale Schiano

机构 * CMCC Foundation - Euro-Mediterranean Center on Climate Change(CMCC基金会 - 欧洲地中海气候变化中心) Columbia University, Department of Earth and Environmental Engineering(哥伦比亚大学地球与环境工程系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 提出OpFML管道,整合数据消费、应急处理、预处理和模型推理四步,消除部署样板代码,用于气候与地球科学模型的业务化推理。

Comments 7 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00851 2026-07-02 q-bio.NC q-bio.QM 50%

DRIADA: A Python Toolkit for Cross-Scale Analysis of Single-Neuron Selectivity and Population Dynamics

DRIADA: 一个用于单神经元选择性和群体动力学跨尺度分析的Python工具包

Nikita Pospelov, Viktor Plusnin, Olga Rogozhnikova, Anna Ivanova, Vladimir Sotskov, Margarita Orobets, Ksenia Toropova, Olga Ivashkina, Vladik Avetisov, Konstantin Anokhin

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出DRIADA,一个统一神经信号与行为数据的Python框架,通过共享数据模型整合选择性测试、降维和网络分析,在合成数据、小鼠海马钙成像和环形吸引子网络验证中实现跨尺度分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00350 2026-07-02 stat.ME 50%

Robust Estimation and Inference with Selective Borrowing in Hybrid Controlled Trials: A Tutorial with SelectiveIntegrative and intFRT

混合对照试验中选择性借用的稳健估计与推断:基于SelectiveIntegrative和intFRT的教程

Ke Zhu, Hairong Huang, Shu Yang, Xiaofei Wang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出混合对照试验中利用外部对照进行选择性借用的工作流程,通过SelectiveIntegrative和intFRT包实现稳健估计与推断,提高效率并保证推断有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01189 2026-07-02 eess.SY cs.SY 新提交 50%

TERA: A Unified Taylor Model Enabled Reachability Analysis Framework

TERA: 一个统一的泰勒模型可达性分析框架

Salma Iraky, Andrew Sogokon

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出TERA框架,基于泰勒模型对连续、混合和随机系统进行统一的可达性分析,通过符号-数值工作流计算紧致可达集上近似,支持非线性ODE和混合系统基准测试。

Comments Presented at CONTROL 2026: 15th United Kingdom Automatic Control Council (UKACC) International Conference on Control, Newcastle upon Tyne, 23-25 June 2026. Proceedings: https://web.archive.org/web/20260622121207/http://control2026.ukcontrol.org/wp-content/uploads/2026/06/Control-2026-Proceedings-Booklet.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01132 2026-07-02 astro-ph.IM 新提交 50%

WST, the Wide-field Spectroscopic Telescope: Mechanical Design and FE Analyses for the High Resolution Spectrograph

WST,广域光谱望远镜:高分辨率光谱仪的机械设计与有限元分析

Simone D'Auria, Andrea Tozzi, Anna Brucalassi, Matteo Munari, Ciro Del Vecchio, Maria Sofia Randich, Roland Bacon, David Lee

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文介绍了WST高分辨率多目标光谱仪(MOS-HR)的机械设计,采用垂直光学平台配置,通过有限元分析验证了结构稳定性和环境鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07221 2026-07-02 cs.CV 版本更新 50%

Histopathology Multi-modal Embedding for Pathology Composed Retrieval

病理学组合检索的组织病理学多模态嵌入

Qifeng Zhou, Wenliang Zhong, Thao M. Dang, Hehuan Ma, Saiyang Na, Yuzhi Guo, Junzhou Huang

机构 * The University of Texas at Arlington(德克萨斯大学阿灵顿分校)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出HOMIE框架,将生成式多模态大语言模型适配为病理检索专家,解决组合查询中的架构、任务和领域不匹配问题,在病理组合检索基准上显著优于现有方法。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09907 2026-07-02 physics.chem-ph 50%

Multi-head committees enable direct uncertainty prediction for atomistic foundation models

多头委员会使原子基础模型能够直接进行不确定性预测

Hubert Beck, Pavol Simko, Lars L. Schaaf, Ondrej Marsalek, Christoph Schran

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出利用多头委员会机制构建神经网络势能,用于原子基础模型的不确定性预测,通过主动学习将训练集缩小至原大小的5%,同时保持预测精度。

Comments 11 pages, 7 figures in main article + supporting information

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 12 篇

2607.00911 2026-07-02 cs.SE 新提交 88%

From Registry to Repository: How AI Agent Skills Are Written, Adapted, and Maintained

从注册表到仓库:AI代理技能如何编写、适配和维护

Haoyu Gao, Jai Lal Lulla, Hong Yi Lin, Sebastian Baltes, Christoph Treude, Mansooreh Zahedi

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.SE

AI总结 本研究首次对AI代理技能作为工程制品进行实证分析,通过挖掘公共注册表和GitHub仓库中的技能,发现技能重用多为一次性复制,定制化主要适配本地环境,而行为契约几乎不变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14690 2026-07-02 cs.SE 版本更新 84%

Harness Engineering for Agentic AI Coding Tools: An Exploratory Study

配置代理AI编码工具:探索性研究

Matthias Galster, Seyedmoein Mohsenimofidi, Jai Lal Lulla, Muhammad Auwal Abubakar, Christoph Treude, Sebastian Baltes

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.SE

AI总结 本文探讨了代理AI编码工具的配置机制,分析了多种工具的配置方法,发现Context Files主导配置,并提出AGENTS.md作为通用标准。

Comments 10 pages, 7 figures, 3 tables, based on "Configuring Agentic AI Coding Tools: An Exploratory Study" published in Proceedings of the 3rd ACM/IEEE International Conference on AI-powered Software (AIware 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00016 2026-07-02 cs.IR cs.AI 新提交 83%

Libra: Training the Environment for Agentic Information Retrieval

Libra: 为智能信息检索训练环境

Xuan Zhao, Andy Chiu, Gengyu Wang

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出Libra框架,通过引入可变目录和LLM驱动优化循环,自动改进代码仓库的索引结构,提升代码定位准确率,并实现跨模型和问题的零样本迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00053 2026-07-02 cs.SE cs.AI 新提交 81%

SWE-Router: Routing in Multi-turn Agentic Software Engineering Tasks

SWE-Router:多轮智能体软件工程任务中的路由

Seongho Son, Sangwoong Yoon, Jiahua Tang, Shuhan Wang, Lorenz Wolf, Ilija Bogunovic

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 提出SWE-Router,一种基于价值的时间路由方法,通过让廉价模型探索几轮后根据部分轨迹决定是否升级到昂贵模型,在保持强模型大部分性能的同时大幅提升成本效率。

Comments The 5th Deep Learning for Code Workshop, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00038 2026-07-02 cs.SE 新提交 79%

Stop Hand-Holding Your Coding Agent: Engineering the Loops that Replace Step-by-Step Prompting

停止手把手指导你的编码智能体:设计替代逐步提示的循环机制

Sandeco Macedo

专题命中 软件智能体 :agent(title,abstract);分类 cs.SE

AI总结 本文提出循环规范作为替代逐步提示的编码智能体新范式,定义其结构、分类与设计原则,并通过真实语料分析验证其成熟度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00035 2026-07-02 cs.AI 新提交 79%

Making Failure Safe: A Constrained, Verifiable Agent Framework for Open-Web Data Collection

确保失败安全:一个用于开放网络数据收集的受约束、可验证的智能体框架

Bo Chen

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI

AI总结 提出一个受约束、可验证的智能体框架,通过将LLM输出从自由形式代码转换为类型化JSON收集器配置,结合六类型收集器分类、模板和效用函数约束、静态Airflow DAG执行、基于规则的质量检查和结构化反馈纠正,实现了零执行阶段LLM令牌消耗和最低平均挂钟时间。

Comments 15 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00990 2026-07-02 cs.SE cs.AI 新提交 62%

SWE-Doctor: Guiding Software Engineering Agents with Runtime Diagnosis from Multi-Faceted Bug Reproduction Tests

SWE-Doctor: 通过多面缺陷复现测试的运行时诊断引导软件工程智能体

Yaoqi Guo, Yang Liu, Jie M. Zhang, Yun Ma, Yiling Lou, Zhenpeng Chen

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 提出SWE-Doctor,通过生成多面缺陷复现测试并执行调试,构建运行时诊断记录,结合定位信息指导补丁生成,在SWE-bench Verified和Pro上平均解决率分别达75.7%和59.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01213 2026-07-02 cs.SE 新提交 57%

RepoRescue: An Empirical Study of LLM Agents on Whole-Repository Compatibility Rescue

RepoRescue: LLM智能体在全仓库兼容性修复上的实证研究

Zhihao Lin, Mingyi Zhou, Zhensu Sun, Yizhuo Yang, Renyu Yang, David Lo, Li Li

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 研究LLM智能体能否自动修复因环境演化而失效的旧仓库,提出RepoRescue基准,包含315个仓库,评估多种智能体系统,发现跨文件协调是主要难点,且系统间互补性显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00895 2026-07-02 cs.CL 新提交 57%

Beyond Document Grounding: Span-Level Hallucination Detection over Code, Tool Output, and Documents

超越文档基础:代码、工具输出和文档上的跨度级幻觉检测

Ádám Kovács, Bowei He, Xue Liu, István Boros, Szilveszter Tóth, Gábor Recski

机构 * KR Labs(KR实验室) MBZUAI(穆罕默德·本·扎耶德人工智能大学) McGill University(麦吉尔大学) TU Wien(维也纳工业大学)

专题命中 软件智能体 :agent(abstract);分类 cs.CL

AI总结 提出一个统一的跨度级幻觉检测基准,涵盖代码、工具输出、结构化文档和自然语言RAG数据,通过微调Qwen3.5-2B模型在跨域场景下显著优于现有方法。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01138 2026-07-02 cs.CR 新提交 50%

Antaeus: Hunting Repository-Level Logic Vulnerabilities via Context-Grounded LLM Reasoning

Antaeus: 通过上下文锚定的LLM推理发现仓库级逻辑漏洞

Michele Armillotta, Nicolò Romandini, Rebecca Montanari, Lorenzo Cavallaro

专题命中 软件智能体 :agentic(abstract)

AI总结 提出Antaeus框架,通过仓库级代码上下文锚定LLM推理,结合函数优先级排序、上下文推理、比较验证和结构化报告,有效检测逻辑漏洞,在28个仓库中检测出15个漏洞,优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏