arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10492 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10492 篇

2410.17517 2026-07-23 cs.MA cs.AI cs.GT 79%

The Hive Mind is a Single Reinforcement Learning Agent

蜂群智能是单一强化学习智能体

Karthik Soma, Yann Bouteiller, Heiko Hamann, Giovanni Beltrame

机构 * MIST Lab, Department of Computer and Software Engineering(MIST实验室,计算机与软件工程系) Polytechnique Montréal(蒙特利尔大学) Mila - Quebec AI Institute(魁北克人工智能研究所) Department of Computer and Information Science(计算机与信息科学系) University of Konstanz(康斯坦茨大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 本文提出蜂群智能等价于单一强化学习智能体,通过模仿规则实现集体学习,为经济和社会系统提供新分析工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17849 2026-07-21 cs.HC cs.CL cs.CV 新提交 79%

AlphaOracle: Oracle bone script decipherment via human-workflow-inspired deep learning

AlphaOracle:通过受人工工作流程启发的深度学习进行甲骨文破译

Yuliang Liu, Haisu Guan, Pengjie Wang, Xinyu Wang, Jinpeng Wan, Kaile Zhang, Handong Zheng, Xingchen Liu, Zhebin Kuang, Huanxin Yang, Bang Li, Yongge Liu, Lianwen Jin, Xiang Bai

机构 * School of Software Engineering, Huazhong University of Science and Technology(华中科技大学软件学院) School of Electronic Information Engineering, South China University of Technology(华南理工大学电子信息学院) Key Laboratory of Oracle Bone Inscriptions Information Processing, Anyang Normal University(安阳师范学院甲骨文信息处理重点实验室)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.CL

AI总结 针对约3000个未破译甲骨文字符的问题,提出受人工工作流程启发的AlphaOracle框架,经多阶段管道进行甲骨文破译,与专家解读高度一致,还能减少分析时间,为甲骨文及其他未破译文字研究提供参考。

Comments Accepted by The Innovation 2026

Journal ref The Innovation 7(11), 101462, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17237 2026-07-21 cs.CL 新提交 79%

AI_LectureNote: A Retrospective Pilot Study of a Post-ASR Workflow for English-Script Rendering and Semantic Drift in Korean-English Medical Lectures

AI_LectureNote:关于韩英医学讲座中后ASR工作流程的回顾性试点研究,用于英文脚本渲染和语义漂移

Kyeongeon Lee, Donghoon Chang, Seungryeol Baek, Taehong Kim, Wonjun Yang

机构 * Sungkyunkwan University(成均馆大学)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.CL

AI总结 研究针对韩英医学讲座后ASR工作流程AI_LectureNote进行回顾性试点,通过恢复拉丁字母术语重写语音转文本输出,评估不同条件下脚本渲染率及语义忠实度,揭示具体失败模式,支持多方面单独评估。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13669 2026-07-20 cs.AI 版本更新 79%

Agents-K1: Towards Agent-native Knowledge Orchestration

Agents-K1:迈向智能体原生的知识编排

Zongsheng Cao, Bihao Zhan, Jinxin Shi, Jiong Wang, Fangchen Yu, Zhijie Zhong, Yingnan Han, Zijie Guo, Tianshuo Peng, Zhuo Liu, Yi Xie, Xiang Zhuang, Shengji Tang, Yue Fan, Runmin Ma, Shiyang Feng, Xiangchao Yan, Anran Liu, Peng Ye, Wenlong Zhang, Xiaosong Wang, Shufei Zhang, Chunfeng Song, Fenghua Ling, Jie Zhou, Liang He, Bo Zhang, Lei Bai

机构 * PJLab(上海人工智能实验室)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 提出Agents-K1管道,将原始文档转化为智能体原生科学知识图谱,通过多模态解析器、GRPO训练的4B信息抽取骨干和三源智能体接口,实现科学信息抽取、知识图谱构建和多跳推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13617 2026-07-16 cs.SE cs.DC 新提交 79%

A Telemetry-Driven Model for Quantifying Upgrade Risk in Durable Workflow Execution

一种用于量化持久工作流执行中升级风险的遥测驱动模型

Luca Maraschi, Matteo Collina

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 研究持久工作流执行中升级风险量化问题,提出基于遥测数据的封闭形式概率模型,结合向后和向前项分解风险,全程贝叶斯估计,给出风险分数可信区间,还能划分运行类别,放弃独立性假设后可计算耦合感知分区。

Comments 29 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13230 2026-07-16 cs.AI cs.CR cs.CY 新提交 79%

AI-Native Insurance for Agentic AI: Pricing, Underwriting, and End-to-End Automation

面向智能体人工智能的原生人工智能保险:定价、承保与端到端自动化

Quanyan Zhu

机构 * NYU Tandon School of Engineering, New York University(纽约大学坦登工程学院)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 针对智能体人工智能带来的保险挑战,开发原生人工智能数学框架,通过风险状态映射相关要素并制定优化问题,建立可保性结构属性,经医疗案例展示了合同优化等内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09996 2026-07-14 cs.AI cs.MA 新提交 79%

Who&When Pro: Can LLMs Really Attribute Failures in AI Agents?

Who&When Pro:大语言模型真的能归因人工智能代理中的失败吗?

Jiale Liu, Huajun Xi, Shaokun Zhang, Yifan Zeng, Tianwei Yue, Chi Wang, Jian Kang, Qingyun Wu, Huazheng Wang

机构 * OpenAI Anthropic Google DeepMind(谷歌DeepMind)

专题命中 工作流自动化 :AI agent(title);agentic(abstract);分类 cs.AI

AI总结 研究聚焦于大语言模型能否归因人工智能代理中的失败,引入Who&When Pro基准,通过严格管道构建大量失败轨迹,经广泛实验分析,揭示模型归因故障模式,为自动故障归因系统提供实证指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06569 2026-07-09 q-bio.QM cs.LG 新提交 79%

Towards a Pseudo-Labeling Workflow for Celltype-Classification from Explanted Brain Slice Recordings

迈向用于从离体脑切片记录中进行细胞类型分类的伪标签工作流程

Cora Jostock, Jonas Ort, Henner Koch, Gregor Schiele, Andreas Erbslöh

机构 * RWTH University Hospital, Department of Neurosurgery(RWTH大学医院神经外科部门) RWTH University Hospital, Department of Epileptology(RWTH大学医院癫痫学部门) University of Duisburg-Essen, Intelligent Embedded Systems Lab(杜伊斯堡-埃森大学智能嵌入式系统实验室)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.LG

AI总结 该研究针对人脑切片MEA记录的细胞外尖峰分类问题,提出无监督工作流程,涵盖数据预处理、机器学习降维聚类等,考虑在线系统方法,通过多种指标评估管道,严格策展可提高分离度。

Comments 4 pages, 5 figures, Biomedizische Technik 2026 (accepted)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07676 2026-07-09 cs.AI 新提交 79%

SkillCenter: A Large-Scale Source-Grounded Skill Library for Autonomous AI Agents

SkillCenter:用于自主人工智能代理的大规模源基础技能库

Tianming Sha, Yue Zhao, Lichao Sun, Yushun Dong

机构 * Stony Brook University(纽约州立大学石溪分校) University of Southern California(南加州大学) Lehigh University(里海大学) Florida State University(佛罗里达州立大学)

专题命中 工作流自动化 :AI agent(title,abstract);分类 cs.AI

AI总结 研究针对自主AI代理缺乏扎实操作知识的问题,构建SkillCenter技能库,通过多源获取等端到端框架,集成大量源基础和社区技能,实现技能可追溯,以保障代理输出的正确性、安全性和可维护性。

Comments 44 pages, 5 figures. Code: https://github.com/LabRAI/SkillCenter ; Data: https://huggingface.co/datasets/Tommysha/skillcenter-bundles

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07007 2026-07-09 cs.CR cs.SE 新提交 79%

Thinking More, Harnessing Better: State Machine Guided Harness Automatic Generation with Project Digestion and Workflow Decomposition

思考更多,利用更好:通过项目剖析和工作流分解实现状态机引导的测试 harness 自动生成

Xing Zhang, Zikang Huang, Gang Yang, CongChong Wang, Lu Liu, Bin Yin, Mingyi Wang, Ziquan Zhao, Min Li, Zhenyu Chen, Bo Wu, Lingyun Ying

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 研究针对现有大语言模型单轮生成模糊测试 harness 的局限,提出 SynapseFlow,通过数据流感知函数聚合和分阶段回滚算法,经四阶段过程合成 harness,在 25 个开源项目上评估,效果超现有工具,还发现多个未报告错误。

Comments 20 pages, accepted by CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06786 2026-07-09 cs.NI cs.AI 新提交 79%

From Agentic to Autogenic Network Management for AI-Native 6G and Beyond: A Standards Perspective

从智能到自生的网络管理:面向原生人工智能的6G及以后网络——标准视角

Petar Djukic, Sudipta Acharya, Takai Eddine Kennouche, Burak Kantarci

机构 * Bell Labs Research(贝尔实验室研究部) Nokia Technology Standards(诺基亚技术标准) University of Ottawa(Ottawa大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 研究面向6G及以后网络的网络管理,提出自生网络管理参考架构,通过自我编程等能力扩展智能能力,支持分阶段部署,经高优先级运营商场景展示可应对实际挑战,给出使自生网络管理在未来6G网络实现的研究路线图。

Comments 9 pages, 5 figures, Accepted to IEEE Network

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05975 2026-07-08 cs.NI cs.AI cs.MA cs.SY eess.SY 新提交 79%

MCP-Enabled Agentic AI for Autonomous IPoDWDM Network Lifecycle Automation

用于自主IPoDWDM网络生命周期自动化的启用MCP的智能AI

Chunmin Xia, Jakub Harbaczewski, Nikhil Dsilva, Julie Raulin, Dominic Schneider, Achim Autenrieth

机构 * Adtran Networks SE(阿特兰网络公司)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 研究自主控制供应商无关的IPoDWDM网络,采用启用MCP的智能AI架构,利用GNPy和遥测技术实现自动化与闭环控制并经测试验证。

Comments Accepted for demo presentation at the European Conference on Optical Communication (ECOC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05139 2026-07-07 cs.SE 新提交 79%

On the risk of coding before testing: An empirical study on LLM-based test generation workflow

关于测试前编码风险:基于大语言模型的测试生成工作流程的实证研究

Michael Konstantinou, Florian Tambon, Mike Papadakis

专题命中 工作流自动化 :workflow(title);agentic(abstract);分类 cs.SE

AI总结 研究大语言模型在软件工程工作流程中生成代码和测试套件时,生成的代码是否会使后续测试产生偏差,通过实证研究错误传播现象,评估其在多种编程任务和工作流程中的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04958 2026-07-07 cs.CR cs.LO cs.PL cs.SE q-fin.PM 新提交 79%

Look-Ahead-Freedom as Temporal Non-Interference: A Verifiable Correctness Property for Backtesting and Agentic Trading Pipelines

作为时间非干扰的前瞻自由:回测和智能交易管道的可验证正确性属性

Xavier Fonseca

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.SE

AI总结 研究回测和机器学习评估中前瞻偏差问题,指出前瞻自由是时间非干扰属性,开发管道演算,给出值独立片段的类型和效果系统,其线性时间内可靠且可判定,工件验证理论。

Comments Submitted to ACM Transactions on Software Engineering and Methodology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03731 2026-07-07 cs.HC cs.AI 新提交 79%

CoGen3D: An Agentic Human-AI Co-Design Pipeline for 3D Asset Generation for Virtual Reality

CoGen3D:用于虚拟现实3D资产生成的智能人机协同设计管道

Weiwei Jiang, Wanyu He, Zheyu Tan, Zheyuan Kuang, Difeng Yu, Shinobu Hasegawa, Sven Mayer, Zhanna Sarsenbayeva

机构 * Nanjing University of Information Science and Technology(南京信息工程大学) Japan Advanced Institute of Science and Technology(日本科学技术大学) The University of Sydney(悉尼大学) University of Copenhagen(哥本哈根大学) TU Dortmund University(多特蒙德技术大学) Research Center Trustworthy Data Science and Security(可信数据科学与安全研究中心)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 研究针对虚拟现实3D资产创作需建模专业知识的问题,引入CoGen3D智能人机协同设计管道,经用户研究评估,发现其可促进创作、改变情感反应,推动创作从技术执行转向协作空间设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17255 2026-07-07 physics.acc-ph cs.AI 版本更新 79%

Agentic Artificial Intelligence for Multistage Physics Experiments at a Large-Scale User Facility Particle Accelerator

面向大规模用户设施粒子加速器的多阶段物理实验的代理AI

Thorsten Hellert, Drew Bertwistle, Simon C. Leemann, Antonin Sulc, Marco Venturini

机构 * Lawrence Berkeley National Laboratory(伯克利国家实验室)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出首个基于语言模型的代理AI系统,实现大规模用户设施粒子加速器上多阶段物理实验的自动化执行,通过结构化执行计划减少准备时间并确保安全约束。

Journal ref Phys. Rev. Research 8, L012017 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01808 2026-07-03 cs.SE 新提交 79%

Archer: Towards Agentic Review for Compiler Optimizations

Archer:面向编译器优化的智能代码审查

Yunbo Ni, Shaohua Li

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.SE

AI总结 针对编译器优化代码审查能力不足的问题,提出首个自动化智能审查工具Archer,通过义务引导分析和确定性验证守卫,在LLVM上发现21%的开放PR和11%的已关闭PR存在语义错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01584 2026-07-03 cs.AI 新提交 79%

EO-Agents: A Three-Agent LLM Pipeline for Earth Observation Hypothesis Generation

EO-Agents: 用于地球观测假设生成的三智能体LLM流水线

Mahyar Ghazanfari, Amin Tabrizian, Armin Mehrabian, Peng Wei

机构 * ADNET Systems(ADNET系统)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 提出基于NASA地球观测知识图谱的三智能体LLM流水线,通过图神经网络排序数据集对,生成并评估结构化研究假设,在1475个数据集上产生160个跨领域假设。

Comments Accepted at the ICML 2026 AI for Science Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24747 2026-07-03 cs.AI cs.MA 版本更新 79%

Formal Semantics for Agentic Tool Protocols: A Process Calculus Approach

智能体工具协议的形式语义:一种进程演算方法

Andreas Schlapbach

机构 * Swiss Federal Railways (SBB)(瑞士联邦铁路公司)

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本文通过进程演算形式化两种智能体工具协议(SGD和MCP),证明它们在映射Phi下结构互模拟,但反向映射有损,进而提出MCP+扩展实现完全等价。

Comments Logical flaw in Theorem 21

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01102 2026-07-02 cs.SE 新提交 79%

SAGE: Structured Agentic Graph Editing for Software Diagrams

SAGE: 结构化智能体图编辑用于软件图表

Tyler Sivertsen, Neal Singh, James C. Davis

专题命中 工作流自动化 :agentic(title);workflow(abstract);分类 cs.SE

AI总结 提出SAGE工具,通过自然语言提示编辑软件图表,将图表映射为可编辑图结构,翻译请求为结构化编辑意图并执行操作,支持验证修复和版本管理,通过单元测试和Kubernetes案例评估有效性。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00989 2026-07-02 cs.HC cs.AI 新提交 79%

SenseWalk: Agent-Based Semantic Trajectory Simulation Powered by Large Language Models in Zoned Environments

SenseWalk: 基于智能体的语义轨迹模拟——由大型语言模型在分区环境中驱动

Ziyue Lin, Xinhang Xie, Kangyi Wang, Siming Chen

机构 * School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 工作流自动化 :agent(title);workflow(abstract);分类 cs.AI

AI总结 提出SenseWalk系统,结合大语言模型与社会力模型,通过智能体模拟语义轨迹,并提供用户界面以简化配置与分析,实验验证了其有效性和效率。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28409 2026-06-30 cs.AR cs.AI 79%

Evidence-Driven LLM Agent for C-to-Synthesizable-C Conversion and Verification

证据驱动的LLM智能体用于C到可综合C的转换与验证

Zhe Zhao, Hongbing Lang, Zhihan Xiao, Luke Ztz Hu, John Imoleayo Adebisi, Songping Mai

专题命中 工作流自动化 :agent(title);workflow(abstract);分类 cs.AI

AI总结 提出一种基于大语言模型的闭环生成-验证-诊断-修复框架,通过四阶段验证器、渐进式不匹配定位链和证据检索增强生成,将C代码转换为HLS可综合C,显著优于现有方法。

Comments 14 pages, 8 figures, submitted to IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems (TCAD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08195 2026-06-30 cs.CL 79%

Supporting Workflow Reproducibility by Linking Bioinformatics Tools across Papers and Executable Code

通过跨论文和可执行代码链接生物信息学工具支持工作流可重复性

Clémence Sebe, Olivier Ferret, Aurélie Névéol, Mahdi Esmailoghli, Ulf Leser, Sarah Cohen-Boulakia

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.CL

AI总结 本文提出CoPaLink方法,通过实体识别和嵌入相似性解决工作流代码与论文描述中的工具链接问题,提升工作流可重复性和可重用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27611 2026-06-29 cs.LG 新提交 79%

COOPA: A Modular LLM Agent Architecture for Operations Research Problems

COOPA: 面向运筹学问题的模块化LLM智能体架构

Chuanhao Li, Xiaoan Xu, Dirk Bergemann, Ethan X. Fang, Yehua Wei, Zhuoran Yang

机构 * Tsinghua University(清华大学) Duke University(杜克大学) Yale University(耶鲁大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.LG

AI总结 提出COOPA模块化LLM智能体架构,通过迭代置信度建模、元素级溯源与多求解器路由,提升运筹问题建模准确性与可解释性,在多个基准上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26460 2026-06-26 cs.AI 新提交 79%

auto-psych: Automating the science of mind using agent-driven theory discovery and experimentation

auto-psych: 使用智能体驱动的理论发现与实验自动化心智科学

Ben Prystawski, Kushin Mukherjee, Daniel Wurgaft, Linas Nasvytis, Michael Y. Li, Noah D. Goodman, Michael C. Frank

机构 * Stanford University(斯坦福大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 提出auto-psych系统,通过嵌套智能体循环自动生成认知模型、设计并在线执行实验、收集数据,在抛硬币随机性判断任务中恢复真实理论并优于文献理论。

Comments 30 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.30014 2026-06-26 cs.DC cs.AI 版本更新 79%

Scalable AI-assisted Workflow Management for Detector Design Optimization Using Distributed Computing

基于分布式计算的可扩展AI辅助探测器设计优化工作流管理

Derek Anderson, Amit Bashyal, Markus Diefenthaler, Cristiano Fanelli, Wen Guan, Tanja Horn, Alex Jentsch Meifeng Lin, Tadashi Maeno, Kei Nagai, Hemalata Nayak, Connor Pecar, Karthik Suresh, Fang-Ying Tsai, Anselm Vossen, Tianle Wang, Torre Wenaus

机构 * Brookhaven National Laboratory(布鲁克海文国家实验室) The Catholic University of America(美国天主教大学) Duke University(杜克大学) Stony Brook University(石溪大学)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 提出一种结合多目标贝叶斯优化与PanDA-iDDS工作流引擎的AI辅助框架,用于协调异构资源上的迭代仿真,实现高维参数空间的高效探索,并在ePIC和dRICH探测器设计中验证了自动化、可扩展性和效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20989 2026-06-24 cs.SE 新提交 79%

OxyMake: A Formally-Specified, Content-Addressable Workflow Engine

OxyMake: 一个形式化规约的、内容可寻址的工作流引擎

Emmanuel Sérié

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 提出OxyMake,一种基于内容可寻址缓存键的Rust工作流引擎,通过BLAKE3哈希替代文件修改时间戳,避免虚假重执行,并支持跨机器共享缓存。

Comments 38 pages, 3 figures. Source code: https://github.com/noogram/oxymake. Documentation: https://oxymake.noogram.dev

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03070 2026-06-23 cs.CR cs.AI 版本更新 79%

How Your Credentials Are Leaked by LLM Agent Skills: An Empirical Study

你的凭证如何被LLM智能体技能泄露:一项实证研究

Zhihao Chen, Ying Zhang, Yi Liu, Gelei Deng, Yuekang Li, Yanjun Zhang, Jianting Ning, Leo Yu Zhang, Lei Ma, Zhiqiang Li

机构 * Griffith University(格里菲斯大学) Wake Forest University(威克森林大学) Nanyang Technological University(南洋理工大学) University of New South Wales(新南威尔士大学) Zhejiang Sci-Tech University(浙江科技学院) The University of Tokyo(东京大学) University of Alberta(阿尔伯塔大学) Independent Researcher(独立研究者)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 首次大规模实证研究LLM智能体技能中的凭证泄露问题,通过分析170,226个技能样本,识别出520个受影响技能和10种泄露模式,发现76.3%的案例需跨模态分析,调试日志占73.5%的漏洞,89.6%的泄露凭证可立即利用。

Comments Accepted to ASE 2026 (The 41st IEEE/ACM International Conference on Automated Software Engineering)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20470 2026-06-19 cs.CR cs.AI 新提交 79%

Analyzing Defensive Misdirection Against Model-Guided Automated Attacks on Agentic AI Systems

分析针对基于模型引导的自动化攻击的防御性误导策略在智能体AI系统中的应用

Reza Soosahabi, Vivek Namsani

机构 * Application & Threat Intelligence Research Center(应用与威胁情报研究中心)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 本文通过概率模型分析智能体AI系统的攻击-防御场景,提出“检测-误导”策略(如CMPE)以替代传统“检测-拦截”方法,通过产生误导性响应降低攻击者成功率,并在基准测试中将攻击成功率上限降低两个数量级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20120 2026-06-19 cs.RO cs.AI 新提交 79%

Dual-Agent Framework for Cross-Model Verified Translation of Natural-Language Protocols into Robotic Laboratory Platform

用于将自然语言协议翻译为机器人实验室平台的双智能体跨模型验证框架

Hyeonna Choi, Jung Yup Kim, Hyuneui Lim, Seunggyu Jeon

机构 * Department of Bionic Machinery, Research Institute of AI Robot, Korea Institute of Machinery & Materials(生物机械系、人工智能机器人研究所、韩国机械材料研究院)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 提出双智能体框架,通过解析器形式化协议、规则映射引擎生成控制命令、异构LLM验证器纠错,实现自然语言微孔板协议到机器人平台可执行命令的转换,并验证了端到端自主执行。

详情

展开后加载摘要…

URL PDF HTML 收藏