arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-11 至 2026-08-11 共收录 427 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 62 篇

2601.18077 2026-08-11 cs.CL 版本更新 70%

Sparks of Cooperative Reasoning: LLMs as Strategic Hanabi Agents

合作推理的火花:LLMs作为战略汉诺塔代理

Mahesh Ramesh, Kaousheik Jayakumar, Aswinkumar Ramkumar, Pavan Thodima, Aniket Rege, Emmanouil-Vasileios Vlatakis-Gkaragkounis

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 本文研究了在不完全信息下多智能体系统的合作推理挑战,通过汉诺塔游戏评估不同LLM模型在策略沟通和状态跟踪中的表现,展示了模型在协作游戏中的改进效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09023 2026-08-11 cs.CY 新提交 67%

AI-AI co-creation outperforms human pairs in creative tasks

AI-AI共创在创意任务中优于人类配对

Yingyue Luna Luan, Luning Sun, Yeun Joon Kim, Jindong Wang, Xing Xie

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究通过实验发现,具备互补角色的AI-AI共创在创意任务中优于单一AI和人类配对,证实结构化多智能体AI共创的创造力潜力。

Comments 19 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09894 2026-08-11 cs.GT cs.MA econ.TH math.OC 新提交 67%

Competitive mediator games and urban CAV routing markets

竞争性中介博弈与城市自动驾驶车辆(CAV)路径规划市场

Grzegorz Jamróz

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文针对未来自动驾驶路径规划与驾驶市场,提出竞争性中介博弈,证明特定条件下其均衡为垄断,并探讨相关市场的机制设计问题。

Comments 42 pages, 6 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18566 2026-08-11 eess.SY cs.SY 版本更新 67%

HJ-Gauss: A Monte-Carlo HJ Reachability Scheme

HJ-Gauss: 一种蒙特卡洛HJ可达性方案

Lekan Molu, Venkatraman Renganathan, Namhoon Cho

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于局部PDE线性化的方法,通过冻结系数采样方案解决高维系统中经典网格基HJ求解器内存消耗大的问题,实现了存储和网格无关的算法,适用于高维可达性分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04341 2026-08-11 eess.SY cs.SY 版本更新 67%

Reinforcement Learning for Freeway Lane-Change Regulation via Connected Vehicles

基于网联车辆的高速公路车道变更调控强化学习方法

Ke Sun, Huan Yu

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对低自动驾驶渗透率下车道变更控制适用性受限的问题,提出基于多智能体强化学习的网联车辆高速公路车道变更调控框架,可提升交通效率并保障安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08037 2026-08-11 cs.AI 新提交 57%

SkillSmith: Enhancing Locally Deployed Agents via Automatic Skill Construction and Evolution

SkillSmith:通过自动技能构建与演进增强本地部署智能体

Xinle Jiang, Remy Xie, Ming Tang

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 SkillSmith是云端-本地智能体协作框架,通过自动构建和演进技能增强本地智能体,使搭载Qwen3.6-27B的本地智能体任务有效性接近云端智能体,在AppWorld上平均动作数从36.1降至9.9且可泛化至其他SLM。

Comments 10 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00143 2026-08-11 cs.CR cs.AI 版本更新 57%

Symbolic Attack Chain Generation from Atomic Red Team Techniques: An Empirical Study of Predicate Representation Granularity

基于Atomic Red Team技术的符号化攻击链生成:谓词表示粒度的实证研究

Ramya Varunsegar

专题命中 多智能体 :planning(abstract);分类 cs.AI

AI总结 本研究对比九类与五类谓词粒度的AALM,发现粒度对攻击链有效性影响小,81.3%结果一致,高粒度仅提升规划论证的内部结构分辨率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07507 2026-08-11 cs.HC 新提交 50%

Visual Reconstruction as Memory Negotiation: An Iterative Generative AI-Mediated Framework for Oral History

视觉重建作为记忆协商:一种用于口述历史的迭代生成式AI介导框架

Yigeng Zhang

专题命中 多智能体 :workflow(abstract)

AI总结 该研究提出迭代AI辅助视觉重建框架,以生成式AI创建视觉探针辅助口述历史的记忆协商,通过五阶段工作流实现反思性公共历史参与与负责任记录。

Comments Accepted as a poster abstract at the 2026 Conference of the European Association for Digital Humanities (EADH 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09780 2026-08-11 cs.GT math.OC 新提交 50%

Algorithmic Asymmetry in Zero-Sum Games: Unilateral Recovery of Fast Convergence Against a Slow Opponent

零和博弈中的算法非对称性:针对缓慢对手的快速收敛的单侧恢复

James P. Bailey, Soham Das

专题命中 多智能体 :agent(abstract)

AI总结 本文研究零和博弈的算法非对称性,提出智能体用交替乐观梯度下降(AOGD)可补偿普通梯度下降(GD)对手的缓慢收敛,使联合动态以O(1/T)速率收敛到纳什均衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08731 2026-08-11 cs.IT math.IT 新提交 50%

Sensing-Induced Embodied Communication in the Near Field

近场中由感知诱导的具身通信

Jingreng Lei, Yulin Shao

专题命中 多智能体 :agent(abstract)

AI总结 本文研究近场感知诱导的具身通信,通过表征位置相关的各向异性可靠性几何、推导三维混淆区域的椭球表示,建立统一框架并证明近场体积装箱的容量增益。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09038 2026-08-11 eess.SY cs.SY nlin.AO 新提交 50%

Emergent Behavior Is Robust to Communication Delays at the Cost of Slower System Evolution

涌现行为对通信延迟具有鲁棒性,但代价是系统演化更缓慢

Seokho Jeong, Jin Gyu Lee, Hyungbo Shim

专题命中 多智能体 :agent(abstract)

AI总结 该研究针对异质智能体集体行为受通信延迟影响的问题,通过减缓智能体动力学保证涌现行为的鲁棒性,明确延迟对向量场的缩放作用,发现延迟诱导的减速或为扩散耦合的普遍特征。

Comments Extended version of the paper accepted for presentation at the 2026 IEEE Conference on Decision and Control (CDC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19388 2026-08-11 cs.GT 版本更新 50%

Fair Team Contracts

公平团队合同

Matteo Castiglioni, Junjie Chen, Yingkai Li

专题命中 多智能体 :agent(abstract)

AI总结 本文研究了在公平性约束下设计收益最优的团队合同问题,提出了基于加法和子模成功函数的高效算法,并展示了公平合同在收益上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 45 篇

2608.07627 2026-08-11 cs.AI cs.CL cs.LG cs.MA 新提交 91%

From Single Chatbots to Governed Agent Ecosystems: An Agentic AI Pattern Catalogue and Orchestration Framework for Mission-Critical Hospital Information Management Systems

从单一聊天机器人到受管控的智能体生态系统:面向关键任务型医院信息管理系统的智能体AI模式目录与编排框架

Manideep Dhar, Ritwik Singh, Sharat Chandra Kumar Manikonda

专题命中 工作流自动化 :agent(title,abstract);agentic(title,abstract);autonomous agent(abstract);multi-agent(abstract)

AI总结 本研究针对医院信息管理系统提出以合规为核心的智能体AI模式目录与编排框架,可减少文档处理时间等成本、强化管控,助力医院将AI投资转化为可持续回报。

Comments Peer-reviewed published article

Journal ref International Journal of Innovative Science and Research Technology (IJISRT), 11-2026(5), IJISRT26MAY1651

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08453 2026-08-11 cs.AI cs.CR 新提交 89%

What Keeps Agent Skills from Being Reusable? Evidence from 138K SKILL.md Files

是什么阻碍了智能体技能的可复用性?来自13.8万个SKILL.md文件的证据

Chi Zhang, Yimin Liu, Xinze Chen, Ping Ji

机构 * The Graduate Center, City University of New York(纽约城市大学研究生中心) The Ohio State University(俄亥俄州立大学) Hunter College, City University of New York(纽约城市大学亨特学院)

专题命中 工作流自动化 :agent(title,summary_cn);workflow(abstract);分类 cs.AI

AI总结 本研究通过分析13.8万个SKILL.md文件,发现91.8%的Agent Skills存在可复用性相关缺陷,主要为打包问题,验证了路由元数据对检索可靠性的影响,并提出了结合规范提示等的质量保证生成工作流。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12884 2026-08-11 cs.SE 版本更新 88%

Agent READMEs: An Empirical Study of Context Files for Agentic Coding

智能体自述文件:对智能体编码的上下文文件的实证研究

Worawalan Chatlatanagulchai, Hao Li, Yutaro Kashiwa, Brittany Reid, Kundjanasith Thonglek, Pattara Leelaprute, Arnon Rungsawang, Bundit Manaskasemsak, Bram Adams, Ahmed E. Hassan, Hajimu Iida

专题命中 工作流自动化 :agent(title,abstract);agentic(title,abstract);分类 cs.SE

AI总结 本文对2303个智能体上下文文件开展大规模实证研究,发现其为动态演变的复杂产物,开发者优先规定功能需求却极少明确非功能需求,凸显改进相关工具与实践的必要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07949 2026-08-11 cs.AI cs.CR cs.DB cs.IR cs.MA 新提交 87%

Guixu: Valuation-Driven Data Discovery for Autonomous AI Agents with On-Chain Attestation

Guixu:面向具备链上证明的自主AI智能体的估值驱动型数据发现

Yifan Wu, Yuchen Peng, Jiaqi Chai, Yufei Qian, Xilin Li, Ke Chen, Lidan Shou

专题命中 工作流自动化 :AI agent(title);agent(abstract);autonomous agent(abstract);workflow(abstract)

AI总结 Guixu是面向自主AI智能体的估值驱动型数据发现系统,采用三阶段估值管线等技术,整合智能体支付协议与链上数据市场,实现任务、预算感知且可信的数据发现与采购。

Comments This paper has been accepted for presentation at VLDB 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07541 2026-08-11 cs.CV cs.AI cs.MA 新提交 85%

NeuroPilot: An Agent-Driven Smart Pipeline for Processing, Quality Control, and Managing Neuroimages

NeuroPilot:一种用于神经影像处理、质量控制与管理的智能体驱动智能流程

Yiyao Chen, Yucheng Li, Jungong Tong, Shaoqi Wang, Kunhao Zhou, Ziquan Wei, Monica Murea, Marissa DiPiero, Tingting Dan, Guorong Wu

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 工作流自动化 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究提出NeuroPilot多智能体系统,整合神经影像处理、质控与管理流程,在17个超12.3万受试者的队列中验证,将传统2-3个月的工作压缩至一周,提升了可扩展性与效率。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14735 2026-08-11 cs.DC 版本更新 85%

FAME: QoS-aware Async Service Orchestration for Agentic Workflows

为MCP启用的智能工作流优化FaaS平台

Haseeb Abdullah Kollorath, Vaibhav Jha, Varad Kulkarni, Vinay, Nikhil Reddy, Anand Eswaran, Praveen Jayachandran, Yogesh Simmhan

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);workflow(abstract)

AI总结 本文提出FAME架构,利用FaaS平台优化MCP启用的智能工作流,实现模块化组合和状态持久化,提升效率与成本效益。

Comments Extended version of paper to appear in the proceedings of the International Conference on Web Services (ICWS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03836 2026-08-11 cs.LG cs.DC cs.LO cs.SE 版本更新 84%

Resume Means Resume: A Machine-Checked Conformance Contract for Checkpoint, Interrupt, and Resume Semantics in Workflow Persistence Layers

恢复即恢复:工作流持久层中检查点、中断与恢复语义的机器可检查一致性契约

Sajjad Khan

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.LG、cs.SE

AI总结 该研究提出了RESUME CONTRACT契约,用TLA+模型等方法验证了五个智能体工作流框架的一致性问题,并通过REMIT修复了相关故障。

Comments 25 pages, 10 tables, 1 figure. Supplementary material included as an ancillary file. v3: rejoins a paragraph split across a table float and harmonizes a label glyph in the supplement; no change to results, claims, or numbers

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08264 2026-08-11 cs.AI 新提交 83%

OBLIVION: Workflow-Level Operational Skill Unlearning for Deployed Agents

OBLIVION:面向已部署智能体的工作流级操作技能遗忘

Zhengyang Shan, Xu Qian, Jiayun Xin, Kun Li, Yue Zhang, Minghui Xu

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究大型语言模型智能体的技能撤销问题,提出OBLIVION框架,通过工作流建模、跨表面连贯擦除等技术降低技能复活风险,在基准与沙箱实验中有效减少攻击成功率与影响加权暴露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02436 2026-08-11 cs.AI 版本更新 83%

Agentic AI for Clustering, Relationship Discovery, and Semantic Trading in Prediction Markets

语义交易:用于预测市场聚类和关系发现的代理AI

Agostino Capponi, Alfio Gliozzo, Brian Zhu

机构 * Columbia University(哥伦比亚大学) IBM Research(IBM研究院)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种代理AI方法,通过自然语言处理将预测市场划分为主题组并发现市场间的关系,利用历史数据验证其预测准确性及交易策略收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00079 2026-08-11 cs.LG cs.CY stat.ME 版本更新 79%

flowengineR: A Modular and Extensible Framework for Fair and Reproducible Workflow Design in R

flowengineR:R语言中用于公平性与可复现性工作流设计的模块化可扩展框架

Maximilian Willer, Peter Ruckdeschel

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.LG

AI总结 flowengineR是R语言的模块化可扩展框架,用于构建可复现的机器学习工作流,支持公平性等场景下的方法整合与评估,具备透明、可扩展等特性。

Comments 27 pages, 7 figures, 1 table. v2: revised terminology (S7 renamed "Regulatory Suitability", FAIR acronym corrected), added discussion of AI governance frameworks, updated related-work positioning and references, added a caveat on LLM-assisted engine generation, and hedged claims on runtime overhead and synthetic data. Software and reported benchmarks unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09821 2026-08-11 eess.SP 新提交 78%

An open-source, scalable workflow for organizing echosounder data for machine learning applications

面向机器学习应用的开源可扩展声呐数据处理工作流

Caesar Tuguinay, Wu-Jung Lee, Valentina Staneva, Elizabeth M. Phillips, Rebecca E. Thomas, Alicia Billings, Julia Clemons

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 该研究提出一种两阶段开源工作流,基于Echopype和Echoregions库构建可扩展的机器学习就绪回声测深数据集,含数据划分与掩码创建,提供教程验证其可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08402 2026-08-11 cs.CV 新提交 78%

Agentic AI-powered flexible fiber-bundle endoscopy for high-resolution NIR-II fluorescence imaging in vivo

智能体驱动的柔性光纤束内窥镜用于体内高分辨率近红外二区(NIR-II)荧光成像

Yanzhao Shi, Yuanhua Liu, Sixin Xu, Wayne Jason Li, Yuyuan Chen, Danyang Xu, Zhisheng Wu, Hanze Yu, Ian Yu-Hong Wong, Simon Ying-Kit Law, Hongjie Dai, Liangqiong Qu, Feifei Wang

专题命中 工作流自动化 :agentic(title);agent(abstract)

AI总结 该研究开发了AI驱动的柔性光纤束内窥镜平台,通过光学-计算协同设计及GAME流水线提升NIR-II成像分辨率,实现体内生物样本高分辨率成像,为临床转化奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08248 2026-08-11 quant-ph 新提交 78%

Catching Transpilation Drift with a CI/CD Workflow in Quantum Software Development

在量子软件开发中通过CI/CD工作流捕获转译漂移

Jouni Peltonen, Otso Kinanen, Vlad Stirbu

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 该研究针对量子软件开发中工具链变更导致的转译漂移问题,提出了基于GitHub Actions和MLflow的量子DevOps CI/CD工作流,可检测转译漂移并提升量子编译的可观测性与可审计性。

Comments Accepted for publication in the Q-SET Workshop at IEEE QCE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07779 2026-08-11 cs.AI 新提交 77%

The Capability Ladder: A Curriculum-Modernization Framework for Workforce Readiness in the AI Era

能力阶梯:AI时代劳动力准备的课程现代化框架

Majid Memari, George Rudolph

机构 * Utah Valley University(犹他谷大学)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出AI时代劳动力准备的能力阶梯课程现代化框架,将AI增强工作按操作自主性分为五级,映射到课程更新等,主张围绕持久能力针对性现代化而非全面替换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09028 2026-08-11 cs.AI cs.CL cs.DB cs.LO 新提交 76%

PolicyKG: An Agentic LLM Pipeline for Translating Institutional Policies into SHACL Knowledge Graphs

PolicyKG:一种用于将机构政策转换为SHACL知识图谱的智能体大语言模型流水线

Ponkrit Kaewsawee, Chaklam Silpasuwanchai, Chutiporn Anutariya

机构 * Asian Institute of Technology(亚洲理工学院)

专题命中 工作流自动化 :agentic(title);分类 cs.AI、cs.CL

AI总结 本研究提出PolicyKG流水线,可自动将机构政策转换为SHACL知识图谱,在AIT语料库上取得高分类准确率,适配新领域仅需替换注册表,解决了人工转换的效率问题。

Comments 23 pages, 3 figures, 4 tables. Under review at IJCKG 2026, Bangkok, Thailand

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09332 2026-08-11 cs.LG 新提交 74%

Hallucinations and Constraints : Regulating surgical workflow recognition beyond accuracy

幻觉与约束:超越准确率的手术工作流程识别调控

John S. H. Baxter, Pierre Jannin

机构 * Université de Rennes(雷恩大学) Inserm(法国国家健康与医学研究院)

专题命中 工作流自动化 :workflow(title);分类 cs.LG

AI总结 该研究针对医学图像处理中AI的幻觉问题,提出用线性时序逻辑谓词结合概率图模型调控,在机器人辅助子宫切除术阶段识别中准确率提约10%且消除多数拓扑错误。

Comments 11 pages, 1 figure, 1 table, accepted to the MICCAI 2026 Workshop on Fairness, Regulation, and Ethics (FAIMI-BRIDGE-EPIMI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09542 2026-08-11 cs.LG cs.AI cs.CR 新提交 73%

Dual-Adversarial Safety Alignment: Cultivating Intrinsic Threat Comprehension in LRMs

双对抗安全对齐:在大型推理模型(LRMs)中培养内在威胁理解

Hongli Shen, Shaopeng Fu, Qinbo Zhang, Jian Li, Di Wang

机构 * King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) Stony Brook University(石溪大学)

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 针对现有LRMs安全对齐方法依赖模式泛化不足的问题,提出双对抗框架AdvSafe,通过两阶段对抗博弈生成不安全知识数据集,使LRMs实现鲁棒安全对齐且权衡性能更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09185 2026-08-11 cs.DB cs.AI cs.SE 新提交 73%

SiriusDeliver: Automating Data Warehouse Delivery at Tencent

SiriusDeliver:腾讯的数据仓库交付自动化方案

Haining Xie, Xiaokai Zhou, Jiaming Yang, Siqi Shen, Ziwei Wang, Yifeng Zheng, Tengyue Xu, Yipeng Shi, Zefang Zong, Yang Li, Peng Chen, Jie Jiang, Debiao He, Xiao Yan, Jiawei Jiang

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 腾讯提出SiriusDeliver端到端交付自动化智能体,集成三类组件,经离线实验和腾讯云WeData大规模部署验证,可显著提升DW交付的成功率、效率,缩短交付时间与工程师工作量。

Comments 13 pages, 13 figures, 3 tables. Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏