arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-25 至 2026-08-25 共收录 381 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 65 篇

2511.12484 2026-08-25 eess.SY cs.AI cs.SY 版本更新 81%

One Request, Multiple Experts: LLM Orchestrates Domain Specific Models via Adaptive Task Routing

一个请求,多个专家:大语言模型通过自适应任务路由调度领域特定模型

Xu Yang, Chenhui Lin, Haotian Liu, Qi Wang, Yue Yang, Wenchuan Wu

专题命中 多智能体 :agent(summary_cn,abstract);分类 cs.AI

AI总结 针对主动配电网运行的复杂调度难题,本文提出ADN-Agent架构,利用大语言模型协调领域特定模型,通过自适应任务路由等机制提升问题解决能力,性能优于现有大语言模型应用范式。

Comments Accepted by CSEE Journal of Power and Energy Systems in June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10749 2026-08-25 cs.CR cs.AI 版本更新 77%

Toward Secure LLM Agents: Threat Surfaces, Attacks, Defenses, and Evaluation

迈向安全的LLM智能体:威胁面、攻击、防御与评估

Yuchen Ling, Shengcheng Yu, Zhenyu Chen, Chunrong Fang

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Technical University of Munich(慕尼黑技术大学)

专题命中 多智能体 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文通过生命周期、系统导向的框架,综合247篇论文,围绕信息流、委托权限和持久状态,系统梳理了LLM智能体的威胁面、攻击、防御与评估,指出提示注入和工具控制流劫持仍是主要威胁,持久状态损坏和多智能体传播成为新兴关注点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04529 2026-08-25 cs.AI 版本更新 77%

SlideGen: Collaborative Multimodal Agents for Scientific Slide Generation

SlideGen:用于科学幻灯片生成的协作多模态智能体

Xin Liang, Zhilin Zhang, Xiang Zhang, Haoran Su, Yiwei Xu, Siqi Sun, Chenyu You

机构 * Stony Brook University(石溪大学) University of British Columbia(不列颠哥伦比亚大学) University of California, Los Angeles(加州大学洛杉矶分校) Fudan University(复旦大学)

专题命中 多智能体 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 SlideGen通过协作多模态智能体实现科学论文到高质量幻灯片的生成,提升视觉质量和内容忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23026 2026-08-25 cs.CL cs.AI 新提交 73%

Beyond Surface Cues: Disentangling Sociocultural Signals in Multilingual LLMs

超越表层线索:在多语言大语言模型(LLM)中解耦社会文化信号

Yuanjun Feng, Tanzhou Liu, Stefan Feuerriegel, Yash Raj Shrestha

机构 * University of Lausanne(洛桑大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本研究提出经人工验证的多智能体审计框架,分析12个LLM的89253个多语言输出,发现多语言LLM的偏见表征随语言和任务变化,需区分表层线索与真正的跨文化模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22583 2026-08-25 cs.LG cs.AI 新提交 73%

Clinical Graph-JEPA: Predictive Patient-State Knowledge Graphs for Cognitive Decision Support

Clinical Graph-JEPA:用于认知决策支持的预测性患者状态知识图谱

Kushagra Yadav, Nalin Prabhath, Amit Lamba, Goeun Han, Yining Mao

机构 * New York University(纽约大学) University of Chicago(芝加哥大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对临床知识图谱构建难题,提出结合多智能体关系提议等技术的Clinical Graph-JEPA框架,在MIMIC-IV数据集上验证其提升了留一边缘恢复的MRR。

Comments Accepted at WM@Booth 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22176 2026-08-25 cs.AI cs.LG 新提交 73%

Role-Specialized Mixture-of-Agents with Open-Weight LLMs for Clinical Prediction

采用开源权重大语言模型的角色专业化智能体混合架构用于临床预测

Jun Hou, Yi Fang, Xuan Wang

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出角色专业化的开源权重智能体混合架构,结合医学知识检索与相似患者推理,在死亡率预测上媲美闭源模型且标记更多高危患者,为隐私约束下的临床LLM预测提供关键角色设计思路。

Comments COLM 2026 DAIH Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19739 2026-08-25 cs.CV cs.AI cs.LG 版本更新 73%

Question-Guided Evidence Acquisition for Multimodal Visual Question Answering

面向多模态视觉问答的问题引导式证据获取

Alin-Ionut Popa

机构 * Amazon Inc.(亚马逊公司)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 针对多模态视觉问答中模型读取文档不可靠的问题,提出Q-Guide智能体引导感知,在两个数据集上优于基线方法,且增益来自精准感知引导而非复杂控制逻辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04685 2026-08-25 cs.LO 版本更新 71%

Classification of $σ$-validity in iterated announcements

σ有效性的分类

Eiji Yamada

专题命中 多智能体 :agent(abstract,comments);multi-agent(abstract,comments)

AI总结 研究Agotnes等人关于σ有效性的猜想,通过重新表述问题,对多主体K45、单主体KD45和多主体S5进行了分类,证明原猜想错误,揭示真假宣告的不对称性。

Comments 21 pages, 4 figures. v2: Added proofs of the nonexistence of non-trivially 0k1-valid and 01k0-valid formulas in multi-agent KD45, thereby completing the classification for this class. Revised related statements and proofs throughout. v3: Added a link to the GitHub repository containing the Lean 4 formalization

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22833 2026-08-25 cs.MA cs.AI 新提交 70%

Minimal Local Simulation Foundations for LLM- and VLM-Driven Agents in 2D and 3D Environments

用于二维和三维环境中大型语言模型(LLM)与视觉语言模型(VLM)驱动智能体的极简局部仿真基础

Ryuki Hyodo

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究提出SD-AgentFoundry-2D和3D两款极简仿真基础,可在多系统本地运行,用于教育与快速原型设计,为学习生成式社会仿真及构建特定领域扩展提供便捷起点。

Comments GitHub Repositories: https://github.com/ryukih/SD-AgentFoundry-2D and https://github.com/ryukih/SD-AgentFoundry-3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22356 2026-08-25 cs.AI cs.HC 新提交 70%

Addressing the Selection Problem in Explainable AI

解决可解释人工智能中的选择问题

Claire Vlases, Katelyn Morrison

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对可解释人工智能(XAI)中用户难以选择合适技术的问题,研究提出多智能体大语言模型(LLM)编排工具,将用户查询转化为对应XAI解释技术,以解决选择问题。

Comments Accepted to the Workshop on Explainable Artificial Intelligence at the International Joint Conference on Artificial Intelligence 2026 (XAI@IJCAI26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22214 2026-08-25 cs.AI cs.MM 新提交 70%

Query-Driven Multimodal Information Extraction from Long Documents

面向长文档的查询驱动多模态信息抽取

Yikai Gao, Ding Xia, Xi Yang

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) Graduate School of Information Science and Technology, The University of Tokyo(东京大学信息科学与技术研究生院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对现有多模态长文档信息抽取范式的不足,本文提出查询驱动的图像-文本联合抽取任务,构建基准ITJoint并设计多智能体框架Q2IT,实验显示Q2IT性能显著优于独立VLMs但仍有提升空间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22120 2026-08-25 cs.LG 新提交 70%

The Price of Decentralization in Top-$K$ Arm Identification

去中心化在Top-K臂识别中的代价

Larissa Xu, Jasmine Nguyen, William Chang

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 该研究针对多智能体多臂老虎机的Top-K联合臂识别问题,设计无通信的UCB-Intervals算法,量化分析了去中心化移除通信的统计代价,证明完全非对称下样本复杂度有4倍固定惩罚。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12836 2026-08-25 math.OC cs.LG stat.ML 版本更新 70%

DIGing--SGLD: Decentralized and Scalable Langevin Sampling over Time--Varying Networks

DIGing--SGLD:时变网络上的去中心化可扩展朗之万采样

Waheed U. Bajwa, Mert Gurbuzbalaban, Mustafa Ali Kutbay, Lingjiong Zhu, Muhammad Zulqarnain

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出DIGing-SGLD算法,解决时变网络下现有去中心化SGLD的静态拓扑限制与采样偏差问题,首次提供有限时间非渐近Wasserstein收敛保证,经实验验证其性能优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01479 2026-08-25 cs.LO cs.AI 版本更新 70%

An Information-Flow Perspective on Explainability Requirements: Specification and Verification

可解释性需求的信息流视角:规范与验证

Bernd Finkbeiner, Hadar Frenkel, Julian Siber

机构 * CISPA Helmholtz Center for Information Security(信息安全研究中心)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究从信息流视角,采用扩展反事实因量化的认知时态逻辑,提出可解释性需求的规范与验证方法,实现有限状态模型的可解释性检查,可区分可解释与不可解释系统并支持隐私需求设定。

Comments This is an extended and corrected version of the paper presented at the 22nd International Conference on Principles of Knowledge Representation and Reasoning (KR 2025); see the appendix for details

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23185 2026-08-25 cs.CR 新提交 67%

Towards Automated Cyber Threat Intelligence Elicitation in Underground Forums

面向地下论坛中自动化网络威胁情报的获取

Lorenzo Bossi, Federico Saccani, Francesco Panebianco, Antonio Maci, Stefano Zanero, Stefano Longari, Michele Carminati

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出首个基于多智能体大语言模型的主动CTI获取系统DarkBot,其在受控与真实世界实验中均优于基线,可从地下论坛高效获取CTI且安全合规。

Comments 23 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22187 2026-08-25 cs.RO cs.CV 新提交 67%

BehaviorWorldGen: Closing the Loop between Action Models and World Simulators via Controllable Behavior-Aware Structured World Generation

BehaviorWorldGen:通过可控行为感知结构化世界生成闭合动作模型与世界模拟器之间的循环

Jiaqi Wang, Zhuo Zhang, Haining Guan, Tingguang Zhou, Haowen Cui, Zhongyang Zhu, Yulong Zheng, ChuanYe Wang, Xuefeng Chen, Zhen Yang, Tianchen Deng, Feiyang Tan, Hangning Zhou, Bo Dai, Lixia Shen, Xiwu Chen, Xiyang Wang, Jiajun Zhu

机构 * AFARI World Model Team(AFARI世界模型团队)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 BehaviorWorldGen通过BehaviorFlow实现可控行为感知结构化世界生成,闭合驾驶动作模型与世界模拟器的循环,在多项任务上取得改进,尤其对困难交互场景效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22135 2026-08-25 cs.IR 新提交 67%

GrOIL: Graph-Grounded Domain Ontology Induction with Constrained LLM Mediation

GrOIL:基于图的领域本体归纳与受限大语言模型调解

Maruf Ahmed Mridul, Abid Talukder, Oshani Seneviratne

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究提出GrOIL流程,以受限LLM调解的七阶段图基方法构建可审计OWL TBox,在人寿保险领域的基准测试中,其CQ覆盖率等指标优于LLM基线,可生成稳定领域表示。

Comments 12 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22104 2026-08-25 cs.MA cs.SY eess.SY 新提交 67%

Opinion-Guided Layered Strategies for Decentralized Coordination

意见引导的分层策略用于去中心化协调

Shuhao Qi, Zhiyong Sun, Siep Weiland, Sofie Haesaert

专题命中 多智能体 :agent(abstract);autonomous agent(abstract)

AI总结 针对自主智能体去中心化协调中存在的策略不兼容、角色难区分等问题,提出意见引导分层策略,通过非线性意见动力学实现无通信协调,可打破对称性,在一般和博弈中能保证智能体达成均衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08534 2026-08-25 eess.SY cs.SY 版本更新 67%

Phase-Coordinated Circular Formation Control of Unicycle Agents Under Non-Concentric Boundary Constraints

非同心边界约束下独轮智能体的相位协调环形编队控制

Shubham Singh, Anoop Jain

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文针对非同心边界约束下独轮智能体的集体环形运动控制问题,将莫比乌斯变换扩展至多智能体框架,设计分布式控制律并通过仿真与实验验证,实现速度向量的相位协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12165 2026-08-25 eess.SY cs.SY 版本更新 67%

Stability Certificates for Receding Horizon Games

后退时域博弈的稳定性证明

Sophie Hall, Giuseppe Belgioioso, Florian Dörfler, Dominic Liao-McPherson

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本研究针对后退时域博弈,提出适用于非势博弈的基于LMI的稳定性证明,给出解耦动态下的可扩展验证方法与代价权重调优指南,为多智能体系统控制提供稳定性保障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23254 2026-08-25 cs.LG 新提交 57%

From Multimodal Observation to Interpretable Suggestions: Counterfactual Time-Expanded Relational Modeling of Surgical Teams

从多模态观察到可解释建议:手术团队的反事实时间扩展关系建模

Vincenzo Marco De Luca, Antonio Longa, Giovanna Varni, Andrea Passerini

机构 * University of Trento(特伦托大学) UiT the Arctic University of Norway(挪威北极大学)

专题命中 多智能体 :workflow(abstract);分类 cs.LG

AI总结 针对现有外科AI忽略团队互动建模的问题,提出tempo-relational框架结合Time-Expanded图,通过反事实程序生成可解释建议,在模拟手术实验中提升了多目标预测性能。

Comments Accepted at ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21976 2026-08-25 cs.AI 新提交 57%

Closed-loop AI achieves certifiable engineering design

闭环AI实现可验证的工程设计

Tianyi Yu, Chengxing Tao, Haoxuan Shen, Huiyang Li, Rugang Chen, Long Teng, Lilin Wang, Yan Li, Qingbin Chen, Chaogang Xu, Lizhong Wang

专题命中 多智能体 :agentic(abstract);分类 cs.AI

AI总结 本文提出The AI Engineer智能体框架,通过LLMs与工程后端闭环耦合实现工程设计自动化,其设计经CCS验证达标,性能优于人工优化的TuQiang基准。

Comments 24 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25108 2026-08-25 cs.AI cs.HC 版本更新 57%

The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing

临床医生的否决权:自主AI处方中的信任、责任与不确定性导航

Eileanor LaRocco, Sarah Tan, Adarsh Subbaswamy, Anne Andrews, Andrew Taylor, Cree Gaskin, Chirag Agarwal

机构 * University of Virginia(弗吉尼亚大学) Cornell University(康奈尔大学) University of Maryland, Baltimore(马里兰大学巴尔的摩分校) National Institute of Standards and Technology(美国国家标准与技术研究院)

专题命中 多智能体 :agentic(abstract);分类 cs.AI

AI总结 本文提出自主AI处方系统应具备校准置信度、区分认知与偶然不确定性、以及决策时推理透明性三个最低架构要求,并通过136名美国临床医生调查验证,以促进临床采纳并合理分配责任。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02553 2026-08-25 cs.SE 57%

Exploring Individual Factors in the Adoption of LLMs for Specific Software Engineering Purposes

探索在特定软件工程目的中采用LLMs的个体因素

Stefano Lambiase, Gemma Catolino, Fabio Palomba, Filomena Ferrucci, Daniel Russo

专题命中 多智能体 :AI agent(abstract);分类 cs.SE

AI总结 本文研究个体因素如何影响软件工程师在特定软件工程任务中采用LLMs,通过结构方程模型分析五个关键目的中的相关属性,揭示不同因素对LLM采用的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21859 2026-08-25 eess.SP 新提交 50%

Sensing-Assisted Anti-Blockage Pinching-Antenna Systems For Indoor Immersive Communications

用于室内沉浸式通信的感知辅助抗遮挡捏合天线系统

Yi Hong, Yalin Liu, Yulei Wang, Yaru Fu

专题命中 多智能体 :workflow(abstract)

AI总结 该研究提出感知辅助抗遮挡捏合天线系统PASS,通过集成感知与受控移动,实现室内毫米波通信的抗遮挡,大幅降低中断并维持所需吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 36 篇

2608.23200 2026-08-25 cs.CL 新提交 85%

LongWoF-Bench: Evaluating EvoMap Genes for Verifiable Long-Workflow Tasks

LongWoF-Bench:评估用于可验证长工作流任务的EvoMap基因

Xiao Zhang, Qumeng Sun, Jihao Li, Yiming Ren, Xiang Liu, Haoyang Zhang, Junjie Wang

机构 * EvoMap Tsinghua University(清华大学)

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.CL

AI总结 该研究提出LongWoF-Bench基准,发现通过EvoMap将验证的执行轨迹转化为可复用的Gene,能显著提升多模型在长工作流任务上的表现,且优于Skill和参考蒸馏的Gene。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00708 2026-08-25 cs.AI cs.LG 版本更新 84%

MOSAIC: Modular Orchestration for Structured Agentic Intelligence and Composition

MOSAIC:结构化智能体智能与组合的模块化编排

Yifan Bao, Xinyu Xi, Xinyu Liu, Wen Ge, Lei Jiang, Kevin Zhang, Raad Khraishi, Yihao Ang, Anthony K. H. Tung, Lukasz Szpruch, Hao Ni

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) University College London(伦敦大学学院) University of Edinburgh(爱丁堡大学) Data & Analytics, Digital X(Digital X 数据与分析部) Alan Turing Institute(艾伦·图灵研究所)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出MOSAIC框架,通过结构化智能体编排、记忆驱动的模型选择和蓝图构建,将自动化数据科学转化为可验证、可复用的模型选择问题,在金融时间序列任务中优于AutoML和智能体基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26075 2026-08-25 cs.IR cs.AI 版本更新 83%

IDP AutoOpt: Agent-Driven Optimization of Document Processing Pipeline Configurations

IDP AutoOpt:智能文档处理流水线配置的智能体驱动优化

David Kaleko, Sergey Ivanov, Md Mofijul Islam

专题命中 工作流自动化 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 IDP AutoOpt是自主LLM智能体,通过闭环流程优化IDP流水线配置,在多领域任务上性能优于人类专家且成本更低,还可扩展至RAG等其他企业AI系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22511 2026-08-25 stat.ML cs.AI cs.LG econ.EM 版本更新 81%

CausalSmith: A Formally Grounded, Self-Improving Agentic Framework for Automated Research in Causal Inference

因果锻造:一个用于因果推理自动化研究的形式化基础、自我改进的智能框架

Jiyuan Tan, Vasilis Syrgkanis

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 提出因果锻造框架用于因果推理自动化研究,结合因果论库与因果史密斯智能管道,通过声明审核增强内核验证,并用自主研究工件评估系统,为因果推理自动化研究提供新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22672 2026-08-25 cs.AI 新提交 79%

A-CPES: A Reference Framework for Agentic AI in Cyber-Physical Energy Systems

A-CPES:用于网络物理能源系统中智能体人工智能的参考框架

Xiaoyu Zhang, Qiuye Sun, Jiachen Xu, Zhongming Yao, Yushuai Li

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 针对能源系统调度员数量增长不及循环运转速度的问题,提出A-CPES参考框架,含嵌套环结构与治理模块,为网络物理能源系统的智能体人工智能提供授权与问责机制。

Comments 5 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏