arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10469 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10469 篇

2607.20503 2026-07-24 cs.AI cs.LG cs.LO 新提交 84%

LeanFlow: A Case Study in Workflow-Driven Lean Autoformalization

LeanFlow:工作流驱动的精益自动形式化案例研究

Lazar Milikic, Simon Guilloud, Khanh Nguyen, Viktor Kuncak

机构 * Moonshot AI(月球计划人工智能公司) epfl-lara(洛桑联邦理工学院拉腊实验室)

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 研究通过对两篇数学论文案例研究,探讨文档到项目形式化中运行时机制对相关指标的影响,使用Kimi2.6和GPT5.5进行消融实验,报告多项数据,展示LeanFlow在特定任务上的表现及校准成果。

Comments 14 pages, 3 figures, ICML 2026: AI for Math Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08740 2026-07-10 cs.AI cs.PL cs.SE 新提交 84%

Workflow as Knowledge: Semantic Persistence for LLM-Mediated Workflows

作为知识的工作流:大语言模型介导的工作流的语义持久性

Emanuele Quinto, Carlo Andrea Rozzi, Francesco Zanitti

机构 * UNHCR København(联合国难民署哥本哈根办事处) CNR—Istituto Nanoscienze Modena(意大利国家研究委员会-纳米科学研究所摩德纳分所) ZeLe & F ApS København(泽勒与F有限公司哥本哈根分公司)

专题命中 工作流自动化 :workflow(title,abstract);tool use(abstract);分类 cs.AI、cs.SE

AI总结 研究大语言模型介导的工作流,提出受Lisp启发的概念模型,用符号形式等作解释视角,将工作流相关元素表示为持久知识对象,区分派生和推理,初步阐述了工作流的语义持久性。

Comments 39 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18425 2026-06-18 cs.SE cs.AI cs.DC 新提交 84%

From Specification to Execution: AI Assisted Scientific Workflow Management

从规范到执行:AI辅助的科学工作流管理

Komal Thareja, Hamza Safri, Rajiv Mayani, Anirban Mandal, Ewa Deelman

机构 * RENCI, University of North Carolina at Chapel Hill, NC, USA(RENCI,北卡罗来纳大学教堂山分校) Information Sciences Institute, University of Southern California, Marina del Rey, CA, USA(信息科学研究所,南加州大学马里纳德尔雷耶斯分校)

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 提出一种AI辅助方法,通过规范驱动的工作流生成、自动化调试和分布式执行,结合Pegasus与MCP层,实现从自然语言到大规模科学工作流的端到端管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14155 2026-06-15 cs.LG cs.CL 新提交 84%

Graph-based Target Back-Propagation for Context Adaptation in Multi-LLM Agentic Systems

基于图的目标反向传播用于多LLM智能体系统中的上下文自适应

Tan Zhu, Tong Yao, Kananart Kuwaranancharoen, Amit Singh, Yushang Lai, Deepa Mohan, Shankara Bhargava

机构 * Retail Intelligence, Walmart Global Tech(零售智能,沃尔玛全球技术)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.CL、cs.LG

AI总结 提出GTBP框架,通过图结构反向传播局部目标输出,实现多LLM智能体工作流的上下文自适应,理论保证稳定性,实验优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10402 2026-06-10 cs.CL cs.AI 新提交 84%

Harnessing the Collective Intelligence of AI Agents in the Wild for New Discoveries

利用野外AI代理的集体智慧实现新发现

Federico Bianchi, Yongchan Kwon, Aneesh Pappu, James Zou

机构 * Together AI Stanford University(斯坦福大学)

专题命中 工作流自动化 :AI agent(title);agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 提出EinsteinArena平台,通过开放分布式环境中的自主代理交互,在数学问题中实现12项新最优结果,展示了集体AI驱动研究的范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12306 2026-06-10 cs.LG cs.AI 版本更新 84%

GCA Framework: A GCC Countries-Grounded Dataset and Agentic Pipeline for Climate Decision Support

GCA框架:面向海湾合作委员会国家的数据集与气候决策支持智能体管道

Muhammad Umer Sheikh, Khawar Shehzad, Salman Khan, Fahad Shahbaz Khan, Muhammad Haris Khan

机构 * Mohamed Bin Zayed University of Artificial Intelligence (MBZUAI)(莫扎德人工智能大学) University of Missouri(密苏里大学) Australian National University(澳大利亚国立大学) Linköping University(林肯大学)

专题命中 工作流自动化 :agentic(title);agent(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 提出GCA框架,包含GCC国家多模态数据集GCA-DS和工具增强型智能体GCA,通过领域微调和工具集成提升气候决策可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00708 2026-06-02 cs.AI cs.LG 84%

MOSAIC: Modular Orchestration for Structured Agentic Intelligence and Composition

MOSAIC:结构化智能体智能与组合的模块化编排

Yifan Bao, Xinyu Xi, Xinyu Liu, Wen Ge, Lei Jiang, Kevin Zhang, Raad Khraishi, Yihao Ang, Anthony K. H. Tung, Lukasz Szpruch, Hao Ni

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) University College London(伦敦大学学院) University of Edinburgh(爱丁堡大学) Data & Analytics, Digital X(Digital X 数据与分析部) Alan Turing Institute(艾伦·图灵研究所)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出MOSAIC框架,通过结构化智能体编排、记忆驱动的模型选择和蓝图构建,将自动化数据科学转化为可验证、可复用的模型选择问题,在金融时间序列任务中优于AutoML和智能体基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27492 2026-05-28 cs.SE cs.AI 84%

Benchmarks are Not Enough: RAMP for Runtime Assessing of Agentic Models in Production Systems

基准测试还不够:RAMP——生产系统中代理模型的运行时评估

Yipeng Ouyang, Xin Huang, Bingjie Liu, Zhongchun Zheng, Yuhao Gu, Xianwei Zhang

机构 * School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, China(中山大学计算机科学与工程学院,广州,中国)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 针对现有基准测试无法反映真实生产环境动态复杂性的问题,提出RAMP框架,通过统一运行时评估架构、编译器构建工作负载和多维效用指标,揭示模型在长序列工作流中的性能退化与资源效率差异。

Comments 16 pages, 8 figures. Project homepage: http://ramp.yatcc-ai.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27470 2026-05-28 cs.LG cs.AI 84%

Detect by Yourself: Self-Designing Agentic Workflows for Few-Shot Graph Anomaly Detection

自行检测:少样本图异常检测的自设计代理工作流

Tairan Huang, Qiang Chen, Yili Wang, Yueyue Ma, Changlong He, Xiu Su, Yi Chen

机构 * CSU(中国科学技术大学) UST(香港大学)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出SignGAD框架,通过自设计任务条件检测工作流替代固定检测器,结合图编码与检测器选择及受保护重拟合策略,提升少样本图异常检测的适应性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02780 2026-05-27 cs.CR cs.AI cs.SE 84%

PoCo: Agentic Proof-of-Concept Exploit Generation for Smart Contracts

PoCo:智能合约的代理式概念验证漏洞利用生成

Vivi Andersson, Sofia Bobadilla, Harald Hobbelhagen, Martin Monperrus

机构 * KTH Royal Institute of Technology(皇家理工学院)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 提出PoCo框架,通过代理式Reason-Act-Observe循环自动从自然语言漏洞描述生成可执行的PoC漏洞利用,在23个真实报告上优于基线方法。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22883 2026-05-25 cs.AI cs.LG cs.PF 84%

Energy per Successful Goal: Goal-Level Energy Accounting for Agentic AI Systems

每个成功目标的能量:面向智能体AI系统的目标级能量核算

Deepak Panigrahy, Aakash Tyagi

机构 * Independent Researcher(独立研究者) Texas A\&M University(德克萨斯A&M大学) Texas A\&M University Department of Computer Science(德克萨斯A&M大学计算机科学系)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出A-LEMS框架,将AI能量核算单位从每次推理能量转换为每个成功目标能量(EpG),并定义编排开销指数(OOI),实验表明智能体工作流平均能耗是线性基线的4.33倍,且能耗主要由编排结构而非推理计算驱动。

Comments 34 pages, 16 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20876 2026-05-21 cs.CL cs.AI 84%

Terminal-World: Scaling Terminal-Agent Environments via Agent Skills

Terminal-World: 通过智能体技能扩展终端智能体环境

Zihao Cheng, Hongru Wang, Zeming Liu, Xinyi Wang, Xiangrong Zhu, Yuhang Guo, Wei Lin, Jeff Z. Pan, Yunhong Wang

机构 * School of Computer Science and Engineering, Beihang University, Beijing, China(北京航空航天大学计算机科学与工程学院) Independent Researcher(独立研究者) Beijing Institute of Technology(北京理工大学) University of Edinburgh(爱丁堡大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出Terminal-World,一种自动化流程,利用智能体技能作为核心合成原语,共同编码任务目标、执行时机和方法,从而生成任务指令、环境和教师轨迹。通过构建5,723个训练环境,训练出Terminal-World-8B/14B/32B模型,在六个基准测试中均优于终端智能体基线,其中Terminal-World-32B在Terminal-Bench 2.0上以仅1.2%的训练数据超越Nemotron-Terminal-32B。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12947 2026-05-14 stat.ML cs.AI cs.LG stat.ME 84%

When Should an AI Workflow Release? Always-Valid Inference for Black-Box Generate-Verify Systems

何时应释放AI工作流?始终有效的推理用于黑盒生成-验证系统

Young Hyun Cho, Will Wei Sun

机构 * Department of Statistics, Purdue University(普渡大学统计系)

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种始终有效的释放包装器,用于现有生成-验证流程,通过构建高质量失败参考池并校准部署时的验证器评分,以在可选停止条件下保证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00742 2026-05-08 cs.AI cs.LG stat.ML 84%

Position: agentic AI orchestration should be Bayes-consistent

位置:代理AI协调应具有贝叶斯一致性

Theodore Papamarkou, Pierre Alquier, Matthias Bauer, Wray Buntine, Andrew Davison, Gintare Karolina Dziugaite, Maurizio Filippone, Andrew Y. K. Foong, Vincent Fortuin, Dimitris Fouskakis, Jes Frellsen, Eyke Hüllermeier, Theofanis Karaletsos, Mohammad Emtiyaz Khan, Nikita Kotelevskii, Salem Lahlou, Yingzhen Li, Fang Liu, Clare Lyle, Thomas Möllenhoff, Konstantina Palla, Maxim Panov, Yusuf Sale, Kajetan Schweighofer, Artem Shelmanov, Siddharth Swaroop, Martin Trapp, Willem Waegeman, Andrew Gordon Wilson, Alexey Zaytsev

机构 * ESSEC Business School(ESSEC商学院) VinUniversity(文大学) Imperial College London(伦敦帝国理工学院) Mila - Quebec AI Institute(魁北克人工智能研究所) Technical University of Denmark(丹麦技术大学) Pyramidal Inc.(Pyramidal公司) University of Notre Dame(诺特大学) Cognizant AI Lab(Cognizant人工智能实验室) University College London(伦敦大学学院) KTH Royal Institute of Technology(瑞典皇家理工学院) Ghent University(根特大学) New York University(纽约大学)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了在代理AI系统中,贝叶斯原则在协调层的应用,而非LLM参数,以提升决策一致性和协作效率。

Comments Accepted for publication at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00942 2026-05-05 cs.SE cs.LG 84%

PPO guided Agentic Pipeline for Adaptive Prompt Selection and Test Case Generation

基于PPO的代理流水线:自适应提示选择与测试用例生成

Gourisetty Venkata Sai Koushik, Dama Aditya, Mahankali Harish Sai, Peddi Siddarhta, Shadab Ahmad, Vivek Yelleti

机构 * Department of Computer Science and Engineering, SRM University AP, India(印度SRM大学计算机科学与工程系)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.LG、cs.SE

AI总结 本文提出一种基于强化学习的代理框架,利用PPO与LLM生成测试用例,通过自适应提示选择提升代码覆盖率。实验表明PPO-LLM在分支和行覆盖率上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27891 2026-05-01 cs.AI cs.LG 84%

In-Context Prompting Obsoletes Agent Orchestration for Procedural Tasks

上下文提示使代理协调在过程性任务中过时

Simon Dennis, Michael Diamond, Rivaan Patil, Kevin Shabahang, Hao Guo

机构 * University of Melbourne(墨尔本大学)

专题命中 工作流自动化 :agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 本文通过对比实验表明,对于过程性任务,将整个流程置于系统提示中让模型自主协调优于传统的外部代理协调框架。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20134 2026-04-23 cs.CR cs.AI cs.CL 84%

AgentSOC: A Multi-Layer Agentic AI Framework for Security Operations Automation

AgentSOC: 一种多层代理AI框架用于安全运营自动化

Joyjit Roy, Samaresh Kumar Singh

机构 * IEEE

专题命中 工作流自动化 :agentic(title,abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 AgentSOC通过整合感知、前瞻性推理和基于风险的行动规划,提升安全运营中心自动化水平,实现警报标准化、上下文丰富化及安全响应合规性。

Comments 7 pages, 6 figures, 2 tables. Peer-reviewed paper published in IEEE ICAIC 2026 (IEEE Xplore)

Journal ref 2026 IEEE 5th International Conference on AI in Cybersecurity (ICAIC), Houston, TX, USA, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06606 2026-04-23 cs.LG cs.AI 84%

CEDAR: Context Engineering for Agentic Data Science

CEDAR:面向代理的数据科学应用

Rishiraj Saha Roy, Chris Hinze, Luzian Hahn, Fabian Kuech

机构 * Department of Generative AI, Fraunhofer IIS(生成人工智能系,弗劳恩霍夫研究所)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 CEDAR通过有效的上下文工程解决数据科学任务中的复杂性、数据规模、计算限制和上下文限制问题,采用分步生成计划和代码块的方式提升数据科学任务自动化水平。

Comments Accepted at ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11623 2026-04-17 cs.AI cs.SE 84%

Context Kubernetes: Declarative Orchestration of Enterprise Knowledge for Agentic AI Systems

上下文Kubernetes:面向代理AI系统的企业知识声明式编排

Charafeddine Mouzouni

机构 * OPIT -- Open Institute of Technology(开放技术研究所)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出Context Kubernetes架构,通过声明式知识架构-as-code和三层权限模型,解决企业知识在代理AI系统中的安全编排问题,实验表明其在治理和安全性方面优于传统方法。

Comments 24 pages, 8 tables, 1 figure, 8 experiments (5 correctness + 3 value). Open-source prototype: https://github.com/Cohorte-ai/context-kubernetes

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05952 2026-04-08 cs.AI cs.CL 84%

Towards Trustworthy Report Generation: A Deep Research Agent with Progressive Confidence Estimation and Calibration

迈向可信报告生成:一种带有逐步置信度估计和校准的深度研究代理

Yi Yuan, Xuhong Wang, Shanzhe Lei

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Southeast University(东南大学)

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文提出一种深度研究代理,通过逐步置信度估计和校准提升报告生成的可信度,增强透明度和用户信任。

Comments 20 pages, 3 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25768 2026-03-30 cs.SE cs.AI cs.AR cs.MA 84%

UCAgent: An End-to-End Agent for Block-Level Functional Verification

UCAgent:一种端到端的块级功能验证代理

Junyue Wang, Zhicheng Yao, Yan Pi, Xiaolong Li, Fangyuan Song, Jinru Wang, Yunlong Xie, Sa Wang, Yungang Bao

机构 * State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Beijing Institute of Open Source Chip(北京开源芯片研究院)

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 UCAgent通过构建纯Python验证环境和31阶段细粒度验证流程,解决传统方法在复杂半导体设计验证中的不足,实现98.5%的代码覆盖率和100%的功能覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25063 2026-03-27 cs.HC cs.AI cs.GR cs.LG 84%

TopoPilot: Reliable Conversational Workflow Automation for Topological Data Analysis and Visualization

TopoPilot:拓扑数据分析和可视化可靠对话工作流自动化

Nathaniel Gorski, Shusen Liu, Bei Wang

机构 * University of Utah(犹他大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 工作流自动化 :workflow(title);agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 TopoPilot通过双代理架构和系统性防护机制,实现复杂科学可视化工作流的可靠自动化,其在1000次多轮对话中成功率达99%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10249 2026-03-18 cs.SE cs.AI cs.HC 84%

DUCTILE: Agentic LLM Orchestration of Engineering Analysis in Product Development Practice

DUCTILE:工程分析中产品开发实践的代理LLM协调

Alejandro Pradas-Gomez, Arindam Brahma, Ola Isaksson

机构 * Product Development Division, Department of Mechanical Engineering, Chalmers University of Technology, Gothenburg, Sweden(产品开发部门,机械工程系,楚姆勒斯技术大学,哥德堡,瑞典) GKN Aerospace Engine Systems, Trollhättan, Sweden(GKN航空发动机系统,特罗尔哈塔纳,瑞典)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 DUCTILE通过代理LLM协调工程分析任务,分离自适应协调与确定性执行,解决工具接口变化导致的自动化失效问题,验证了其在航空制造中的有效性。

Comments 22 pages, including supplemental material. 9 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03495 2026-02-27 cs.SE cs.AI 84%

AgentHub: A Registry for Discoverable, Verifiable, and Reproducible AI Agents

AgentHub: 一个用于可发现、可验证和可重复的AI代理注册表

Erik Pautsch, Tanmay Singla, Parv Kumar, Wenxin Jiang, Huiyun Peng, Behnaz Hassanshahi, Konstantin Läufer, George K. Thiruvathukal, James C. Davis

机构 * Purdue University, USA(普渡大学) Socket Inc.(Socket公司) Oracle Labs(Oracle实验室)

专题命中 工作流自动化 :AI agent(title);agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 AgentHub旨在通过提供一个注册表层和研究议程,实现AI代理的可发现性、可验证性和可重复性,以构建可靠且可重用的代理生态系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20924 2026-02-25 cs.NI cs.AI cs.SE 84%

Airavat: An Agentic Framework for Internet Measurement

Airavat:一种用于互联网测量的代理框架

Alagappan Ramanathan, Eunju Kang, Dongsu Han, Sangeetha Abdu Jyothi

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 Airavat通过代理框架实现互联网测量工作流的自动化生成与验证,解决了复杂分析中工具协调和方法学验证的难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00097 2026-02-17 cs.AI cs.CL cs.HC cs.IR 84%

The Agentic Leash: Extracting Causal Feedback Fuzzy Cognitive Maps with LLMs

代理缰绳:利用大语言模型提取因果反馈模糊认知图

Akash Kumar Panda, Olaoluwa Adigun, Bart Kosko

机构 * University of Southern California(南加州大学) Florida International University(佛罗里达国际大学)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出利用LLM代理系统提取因果反馈模糊认知图,通过三步过程生成与人类生成的FCM具有相同平衡特性的动态系统。

Comments 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12317 2026-01-21 cs.LG cs.AI 84%

Explanova: Automatically Discover Data Insights in N \times M Table via XAI Combined LLM Workflow

Explanova:通过XAI结合LLM工作流自动在N×M表格中发现数据洞察

Yiming Huang

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克Quantin 国家信息与自动化研究所) Rajiv Gandhi University(拉吉夫·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕尔默研究实验室)

专题命中 工作流自动化 :workflow(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 Explanova通过结合XAI和LLM工作流,在N×M表格中实现更经济的自动数据洞察发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20959 2025-12-25 cs.LG cs.AI stat.ME 84%

Can Agentic AI Match the Performance of Human Data Scientists?

代理AI能否匹配数据科学家的性能?

An Luo, Jin Du, Fangqiao Tian, Xun Xian, Robert Specht, Ganghua Wang, Xuan Bi, Charles Fleming, Jayanth Srinivasa, Ashish Kundu, Mingyi Hong, Jie Ding

机构 * School of Statistics, University of Minnesota(统计学系,明尼苏达大学) Department of Electrical and Computer Engineering, University of Minnesota(电气与计算机工程系,明尼苏达大学) Data Science Institute, University of Chicago(数据科学研究所,芝加哥大学) Carlson School of Management, University of Minnesota(卡尔森管理学院,明尼苏达大学) Cisco Research, San Jose, CA, USA(Cisco研究,加州圣何塞)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨代理AI在处理隐藏潜在变量任务时的表现,发现其在缺乏领域知识时无法匹敌人类数据科学家。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19769 2025-12-24 cs.SE cs.AI cs.PL 84%

A Declarative Language for Building And Orchestrating LLM-Powered Agent Workflows

构建和协调基于大语言模型的智能体工作流的声明式语言

Ivan Daunis

机构 * PayPal

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出一种声明式语言,用于构建和协调基于大语言模型的智能体工作流,通过统一DSL减少开发时间和部署速度,提升非工程师的使用效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14429 2025-12-17 cs.AI cs.SE 84%

Seismology modeling agent: A smart assistant for geophysical researchers

地震建模代理:为地球物理研究者设计的智能助手

Yukun Ren, Siwei Yu, Kai Chen, Jianwei Ma

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出基于LLMs的SPECFEM智能交互工作流程,通过MCP协议降低地震模拟门槛,提升地球物理研究的自动化与可重复性。

Comments 26 pages, 15 figures. Code available at https://github.com/RenYukun1563/specfem-mcp

详情

展开后加载摘要…

URL PDF HTML 收藏