arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10514 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10514 篇

2608.16048 2026-08-18 quant-ph cs.NA math.NA physics.app-ph 新提交 67%

zenDot: An LLM-integrated quantum TCAD platform for semiconductor quantum-device design and optimization automation

zenDot:一款集成大语言模型(LLM)的量子TCAD平台,用于半导体量子器件设计与优化自动化

Zeheng Wang, Yan Liu, Yue Hao, Genquan Han

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 zenDot是集成LLM的量子TCAD平台,可连接器件物理与LLM驱动的设计探索,在Si/SiO₂双量子点验证中完成18次设计迭代,将最差门保真度降低近30倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14207 2026-08-17 cs.RO cs.CV 新提交 67%

MMUSV-Sim: A Perception-Oriented Simulation and Data-Generation Platform for Multi-USV Cooperative Perception

MMUSV-Sim:面向多无人水面艇协同感知的感知导向型仿真与数据生成平台

Ziao Li, Jianxiong Ye, Biao Tang, Leping Zhang, Kun Zuo, Siyu Huang, Chenqiang Gao

机构 * School of Intelligent Systems Engineering, Sun Yat-sen University(中山大学智能工程学院) School of Intelligent Imagery Engineering, Beijing Film Academy(北京电影学院智能影像工程学院)

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 该研究提出基于Unreal Engine 5和Project AirSim的MMUSV-Sim仿真与数据生成平台,用于多USV协同感知,实验表明其生成的数据集可使激光雷达协同BEV船舶检测的AP@0.5达72.74,显著优于单USV方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13063 2026-08-14 cs.AI cs.CL cs.LG 新提交 67%

Explanatory Engagement Under Rare Anomalous Failure: Asymptotic Rarity in Model Behavior (or: The Asymptotic AI)

罕见异常失效下的解释性参与:模型行为中的渐近稀有性(或:渐近式AI)

Sam Mao

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究探究LLM在低可控失效概率工作流中,解释性参与度随失效渐近稀有性的变化,发现触发结构是关键调节变量,不同模型的异常识别与参与表现存在差异。

Comments 11 figures. Elicitation-condition sweep across three open-weight models (qwen3:8b, llama3.1:8b, mistral:7b); pipeline scripts and experimental data available upon reasonable request

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12375 2026-08-14 cs.DB 新提交 67%

Pipeline Denotational Design: Correct-by-Construction Data Pipelines at Zero Cost

管道指称设计:零成本的构造正确性数据管道

Nikos Karayannidis

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 提出管道指称设计(PDD)方法论,在设计时零成本实现数据管道构造正确性,可验证 AI 生成管道的粒度一致性,已在生产工具链中实现并评估。

Comments Extended version of a work-in-progress paper; the experimental evaluation is in progress and will appear in a later revision. Builds on a companion grain theory paper, arXiv:2601.00995

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06085 2026-08-12 cs.DC 67%

LAAFD: LLM-based Agents for Accelerated FPGA Design

LAAFD: 基于大语言模型的加速FPGA设计代理

Maxim Moraru, Kamalavasan Kamalakkannan, Jered Dominguez-Trujillo, Patrick Diehl, Atanu Barai, Julien Loiseau, Zachary Kent Baker, Howard Pritchard, Galen M Shipman

专题命中 工作流自动化 :workflow(abstract);agentic(abstract)

AI总结 LAAFD利用大语言模型将通用C++转换为优化的Vitis HLS内核,实现高性能FPGA设计,同时降低专业门槛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09719 2026-08-11 cs.HC 新提交 67%

Mirroring the Past: Exploring How Ancestral Digital Self Influences History Learning

镜像过去:探索祖先数字自我如何影响历史学习

Duo Gong, Fan Sun, Yucen Wang, Yufan Hu, Wen Zhong, Wei Zhang, Pengcheng An

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 该研究针对历史学习中学习者与自身的疏离问题,提出AI生成的“祖先数字自我”教学智能体,经被试内研究发现其可提升体验性指标,但未改善即时学习结果,为相关教育环境设计提供启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07952 2026-08-11 cs.LG cs.AI cs.CR cs.SE 新提交 67%

Persistent Semantic Entities in Tool-Augmented LLM Systems

工具增强型大语言模型系统中的持久语义实体

Zhaohui Wang

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 该研究定义工具增强型LLM系统的持久语义实体(PSEs),证实其在24款不同规模模型中普遍存在,偏好/指令污染难自校正,上下文隔离自验证可降低污染,为智能体系统安全提供关键发现。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026). Camera-ready version; 32 pages . The openreview url is https://openreview.net/forum?id=zPjmtawzT8&noteId=CXB95ws5so and ICML poster url is https://icml.cc/virtual/2026/poster/60521

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16544 2026-08-11 cond-mat.str-el cond-mat.mes-hall 版本更新 67%

AIMS: an AI experimentalist turns uncertainty into quantum matter discovery

AIMS:一种用于量子物质的不确定性感知人工智能实验者

Siyuan Qiu, Philip D. Suh, Nhat Huy Tran, Xirui Wang, Heonjoon Park, Kutay Akin, Kevin K. S. Multani, Seungwon Jung, Wenkai Cai, Xinyu Liu, León Garcia, Ziyan Zhu, Chunjing Jia, Zhantao Chen, Zhixun Shen, Zhurun Ji

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 研究量子材料实验中的不确定性问题,提出AIMS这一不确定性感知人工智能实验者,通过连接三个嵌套循环实现感知恢复、测量选择和能量尺度分辨机制归因,展示了对量子物质的不确定性感知实验能动性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14137 2026-08-06 cs.CL cs.AI cs.LG 版本更新 67%

From Feelings to Metrics: Understanding and Formalizing How Users Vibe-Test LLMs

从感受至指标:理解并形式化用户如何通过 vibes 测试 LLMs

Itay Itzhak, Eliya Habba, Gabriel Stanovsky, Yonatan Belinkov

机构 * Technion – Israel Institute of Technology(技术离子-以色列理工学院) The Hebrew University of Jerusalem(耶路撒冷希伯来大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究用户通过非正式经验评估LLM的方式,并形式化该过程以支持系统分析,通过个性化测试和用户感知标准改进模型评估。

Comments Published at COLM 2026. 50 pages, 20 figures. Code and data at https://technion-cs-nlp.github.io/vibe-testing-llms

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03534 2026-08-05 cs.CR 新提交 67%

A Challenge-Nonce Freshness Gap in Project Veraison's TPM Reference Schemes, Found by Appraising Application-Layer Action Evidence End-to-End

通过端到端评估应用层行动证据发现Project Veraison的TPM参考方案中存在的挑战随机数新鲜度缺口

Anton Sokolov

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 本文发现Project Veraison的TPM参考方案存在挑战随机数新鲜度缺口,通过端到端测试验证修复方案,使重放Quote的评估结果变为否定,提升了RATS架构的安全性。

Comments 18 pages, 3 figures. Responsible disclosure: veraison/services#427, fixed in PR #432. Artifact and data: doi:10.5281/zenodo.20998730

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28836 2026-08-03 cs.ET cs.MA cs.NI 新提交 67%

The AnyLog Edge Data Fabric

AnyLog 边缘数据架构

Roy Shadmon, Mark Davidson, Eric Aquaronne, Massimiliano Pinto, Ori Shadmon, Moshe Shadmon

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 本文提出 AnyLog 边缘数据架构,该基于智能体与边缘的平台可在源端管理运营数据,通过多项技术让用户无需知晓资源位置即可操作分布式资源,为分布式 SQL 等提供类云操作模式,无单点故障且不依赖集中式基础设施。

Comments Keywords: IoT Data Management, Edge Data Management, Edge Data Fabric, Distributed Query, Edge AI, P2P Data Layer, Decentralized Data Layer. 30 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27918 2026-07-31 math.OC 新提交 67%

OptGraph: Large Language Models Enhanced Evolutionary Optimization Via Graph Retrieval-Augmented Generation

OptGraph:基于图检索增强生成的大语言模型增强进化优化

Xianchao Xiu, Jianhao Li, Huangyue Chen, Wanquan Liu

专题命中 工作流自动化 :workflow(abstract);agentic(abstract)

AI总结 针对现有LLM自动化进化优化的局限,提出引入GraphRAG的OptGraph工作流,通过类型化图复用经验等方法,在基准数据集上较现有框架平均精确准确率提升8.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25326 2026-07-29 cs.GR cs.CG 新提交 67%

Functionally Grading the Slicing Process by Compiling Design Intent into Slicer Projects

通过将设计意图编译到切片器项目中对切片过程进行功能分级

Charles Wade, Devon Beck, Robert MacCurdy

专题命中 工作流自动化 :planning(abstract);workflow(abstract)

AI总结 研究如何对切片过程进行功能分级,核心方法是提出切片器项目编译的自动化工作流程,将异构隐式设计转换为切片器原生项目,主要贡献是通过示例展示该方法并开源实现,连接异构设计与切片器生态系统,助力功能分级FFF制造。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23588 2026-07-28 cs.CV 新提交 67%

JarvisHub: An Open Harness for Canvas-Native Multimodal Creative Agents

JarvisHub:用于原生画布多模态创意智能体的开放框架

Yunlong Lin, Zixu Lin, Zhaohu Xing, Biqiang Li, Chenxin Li, Haonan Wang, Haitao Wu, Hengyu Liu, Jianghai Chen, Kaituo Feng, Kaixin Li, Shawn Chen, Shijue Huang, Sixiang Chen, Tsung-Yi Ho, Wenxuan Huang, Xiangyan Liu, Xiaomeng Hu, Xuanhua He, Yan Sun, Yunqing Zhao, Zhiqin Yang, Zehan Wang, Zhengyang Tang, Tianyu Pang, Xiangyu Yue

专题命中 工作流自动化 :agent(abstract);tool use(abstract)

AI总结 研究针对创意人工智能从单步到多模态创作转变中现有系统不足的问题,引入JarvisHub框架,以可编辑画布为核心,通过三层架构让智能体实现持续、人工可控的创意自动化创作。

Comments 15 pages, 9 figures. Project page: https://www.jarvishub.site/ Code github: https://github.com/LYL1015/JarvisHub

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21608 2026-07-27 cs.SE cs.AI cs.CL cs.CY 新提交 67%

From Obligation to Specification: A Survey on Validating EU AI Act Requirements in RE

从义务到规范:关于在需求工程中验证欧盟人工智能法案要求的调查

T. Y. Emmy Lai, Sven Giesselbach, Matthias Koch, Héctor Allende-Cid

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究围绕欧盟人工智能法案生效后组织面临的新义务,通过混合方法探索性研究,评估组织准备及对大语言模型智能验证工具的看法,发现虽法案相关但结构化机制缺失,该工具在映射义务等方面有前景但需保障措施,还概述了闭环方法最低要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20453 2026-07-24 cs.CL cs.AI cs.LG 新提交 67%

A Knowledge-Injection Framework for Zero-Shot Adaptation of LLMs to Delirium Prediction

一种用于将大语言模型零样本适应谵妄预测的知识注入框架

Jessica Sena, Shesadree Priyadarshani, Miguel Contreras, Bharat Gandhi, Scott Siegel, Subhash Nerella, Parisa Rashidi

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对大语言模型零样本适应谵妄预测中领域知识不足问题,提出轻量级知识注入框架。在推理时用外部临床知识报告增强数据摘要,无需微调或检索。实验表明该方法能提升模型性能,缩小与前沿模型差距,且收益依赖临床意义内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13531 2026-07-23 cs.LO cs.DC cs.ET cs.SY eess.SY 版本更新 67%

Ripple: An Open, AI-Formalized Lean 4 Framework for Computing with CRNs

Ripple:一个用于化学反应网络计算的开放的、人工智能形式化的Lean 4框架

Ho-Lin Chen, Xiang Huang

专题命中 工作流自动化 :AI agent(abstract);workflow(abstract)

AI总结 介绍用于CRN计算实数数学的Ripple框架,它形式化多种模型阶梯,开发可靠,暴露并修复证明漏洞,还证明新结果,且形式化主要由人工智能代理利用公开模型完成,工作流程可重现。

Comments 26 pages. v2 removes the incorrect claim that the formalization found a gap in the Angluin-Aspnes-Eisenstat (2008) approximate-majority proof: the flawed inequality was internal to our formalization, not their argument. It also corrects the attribution of zeta(3)'s CRN-computability to the Fermi-Dirac integral route. Abstract revised

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18316 2026-07-22 cs.SE cs.AI cs.CL 新提交 67%

Binding Drift in Multi-Step Tool-Augmented Agents

多步工具增强智能体中的绑定漂移

Rahul Suresh Babu, Shashank Indukuri

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究多步工具增强智能体中实体绑定随时间的变化,区分绑定漂移与错误传播。通过实验发现实体锁定会放大错误操作,实用的重新验证器可减少错误,自然设置下基线智能体有漂移现象,且持久性和重新验证不可互换。

Comments 14 pages, 5 tables, 1 figure. Equal contribution by both authors. Code and data: https://github.com/shashank-indukuri/binding-drift

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09994 2026-07-22 cs.NI 版本更新 67%

ORCHID: Fairness-Aware Orchestration in Mission-Critical Air-Ground Integrated Networks

ORCHID:面向关键任务空地一体化网络的公平性感知编排

Chuan-Chi Lai, Chi Jai Choy

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract)

AI总结 ORCHID提出一种两阶段学习框架,通过拓扑分区和重置微调机制提升多UAV编排稳定性,实现服务公平性与能效的协同优化。

Comments 18 pages, 8 figures, 1 Table. Full research paper proposing a resilient two-stage orchestration framework for collaborative UAV-GBS deployment in mission-critical Air-Ground Integrated Networks (AGINs). This revised version introduces a game-theoretic approach (Egalitarian Bargaining Game) and an aerodynamic energy model to enhance system robustness. Under review at an IEEE journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18039 2026-07-21 cs.IR 新提交 67%

Evidence-in-the-Loop: Trace-Driven Optimization for Customer-Service LLM Agents

循证优化:面向客户服务语言模型代理的跟踪驱动优化

Chunming Wu, Dafei Qiu, Congde Yuan, Charles Quan, Jun Wu, Suipeng Li, Mo Wu, Gavin Xie, Hope Chen, Max Yao

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 研究面向客户服务语言模型代理的优化,提出循证客户服务代理工作流程,通过多种技术构建证据,结合政策引导编排。贡献混合RAG证据构建、循证问题/行动决策、跟踪驱动的RAG和重排器改进三种部署模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18531 2026-07-20 cs.AI cs.CL cs.LG 67%

Enhancing Hepatopathy Clinical Trial Efficiency: A Secure, Large Language Model-Powered Pre-Screening Pipeline

提升肝病临床试验效率:一种安全的、基于大语言模型的预筛选流程

Xiongbin Gui, Hanlin Lv, Xiao Wang, Longting Lv, Yi Xiao, Lei Wang

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种基于大语言模型的安全预筛选流程,通过两种策略提升肝病临床试验的效率与精度。

Comments 30 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00613 2026-07-15 physics.chem-ph 版本更新 67%

Ai2-Kit: Streamlining AI-Accelerated Ab Initio Workflows for Complex Chemical Systems

Ai2-Kit: 为复杂化学系统简化AI加速从头算工作流

Sheng Bi, Wei-Hong Xu, Yong-Bin Zhuang, Jia-Xin Zhu, Jiang-Peng Qiu, Yu-Hang Tang, Xiang-Long Du, Qi You, Yun-Pei Liu, Fu-Qiang Gong, Yu-Xin Guo, Yi-Ze Wang, Cheng-Xuan Wang, Zi-Heng Gong, Zi-Qiang Chen, Chang Liu, Siyuan Han, Jian Gu, Jia-Xin Li, Yi-Ming Chen, Lin Huang, Si-Jie Chen, Bo-Ying Huang, Jie-Zhen Xia, Fan-Jie Xu, Su-Yang Zhong, Peng-Wei Xu, Jun-Yi Wang, Xing-Yun Xie, Yu-Lei Gong, Yan-Yi Su, Yue Liu, Rui-Hao Bi, Lang Li, Fei-Teng Wang, Jing-Xiang Zou, Mei Jia, Jie-Qiong Li, Min Lin, Qi-Yuan Fan, Juan-Juan Sun, Jia-Bo Le, Zixuan Wei, Jin-Yuan Hu, Meng-Lei Jia, Yan Sun, Xiao-Hui Yang, Fujie Tang, Feng Wang, Jun Cheng

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 提出ai2-kit工具包,通过命令行和Python API整合第一性原理计算、机器学习势训练、分子动力学、增强采样和HPC编排,实现复杂化学系统的AI加速从头算工作流自动化与可扩展。

Comments 24 pages, 11 figures. Submitted to Chemical Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29100 2026-07-07 cs.CE 67%

Toward Exascale AI for Science: A Scalable AI Skill for Autonomous Microkinetics Discovery

面向百亿亿次AI科学计算:一种可扩展的AI技能用于自主微观动力学发现

Ken-ichi Nomura, William Dawson, Nabankur Dasgupta, Taufeq Mohammed Razakh, Thomas Linker, Kai Ito, Aiichiro Nakano

专题命中 工作流自动化 :workflow(abstract);agentic(abstract)

AI总结 提出可扩展的AI驱动框架,结合智能体工作流自动化、高性能计算和科学代理模型,实现自主微观动力学发现,减少专家干预并评估代理模型可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13306 2026-07-03 cs.GT 新提交 67%

EconCSLib: AI-Assisted Lean Formalization for Economics & Computation research

EconCSLib: 人工智能辅助的经济学与计算研究Lean形式化

Nikhil Garg

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 提出EconCSLib,一个基于Lean 4的库和工作流,利用语言模型辅助形式化经济学与计算领域的研究论文,通过人-AI-Lean协作流程实现论文声明到形式化语句的翻译与验证。

Comments Accepted to EC'26 Workshop on AI-Driven Research in EconCS (AI-EconCS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28348 2026-06-30 cs.NI 67%

Intent-Driven 6G Service Orchestration: Grounded Translation, Validation, and Decomposition

意图驱动的6G服务编排:基于目录的翻译、验证与分解

Jean Martins, Leonid Mokrushin, Marin Orlic, Amardeep Kumar A

专题命中 工作流自动化 :workflow(abstract);agentic(abstract)

AI总结 提出一个三阶段智能体工作流,通过语义服务目录、SHACL验证和约束满足分解,实现6G意图驱动编排,在930次基准测试中成功率达97%,并减少26%的对抗性幻觉。

Comments AI4NextG @ ICML'26 Workshop on AI and ML for Next-Generation Wireless Communications and Networking

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28344 2026-06-30 cs.IR cs.AI cs.CL cs.CV cs.LG 67%

PIXELRAG: Web Screenshots Beat Text for Retrieval-Augmented Generation

PIXELRAG:网页截图在检索增强生成中优于文本

Yichuan Wang, Zhifei Li, Zirui Wang, Paul Teiletche, Lesheng Jin, Matei Zaharia, Joseph E. Gonzalez, Sewon Min

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出PixelRAG方法,以网页截图替代文本进行检索和阅读,利用视觉嵌入模型和对比学习,在30M截图库上实现端到端RAG,在多项任务中优于文本基线,准确率提升最高18.1%,并通过图像压缩降低3倍token成本。

Comments Our code is available at https://github.com/StarTrail-org/PixelRAG

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21190 2026-06-30 cs.CV 67%

SpatiO: Adaptive Test-Time Orchestration of Vision-Language Agents for Spatial Reasoning

SpatiO: 用于空间推理的视觉-语言代理自适应测试时编排

Chan Yeong Hwang, Miso Choi, Sunghyun On, Jinkyu Kim, Jungbeom Lee

机构 * Korea University(韩国大学) Kakao Mobility Corp.(Kakao Mobility公司) Handong Global University(Handong全球大学)

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract)

AI总结 SpatiO通过自适应测试时编排机制协调多种视觉-语言代理,提升空间推理能力,在多个基准测试中优于现有方法。

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02080 2026-06-25 cs.AI cs.FL cs.LG cs.SE 版本更新 67%

The 4/$δ$ Bound: Designing Predictable LLM-Verifier Systems for Formal Method Guarantee

4/δ 界:设计具有形式方法保证的可预测 LLM-验证器系统

Pierre Dantas, Lucas Cordeiro, Youcheng Sun, Waldir Junior

专题命中 工作流自动化 :planning(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 提出 LLM-验证器收敛定理,将多阶段验证建模为顺序吸收马尔可夫链,证明成功概率 δ>0 时系统几乎必然验证,并导出精确延迟上界 4/δ,经 90000+ 试验验证。

Comments 36 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24177 2026-06-24 cs.SE cs.AI cs.CL cs.MA 新提交 67%

Agon: An Autonomous Large-Scale Omnidisciplinary Research System Built on Prompt Economy

Agon:基于提示经济学的自主大规模全学科研究系统

Youran Sun, Xingyu Ren, Chugang Yi, Jiaxuan Guo, Kejia Zhang, Jianda Du, Haizhao Yang

机构 * University of Maryland, College Park(马里兰大学 College Park 分校) The Chinese University of Hong Kong(香港中文大学) Stanford University(斯坦福大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 提出Agon研究编排系统,通过提示经济学循环实现大规模自主研究,将可验证任务自动化,不可验证判断留给人类,并分类了系统失败类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18684 2026-06-24 cs.CR cs.AI cs.CL cs.LG cs.SY eess.SY 版本更新 67%

FALCON: Transforming Cyber Threat Intelligence into Deployable IDS Rules with Self-Reflection

FALCON:通过自我反思将网络威胁情报转化为可部署的入侵检测系统规则

Shaswata Mitra, Subash Neupane, Martin Duclos, Sudip Mittal, Aritran Piplai, Md Rayhanur Rahman, Edward Zieglar, Shahram Rahimi

机构 * Meharry Medical College(梅哈里医学院) The University of Texas at El Paso(德克萨斯理工大学) The University of Alabama(阿拉巴马大学) National Security Agency(国家安全局)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出FALCON框架,通过新颖的CTI-规则语义评分器实现规则检索、生成和验证,解决签名型入侵检测系统中规则创建的手动瓶颈和验证难题,在Snort和YARA平台上达到0.72平均相关性。

Comments 17 pages, 10 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏