FormIDEAble: Safe and Socially-aware Autonomous Systems
FormIDEAble:安全且具有社会感知能力的自主系统
专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.SE
AI总结 提出FormIDEAble方法,通过带代价的马尔可夫决策过程建模人机协作,将决策形式化为代价有界可达性问题,在保证安全的同时实现社会感知策略合成。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
FormIDEAble:安全且具有社会感知能力的自主系统
专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.SE
AI总结 提出FormIDEAble方法,通过带代价的马尔可夫决策过程建模人机协作,将决策形式化为代价有界可达性问题,在保证安全的同时实现社会感知策略合成。
面向室内环境的模块化视觉-语言-动作机器人框架
机构 * TCS Research, Tata Consultancy Services(塔塔咨询服务公司TCS研究部) ; CMU(卡内基梅隆大学)
专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.AI
AI总结 提出模块化架构,集成环境建图、问题处理和导航,通过双流并行处理(语义体素建图与语言分类)实现自然语言指令驱动的自主任务执行。
Comments IEEE IROS 2025 Workshop on Generative AI for Robotics and Smart Manufacturing
OpenRCA 2.0:从结果标签到因果过程监督
机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
专题命中 工作流自动化 :tool use(abstract);agentic(abstract);分类 cs.AI
AI总结 针对现有根因分析数据集仅标注结果而忽略因果传播路径的问题,提出PAVE协议重建因果路径,构建OpenRCA 2.0基准,发现LLM在根因定位中因果验证不足的缺陷。
Comments work in progress
AI教练:利用强化学习加速人类技能发展
机构 * University of Pennsylvania(宾夕法尼亚大学) ; Johns Hopkins University(约翰霍普金斯大学)
专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.AI
AI总结 本文提出一种基于非合作动态博弈和强化学习的AI教练框架,通过自适应共享控制和因果影响模型加速人类运动技能发展,在无人机竞速用户研究中显著提升学习效果。
分子性质预测的闭环自动研究:发现并认证可泛化的改进
机构 * DP Technology
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 提出闭环自动研究框架,通过语言模型代理编辑表示、模型代码和外部证据,在分子性质预测任务上评估改进的泛化性,发现特征、模型和数据三个轴线的可迁移性因基准而异,并验证了污染过滤对迁移的必要性。
Zhinong AI:面向小农生产的AI赋能农业决策支持平台的设计科学研究
机构 * University of Sanya(三亚大学) ; Hebei International Studies University(河北国际关系学院)
专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI
AI总结 本文通过设计科学研究,提出了一个集成信息推送、问答、诊断、日历管理等功能的小农决策支持平台,并构建了分层架构、闭环流程、评估指标和治理框架,为AI农业原型转化为可测试、负责任的基础设施提供了结构化研究框架。
面向软件工具发现的LLM加速快速综述——以日志异常检测为例
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.SE
AI总结 提出一种结合LLM筛选和编码代理的流水线,用于快速识别和运行软件工具,在日志异常检测案例中实现高效综述。
Comments 52nd Euromicro Conference on Software Engineering and Advanced Applications (SEAA) 2026
神奇的科学智能体及其构建方法:用于Rietveld精修的AgentBuild
机构 * UT-Battelle, LLC(UT-Battelle有限责任公司) ; US Department of Energy (DOE)(美国能源部)
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 提出AgentBuild框架,通过科学家编写的合同(包含评分标准、课程和知识库)自动构建科学智能体,用于X射线衍射数据的Rietveld精修,实现可复用的智能体编译而非手动调优。
人工智能在船舶金融中的应用:机遇与AI增强贷款发起的案例研究
机构 * ShipFinance.ai ; HHX.blue GmbH ; Technical University of Munich(慕尼黑技术大学) ; University of the Aegean(爱琴海大学)
专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI
AI总结 本文探讨AI在船舶金融中的应用,提出基于大语言模型的模块化架构,用于文档理解、信息提取和工作流自动化,以支持贷款申请流程。
Comments 9 pages, 1 figure
Regimes: 一种可审计的、保留验证集的改进循环——在ActiveGraph上的LongMemEval演示
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 提出Regimes,一种基于事件溯源的可审计自主改进循环,通过ActiveGraph运行时实现故障记录、重放和保留集验证,在LongMemEval-S上提升0.05-0.10的准确率。
Comments 30 pages, 5 figures. Code and committed runs: https://github.com/yoheinakajima/regimes
(自动)形式化应该很简单:用于详细阐述严格证明的Trellis过程语义
机构 * Department of Mathematical Sciences, Carnegie Mellon University(卡内基梅隆大学数学科学系)
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 提出Trellis系统,通过确定性约束工作流和LLM代理迭代细化自然语言证明,实现Lean自动形式化,强调严格证明的可细化性。
Comments 15 pages, 7 figures, 5 tables
上下文碎片化解构攻击:利用工具使用LLM代理的工件来源鸿沟
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 针对工具使用LLM代理,提出上下文碎片化解构(CFD)攻击,利用跨上下文工件来源鸿沟实现多步越狱,成功率提升高达28.3个百分点。
数据代理遭受攻击:LLM驱动的分析系统中的漏洞
机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) ; The Hong Kong Polytechnic University(香港理工大学) ; Tsinghua University(清华大学)
专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI
AI总结 本研究系统分析了LLM驱动的数据代理的安全漏洞,提出了分层漏洞框架和攻击分类法,并在六个系统上评估了攻击效果,揭示了当前系统的重大安全缺陷。
FAST-HEP:为高能物理及其他领域编译声明式分析工作流
专题命中 工作流自动化 :planning(abstract);workflow(abstract)
AI总结 FAST-HEP的Flow引擎将声明式工作流语言、编译器与运行时结合,编译生成与后端无关的执行计划,支持模块化替换与溯源记录,为高能物理及其他领域提供透明可重复的工作流基础。
RaivenTracks:面向对话式可视化工作流的分支溯源系统
专题命中 工作流自动化 :AI agent(abstract);workflow(abstract)
AI总结 RaivenTracks是Raiven可视化管道的工作流感知扩展,通过两级状态管理架构实现可分支的版本树与细粒度撤销/重做,试点研究显示其支持可视化工作流的分支与恢复,为AI驱动科学工作流的溯源监督提供了新方向。
Comments *Ella Hugie and Alexandra Irger are co-first authors
zenDot:一款集成大语言模型(LLM)的量子TCAD平台,用于半导体量子器件设计与优化自动化
专题命中 工作流自动化 :agent(abstract);workflow(abstract)
AI总结 zenDot是集成LLM的量子TCAD平台,可连接器件物理与LLM驱动的设计探索,在Si/SiO₂双量子点验证中完成18次设计迭代,将最差门保真度降低近30倍。
MMUSV-Sim:面向多无人水面艇协同感知的感知导向型仿真与数据生成平台
机构 * School of Intelligent Systems Engineering, Sun Yat-sen University(中山大学智能工程学院) ; School of Intelligent Imagery Engineering, Beijing Film Academy(北京电影学院智能影像工程学院)
专题命中 工作流自动化 :agent(abstract);workflow(abstract)
AI总结 该研究提出基于Unreal Engine 5和Project AirSim的MMUSV-Sim仿真与数据生成平台,用于多USV协同感知,实验表明其生成的数据集可使激光雷达协同BEV船舶检测的AP@0.5达72.74,显著优于单USV方案。
罕见异常失效下的解释性参与:模型行为中的渐近稀有性(或:渐近式AI)
专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本研究探究LLM在低可控失效概率工作流中,解释性参与度随失效渐近稀有性的变化,发现触发结构是关键调节变量,不同模型的异常识别与参与表现存在差异。
Comments 11 figures. Elicitation-condition sweep across three open-weight models (qwen3:8b, llama3.1:8b, mistral:7b); pipeline scripts and experimental data available upon reasonable request
管道指称设计:零成本的构造正确性数据管道
专题命中 工作流自动化 :agent(abstract);AI agent(abstract)
AI总结 提出管道指称设计(PDD)方法论,在设计时零成本实现数据管道构造正确性,可验证 AI 生成管道的粒度一致性,已在生产工具链中实现并评估。
Comments Extended version of a work-in-progress paper; the experimental evaluation is in progress and will appear in a later revision. Builds on a companion grain theory paper, arXiv:2601.00995
镜像过去:探索祖先数字自我如何影响历史学习
专题命中 工作流自动化 :agent(abstract);workflow(abstract)
AI总结 该研究针对历史学习中学习者与自身的疏离问题,提出AI生成的“祖先数字自我”教学智能体,经被试内研究发现其可提升体验性指标,但未改善即时学习结果,为相关教育环境设计提供启示。
工具增强型大语言模型系统中的持久语义实体
专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG、cs.SE
AI总结 该研究定义工具增强型LLM系统的持久语义实体(PSEs),证实其在24款不同规模模型中普遍存在,偏好/指令污染难自校正,上下文隔离自验证可降低污染,为智能体系统安全提供关键发现。
Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026). Camera-ready version; 32 pages . The openreview url is https://openreview.net/forum?id=zPjmtawzT8¬eId=CXB95ws5so and ICML poster url is https://icml.cc/virtual/2026/poster/60521
通过端到端评估应用层行动证据发现Project Veraison的TPM参考方案中存在的挑战随机数新鲜度缺口
专题命中 工作流自动化 :agent(abstract);AI agent(abstract)
AI总结 本文发现Project Veraison的TPM参考方案存在挑战随机数新鲜度缺口,通过端到端测试验证修复方案,使重放Quote的评估结果变为否定,提升了RATS架构的安全性。
Comments 18 pages, 3 figures. Responsible disclosure: veraison/services#427, fixed in PR #432. Artifact and data: doi:10.5281/zenodo.20998730
AnyLog 边缘数据架构
专题命中 工作流自动化 :agent(abstract);AI agent(abstract)
AI总结 本文提出 AnyLog 边缘数据架构,该基于智能体与边缘的平台可在源端管理运营数据,通过多项技术让用户无需知晓资源位置即可操作分布式资源,为分布式 SQL 等提供类云操作模式,无单点故障且不依赖集中式基础设施。
Comments Keywords: IoT Data Management, Edge Data Management, Edge Data Fabric, Distributed Query, Edge AI, P2P Data Layer, Decentralized Data Layer. 30 pages, 6 figures
OptGraph:基于图检索增强生成的大语言模型增强进化优化
专题命中 工作流自动化 :workflow(abstract);agentic(abstract)
AI总结 针对现有LLM自动化进化优化的局限,提出引入GraphRAG的OptGraph工作流,通过类型化图复用经验等方法,在基准数据集上较现有框架平均精确准确率提升8.9%。
通过将设计意图编译到切片器项目中对切片过程进行功能分级
专题命中 工作流自动化 :planning(abstract);workflow(abstract)
AI总结 研究如何对切片过程进行功能分级,核心方法是提出切片器项目编译的自动化工作流程,将异构隐式设计转换为切片器原生项目,主要贡献是通过示例展示该方法并开源实现,连接异构设计与切片器生态系统,助力功能分级FFF制造。
JarvisHub:用于原生画布多模态创意智能体的开放框架
专题命中 工作流自动化 :agent(abstract);tool use(abstract)
AI总结 研究针对创意人工智能从单步到多模态创作转变中现有系统不足的问题,引入JarvisHub框架,以可编辑画布为核心,通过三层架构让智能体实现持续、人工可控的创意自动化创作。
Comments 15 pages, 9 figures. Project page: https://www.jarvishub.site/ Code github: https://github.com/LYL1015/JarvisHub
从义务到规范:关于在需求工程中验证欧盟人工智能法案要求的调查
专题命中 工作流自动化 :agentic(abstract);分类 cs.AI、cs.CL、cs.SE
AI总结 研究围绕欧盟人工智能法案生效后组织面临的新义务,通过混合方法探索性研究,评估组织准备及对大语言模型智能验证工具的看法,发现虽法案相关但结构化机制缺失,该工具在映射义务等方面有前景但需保障措施,还概述了闭环方法最低要求。
一种用于将大语言模型零样本适应谵妄预测的知识注入框架
专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 针对大语言模型零样本适应谵妄预测中领域知识不足问题,提出轻量级知识注入框架。在推理时用外部临床知识报告增强数据摘要,无需微调或检索。实验表明该方法能提升模型性能,缩小与前沿模型差距,且收益依赖临床意义内容。
多步工具增强智能体中的绑定漂移
专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.SE
AI总结 研究多步工具增强智能体中实体绑定随时间的变化,区分绑定漂移与错误传播。通过实验发现实体锁定会放大错误操作,实用的重新验证器可减少错误,自然设置下基线智能体有漂移现象,且持久性和重新验证不可互换。
Comments 14 pages, 5 tables, 1 figure. Equal contribution by both authors. Code and data: https://github.com/shashank-indukuri/binding-drift
循证优化:面向客户服务语言模型代理的跟踪驱动优化
专题命中 工作流自动化 :agent(abstract);workflow(abstract)
AI总结 研究面向客户服务语言模型代理的优化,提出循证客户服务代理工作流程,通过多种技术构建证据,结合政策引导编排。贡献混合RAG证据构建、循证问题/行动决策、跟踪驱动的RAG和重排器改进三种部署模式。