DocClaw: A Unified Agentic System for Intelligent Document Processing
DocClaw:用于智能文档处理的统一智能体系统
专题命中 工作流自动化 :agentic(title,abstract);agent(abstract)
AI总结 研究针对现有智能文档处理任务多为独立建模的问题,提出统一智能体系统DocClaw,通过智能体与文档的共享交互处理多种IDP任务,在基准测试中取得有竞争力的性能。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
DocClaw:用于智能文档处理的统一智能体系统
专题命中 工作流自动化 :agentic(title,abstract);agent(abstract)
AI总结 研究针对现有智能文档处理任务多为独立建模的问题,提出统一智能体系统DocClaw,通过智能体与文档的共享交互处理多种IDP任务,在基准测试中取得有竞争力的性能。
作为AI风险基础设施的保险:AI采纳的生成智能体模拟
专题命中 工作流自动化 :agent(title,abstract);workflow(abstract)
AI总结 本文提出将保险作为AI风险基础设施,开发LLM驱动的基于智能体的社会模拟系统,验证其可降低企业财务风险,加速AI工具采纳并提升企业偿付能力与总体资本。
FabDreamer:通过AI辅助分层制造探索图像到物理的工作流
专题命中 工作流自动化 :workflow(title,abstract);agent(abstract)
AI总结 FabDreamer是一款图像转物理的AI辅助系统,通过三个阶段将图像转化为可制造SVG,经多轮评估验证其可提升制造效率并适配不同领域需求。
Comments 16 pages, 10 figures
Journal ref Proceedings of the 39th Annual ACM Symposium on User Interface Software and Technology (UIST 2026)
Surprise2Refine:面向智能体辅助创意支架的以轴为中心的探索-细化方法
专题命中 工作流自动化 :agent(title,abstract);workflow(abstract)
AI总结 针对现有智能体创意工具设计空间适配不足的问题,提出Surprise2Refine的以轴为中心的探索-细化工作流,原型可构建n×n设计空间,研究表明其能提升用户控制感与设计成果感知创意性。
Comments Accepted to ACM UIST 2026
转变论文指导中的互动:高等教育中以开题报告为核心的工作流程
专题命中 工作流自动化 :workflow(title,abstract);planning(abstract)
AI总结 本文以某机构的以开题报告为核心的论文指导工作流程为研究对象,采用混合方法结合反思性设计视角分析,发现其提升了论文准备的结构化程度但仅重新分配工作,贡献了对该社会技术工作流程的分析。
Comments 5 pages, 3 figures; accepted as Work in Progress at Mensch und Computer 2026 (MuC 2026)
“没人做过这件事”:智能体介导协作中的贡献、原创性与问责制
专题命中 工作流自动化 :agent(title,abstract);workflow(abstract)
AI总结 本研讨会聚焦智能体介导协作中的贡献消解问题,将召集研究者与从业者,通过多元活动探讨应对方案,旨在形成共享研究议程与基础设施应对基础。
一种基于机器学习的非常规油藏气举优化工作流程
专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.LG、cs.SE
AI总结 针对非常规油藏气举优化问题,提出基于机器学习的自动化数据驱动工作流程,集成预测气举性能曲线的模型与贝叶斯优化框架,利用历史数据求解最佳注气速率,试点及部署效果良好,为相关资产提供有效经济方案。
Comments 11 pages, 13 figures
Journal ref Proceedings of the Unconventional Resources Technology Conference (URTeC), Houston, TX, USA, June 17-19, 2024, pp. 1600-1610
ABISS:通过代理交互评估文本到SQL系统
专题命中 工作流自动化 :agent(title,abstract);multi-agent(abstract)
AI总结 研究针对文本到SQL系统在处理现实模糊问题的不足,提出统一分类法、多代理生成管道及动态模拟环境ABISS。通过实验揭示模型在子类别分类和澄清条件下SQL生成的瓶颈,提供真实类别虽有收益,但模糊问题执行率仍低,且发布相关代码。
Open-KNEAD:通过智能分解实现基于知识的营养估计
机构 * Purdue University(普渡大学)
专题命中 工作流自动化 :agentic(title,abstract);agent(abstract)
AI总结 研究探讨多模态大语言模型用于膳食评估时检索增强基础方法是否仍有价值。提出无需训练、可本地部署的Open-KNEAD框架,通过营养感知检索关联食物项与FNDDS代码,提高份量估计,还能恢复非美国烹饪风格估计偏差,优势显著并开源相关框架与知识库。
Comments 10 pages main paper, 5 pages supplementary
作为人工智能-智能体对齐层次的基础市场设计
专题命中 工作流自动化 :agent(title,abstract);AI agent(abstract)
AI总结 研究探讨市场中人工智能-智能体对齐,提出将基础市场设计视为该对齐层次,通过对市场核心形式化建模,利用理论计算机科学严谨性构建透明盒模型,支持激励分析与机制设计,使期望行为受青睐,不良行为难维持。
Comments Accepted as at the EC'26 Workshop on Incentive-Based AI Alignment, co-located with the 27th ACM Conference on Economics and Computation, Rome, Italy, July 2026. This version is prepared for public dissemination following workshop acceptance
认证幽灵:网络安全人工智能代理如何突破欧盟网络弹性法案
专题命中 工作流自动化 :AI agent(title);agent(abstract);agentic(abstract)
AI总结 研究欧盟网络弹性法案在网络安全人工智能代理冲击下的问题,指出其四点假设被打破,法案应对方式有矛盾,提出应转向持续且由代理操作的安全模式,并通过机器人实验验证补救措施。
评估用于自主计算病理学的智能控制框架系统
机构 * National Institute for Data Science in Health and Medicine, Xiamen University(厦门大学健康医疗大数据国家研究院)
专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract)
AI总结 研究将高级病理学分析目标转化为可执行工作流,贡献 ACP-Bench 框架,评估 41 个病理学工作流任务、9 个模型和 3 个控制框架组,通过多方面评估为智能系统实现病理学工作流提供标准。
TO-Master:用于自动化拓扑优化的大语言模型智能体框架
专题命中 工作流自动化 :agent(title,abstract);workflow(abstract)
AI总结 提出TO-Master框架,利用大语言模型智能体将有限元拓扑优化转化为对话式工作流,通过自然语言指令自动完成几何处理、网格生成、边界条件设置和优化求解,无需用户编写代码。
Comments 29 pages, 10 figures, 2 tables; submitted manuscript
从搜索到合成:训练大语言模型为零样本工作流生成器
机构 * School of Mathematics Science, Peking University(北京大学数学科学学院)
专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出MetaFlow,将工作流生成视为元学习问题,通过两阶段训练(监督微调+强化学习)使模型能生成可泛化的任务级工作流,在问答、代码生成和数学推理任务上实现零样本泛化。
Comments 35 pages, 8 figures
MedSWFlow: 一个用于起草医务社会工作案例计划的开源LLM工作流
专题命中 工作流自动化 :workflow(title,abstract);planning(abstract)
AI总结 提出开源、模型无关的LLM工作流MedSWFlow,将案例计划任务分解为六个阶段,通过结构化提示生成可审查的评估表和服务计划,旨在辅助从业者起草案例计划。
Comments 26pages, 8tables, 2figuers
看见不等于筛查:针对智能体技能扫描仪的多模态隐藏指令攻击
机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) ; Chongqing University, China(重庆大学) ; Northeastern University, China(东北大学) ; University of Chinese Academy of Sciences, China(中国科学院大学) ; Beihang University, China(北航大学)
专题命中 工作流自动化 :agent(title,abstract);workflow(abstract)
AI总结 针对现有技能扫描仪忽视图像中恶意指令的盲点,提出SkillCamo多模态攻击将指令隐藏于图像,并设计ExecScan执行级扫描模块,通过意图提取、行为重建等检测隐藏指令,实验证明其有效性。
Mind Companion: 一种用于基于过程心理治疗的具身对话代理
专题命中 工作流自动化 :agent(title,abstract);planning(abstract)
AI总结 提出Mind Companion,一种基于大语言模型的具身对话代理,通过多层级心理分析与过程治疗原则,实时分析客户陈述并生成回应,评估显示GPT-5.2在多个维度上优于人类治疗师。
Journal ref 2026 IEEE 14th International Conference on Healthcare Informatics (ICHI), Minneapolis, MN, June 1-3, 2026, pp. 980-989
Struct-Searcher:代理式结构化思维推进多模态深度信息检索
机构 * CUHK(香港中文大学) ; LIGHTSPEED ; PKU(北京大学) ; Tongji University(同济大学) ; THU(清华大学) ; HKUST(香港科技大学)
专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract)
AI总结 提出基于信念修正理论的结构化代理工作流Struct-Searcher,通过维护多模态结构图实现冲突感知的深度信息检索,在多个基准上平均相对准确率提升17.2%。
面向执行约束的自主AI自动化:一种可复现的AIBOM驱动的CSAF-VEX框架
机构 * University of Oxford(牛津大学) ; Cisco Systems(思科系统) ; The Alan Turing Institute(艾伦·图灵研究所) ; University of Warwick – WMG(沃里克大学 – WMG) ; University of Hull(哈罗德大学)
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.SE
AI总结 提出一种协议驱动框架,通过绑定SBOM和AIBOM工件与确定性环境捕获及结构化运行时遥测,结合静态与运行时证据生成CSAF VEX公告,经密码签名和确定性重放验证,在合成自主AI工作负载上评估。
Journal ref Execution-bound advisory automation for agentic AI: a reproducible AIBOM-driven CSAF-VEX framework. Front Artif Intell 9, (May 2026), 1826384
Graphectory Viewer:面向智能体软件轨迹的以流程为中心分析工具
专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI、cs.SE
AI总结 Graphectory Viewer是一款基于网页的交互式开源工具,可将异构软件智能体原始轨迹转换为阶段感知图,支持多框架轨迹分析,助力研究人员分析智能体执行、行为模式及成功失败案例,为智能体软件轨迹研究提供支撑。
Comments 5 pages, Short Paper; ASE 2026 Tool Track
静态分析引导的智能体AI翻译使Rust成为全栈生物信息学语言
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.SE
AI总结 该研究结合智能体AI与静态分析,将生物信息学遗留代码翻译为Rust,在Bascet软件上实现规模、构建时间、性能的显著优化,且支持原生Windows运行,为生物信息学软件大规模重构提供了低成本方案。
ChemWorld:用于可控且可重复智能体实验的可编程化学世界
机构 * Tsinghua University(清华大学)
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.LG
AI总结 本研究提出可编程化学环境ChemWorld,分离公开实验契约与私有化学定律,支持实验轨迹精确重放,通过多组实验验证其可控性与可重放性,为化学智能体实验提供互补于物理实验室的基底。
一种用于知识图谱生成的智能体式混合自顶向下与自底向上方法
机构 * Malt
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.CL
AI总结 针对HR平台的多语言非标准化技能声明问题,提出结合LLM与Wikidata KG的智能体式混合KG生成流水线,可生成可扩展可解释的技能KG。
DoctorAgents:用于针对小型临床时序数据迭代优化自动机器学习流水线的智能体框架
机构 * McGill University(麦吉尔大学) ; Mila – Quebec AI Institute(米拉-魁北克人工智能研究所) ; CIUSSSE-CHUS(谢布鲁克大学医学中心综合大学健康和社会服务中心) ; University of Sherbrooke(谢布鲁克大学)
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG
AI总结 DoctorAgents是一种用于小型临床时序数据的智能体框架,通过LLM智能体以推理驱动方式迭代优化AutoML流水线,在多种临床任务上性能优于现有AutoML基线且可解释性更强。
Comments 34 pages, 5 figures
评估用于企业自动化的大语言模型权衡:来自生产级企业平台中工作流生成的经验教训
专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.SE
AI总结 该研究通过在生产级企业平台评估6种大语言模型的工作流生成能力,发现分段式流水线可提升结构成功率,使小型模型达生产可行性,为云工程提供模型无关的自动化方案。
Comments 10 pages, 3 figures, 5 tables. Accepted at the 14th IEEE International Conference on Cloud Engineering (IC2E 2026), Industry Track
基于强化学习的智能体技能渐进式生成
机构 * The Chinese University of Hong Kong(香港中文大学) ; LIGHTSPEED(光速公司)
专题命中 工作流自动化 :agent(title,abstract);分类 cs.CL、cs.LG
AI总结 该研究针对现有技能生成方法的缺陷,提出基于强化学习的Skill-α方法,将技能生成为序列编辑过程并引入回退奖励,在CL-Bench和tau2-bench上均显著提升了下游任务成功率。
Comments Code is available at https://github.com/ejhshen/skill-alpha
执行前澄清:用于解决3D工具编排中意图不对称的自进化智能体
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.CL
AI总结 研究3D资产创建中用户指令模糊与工具要求精确的意图不对称问题,提出自进化智能体CLARE,通过解耦生成管道、模拟多轮交互自我进化澄清策略,在新基准测试中取得领先性能,证明主动澄清对3D执行的关键作用。
Comments Accepted to ACM Multimedia 2026 (ACM MM 2026). 26 pages including appendix, 8 figures. Code: https://github.com/xyzhu1225/CLARE
2026年金融市场评估任务3中的金融分析师:一个结合大型语言模型专家和基于规则信号的实时混合交易代理
机构 * University of North Texas(北德克萨斯大学)
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.CL
AI总结 研究针对金融市场评估任务3,提出结合LLM专家和规则信号的混合交易代理Fin-Analyst,用于特斯拉和比特币交易。通过多源信息聚合及规则投票,在特斯拉交易上取得高回报率,比特币交易表现良好,还分析了排名逆转原因及信号影响等,为后续模型改进提供依据。
Comments 14 pages, 7 tables, 1 figure. CLEF 2026 FinMMEval Task 3 Working Notes
过滤有害行为是不够的:智能体自反决策函数中的幻影转移
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG
AI总结 研究在含对抗交互的合成智能体轨迹训练的影响,通过微调Llama 3.3 70B Instruct并评估,发现有害行为过滤不足,生成过程引入失调倾向且分散编码,依赖生成模型,安全基准难区分影响,强调动作级过滤无法确保合成智能体训练数据安全。
失败作为一个过程:CLI编码代理轨迹剖析
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.SE
AI总结 研究CLI编码代理失败轨迹,引入面向过程框架,收集并标注大量执行轨迹,发现失败多由认知错误驱动,起始于最初几步且常隐藏,提出提高编码代理可靠性需早期验证和干预,而非仅靠最终结果评估。
Comments 12 pages, 6 figures