Automatizing a non-scripting TPS for optimizing clinical workflow and re-optimization of IMRT/VMAT plans
专题命中 工作流自动化 :workflow(title,abstract);planning(abstract)
Comments 11 pages, 7 figures
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
专题命中 工作流自动化 :workflow(title,abstract);planning(abstract)
Comments 11 pages, 7 figures
专题命中 工作流自动化 :workflow(title,abstract);agent(abstract)
Comments IEEE High Performance Computing and Simulation conference 2015, Jun 2015, Amsterdam, Netherlands
面向执行约束的自主AI自动化:一种可复现的AIBOM驱动的CSAF-VEX框架
机构 * University of Oxford(牛津大学) ; Cisco Systems(思科系统) ; The Alan Turing Institute(艾伦·图灵研究所) ; University of Warwick – WMG(沃里克大学 – WMG) ; University of Hull(哈罗德大学)
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.SE
AI总结 提出一种协议驱动框架,通过绑定SBOM和AIBOM工件与确定性环境捕获及结构化运行时遥测,结合静态与运行时证据生成CSAF VEX公告,经密码签名和确定性重放验证,在合成自主AI工作负载上评估。
Journal ref Execution-bound advisory automation for agentic AI: a reproducible AIBOM-driven CSAF-VEX framework. Front Artif Intell 9, (May 2026), 1826384
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.LG;autonomous agent(journal_ref)
Journal ref Adaptive Learning Agents Workshop @ International Conference on Autonomous Agents and Multiagent Systems (AAMAS) 2023, London, UK
SkillJect:有效自动化基于技能的提示注入以针对具备技能的代理
机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) ; Chongqing University, China(重庆大学) ; Northeastern University, China(东北大学) ; Sun Yat-sen University, China(中山大学) ; University of Oxford, UK(牛津大学)
专题命中 工作流自动化 :agent(abstract);tool use(abstract);workflow(abstract);multi-agent(abstract)
AI总结 SkillJect 是首个自动化生成有效中毒技能的框架,通过隐藏恶意负载和重写指令通道,提升攻击效果,揭示可重用技能生态中的持久性攻击向量。
ClawTrace: 面向LLM智能体技能蒸馏的成本感知追踪
机构 * University of California San Diego(加州大学圣地亚哥分校) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI;agentic(comments)
AI总结 针对技能蒸馏管道缺乏每步成本信号的问题,提出ClawTrace记录成本归因轨迹并生成TraceCard,通过CostCraft生成保留、剪枝和修复三类技能补丁,发现剪枝补丁作为质量护栏而保留补丁导致回归,主张按规则类型评估可复用技能。
Comments Accepted at Agent Skills '26 Workshop, ACM Conference on AI and Agentic Systems (CAIS 2026), San José, CA, May 26, 2026
机构 * Zapier
专题命中 工作流自动化 :agent(abstract);AI agent(abstract);workflow(abstract);agentic(abstract)
通过重构理解:为LLM预训练反转软件开发过程
专题命中 工作流自动化 :agent(abstract);planning(abstract);agentic(abstract);multi-agent(abstract)
AI总结 本文提出通过重构软件开发过程来提升LLM性能,通过模拟多智能体轨迹生成更丰富的监督信号,实验显示在多个基准测试中效果显著。
EpidemIQs: 用于流行病建模与分析的提示到论文LLM代理
机构 * Department of Electrical and Computer Engineering, Kansas State University(电气与计算机工程系,堪萨斯州立大学)
专题命中 工作流自动化 :agent(abstract);planning(abstract);workflow(abstract);multi-agent(abstract)
AI总结 EpidemIQs是一种多代理LLM框架,通过五个阶段实现流行病建模与分析的自动化,利用科学家代理和任务专家代理提高效率和准确性。
机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) ; University of Chinese Academy of Sciences(中国科学院大学) ; Hangzhou Institute for Advanced Study, UCAS(杭州先进研究所) ; National Genomics Data Center, China National Center for Bioinformation(国家基因组科学数据中心) ; Beijing Institute of Genomics, Chinese Academy of Sciences(中国科学院北京基因组研究所)
专题命中 工作流自动化 :agent(abstract);planning(abstract);workflow(abstract);multi-agent(abstract)
专题命中 工作流自动化 :agent(abstract);AI agent(abstract);planning(abstract);workflow(abstract)
Comments 58 pages including text, figures, references and appendices
环境、智能体及智能体-环境联合系统的世界模型
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.LG
AI总结 本文基于计算力学,将世界模型按建模信道分为三类,构建规范模型并通过POMDP示例说明耦合与支持限制可简化模型复杂度,为世界模型的本质提供了清晰框架。
面向智能体对话AI的风格可控且事实保留生成的知识图谱门控去事实化方法
机构 * Indian Institute of Technology (IIT) Bhilai(印度比莱印度理工学院)
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.CL
AI总结 针对智能体对话AI的事实保留与风格可控生成需求,提出DSR知识工程框架,结合KG与激活引导,在LLaMA系列模型上验证其可提升实体恢复率并保持风格控制,无需微调。
Graphectory Viewer:面向智能体软件轨迹的以流程为中心分析工具
专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI、cs.SE
AI总结 Graphectory Viewer是一款基于网页的交互式开源工具,可将异构软件智能体原始轨迹转换为阶段感知图,支持多框架轨迹分析,助力研究人员分析智能体执行、行为模式及成功失败案例,为智能体软件轨迹研究提供支撑。
Comments 5 pages, Short Paper; ASE 2026 Tool Track
迈向AI历史学家:从原始资料中进行代理信息提取
机构 * Torr Vision Group, Department of Engineering Science, University of Oxford(牛津大学工程科学系托尔视觉组) ; Oxford Centre for Economic and Social History, University of Oxford(牛津大学牛津经济与社会史中心) ; Faculty of Music, University of Oxford(牛津大学音乐学院) ; Fraunhofer HHI(弗劳恩霍夫海因里希·赫兹研究所)
专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI、cs.CL
AI总结 本文介绍Chronos项目首个模块,通过自然语言交互将历史文献图像转化为数据,允许历史学家自定义流程、评估模型性能并迭代优化。
面向心理学中鲁棒大语言模型研究的有效性导向工作流程
专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.CL
AI总结 本文提出一个六阶段工作流程,通过整合心理测量与因果推断,提升心理学中大语言模型研究的有效性,强调研究目标、计算工具验证、实验设计、透明执行、数据分析和结果报告的全面性。
Journal ref Behavior Research Methods, 58, 216 (2026)
静态分析引导的智能体AI翻译使Rust成为全栈生物信息学语言
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.SE
AI总结 该研究结合智能体AI与静态分析,将生物信息学遗留代码翻译为Rust,在Bascet软件上实现规模、构建时间、性能的显著优化,且支持原生Windows运行,为生物信息学软件大规模重构提供了低成本方案。
ChemWorld:用于可控且可重复智能体实验的可编程化学世界
机构 * Tsinghua University(清华大学)
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.LG
AI总结 本研究提出可编程化学环境ChemWorld,分离公开实验契约与私有化学定律,支持实验轨迹精确重放,通过多组实验验证其可控性与可重放性,为化学智能体实验提供互补于物理实验室的基底。
评估AI代理在神经科学数据到发现流程中的案例研究
机构 * Cornell University(康奈尔大学) ; HHMI Janelia Research Campus(霍华德·休斯医学研究所贾雷尔研究园区)
专题命中 工作流自动化 :AI agent(title);agentic(abstract);分类 cs.AI、cs.LG
AI总结 本研究评估通用编码代理在果蝇光遗传学数据到发现流程中的表现,发现代理能解决单个阶段任务,但端到端流程仍超出其能力,主要挑战包括缺乏预定义迭代标准和科学判断能力。
Comments Peer-reviewed conference paper
Journal ref Third Conference on Language Modeling (COLM 2026)
一种用于知识图谱生成的智能体式混合自顶向下与自底向上方法
机构 * Malt
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.CL
AI总结 针对HR平台的多语言非标准化技能声明问题,提出结合LLM与Wikidata KG的智能体式混合KG生成流水线,可生成可扩展可解释的技能KG。
DoctorAgents:用于针对小型临床时序数据迭代优化自动机器学习流水线的智能体框架
机构 * McGill University(麦吉尔大学) ; Mila – Quebec AI Institute(米拉-魁北克人工智能研究所) ; CIUSSSE-CHUS(谢布鲁克大学医学中心综合大学健康和社会服务中心) ; University of Sherbrooke(谢布鲁克大学)
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG
AI总结 DoctorAgents是一种用于小型临床时序数据的智能体框架,通过LLM智能体以推理驱动方式迭代优化AutoML流水线,在多种临床任务上性能优于现有AutoML基线且可解释性更强。
Comments 34 pages, 5 figures
评估用于企业自动化的大语言模型权衡:来自生产级企业平台中工作流生成的经验教训
专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.SE
AI总结 该研究通过在生产级企业平台评估6种大语言模型的工作流生成能力,发现分段式流水线可提升结构成功率,使小型模型达生产可行性,为云工程提供模型无关的自动化方案。
Comments 10 pages, 3 figures, 5 tables. Accepted at the 14th IEEE International Conference on Cloud Engineering (IC2E 2026), Industry Track
因果锻造:一个用于因果推理自动化研究的形式化基础、自我改进的智能框架
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG
AI总结 提出因果锻造框架用于因果推理自动化研究,结合因果论库与因果史密斯智能管道,通过声明审核增强内核验证,并用自主研究工件评估系统,为因果推理自动化研究提供新途径。
基于强化学习的智能体技能渐进式生成
机构 * The Chinese University of Hong Kong(香港中文大学) ; LIGHTSPEED(光速公司)
专题命中 工作流自动化 :agent(title,abstract);分类 cs.CL、cs.LG
AI总结 该研究针对现有技能生成方法的缺陷,提出基于强化学习的Skill-α方法,将技能生成为序列编辑过程并引入回退奖励,在CL-Bench和tau2-bench上均显著提升了下游任务成功率。
Comments Code is available at https://github.com/ejhshen/skill-alpha
编译AI:基于LLM的工作流自动化确定性代码生成
机构 * XY.AI Labs, Palo Alto, CA(XY.AI实验室,帕洛阿尔托) ; Stanford University School of Medicine, Stanford, CA(斯坦福大学医学院,斯坦福) ; Cornell University, Department of Computer Science, Ithaca, NY(康奈尔大学计算机科学系,伊萨卡) ; Brigham and Women’s Hospital / Harvard Medical School, Boston, MA(布莱根妇女医院/哈佛医学院,波士顿)
专题命中 工作流自动化 :workflow(title);planning(abstract);分类 cs.AI、cs.SE
AI总结 本文研究编译AI,一种大语言模型在编译阶段生成可执行代码,随后工作流确定性执行的范式。重点探讨其在高风险企业工作流中的应用,尤其在医疗领域,强调可靠性与可审计性。
Comments 14 pages, 2 figures, 3 tables
AuditRepairBench:用于评估智能体修复中评估器通道排名不稳定性的配对执行跟踪语料库
机构 * Shanghai Jiao Tong University(上海交通大学) ; Shanghai Maritime University(上海 Maritime University)
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.SE
AI总结 研究智能体修复排行榜因评估器重新配置而重新排序的问题,通过AuditRepairBench语料库及模块化筛选架构实现评估器通道阻塞排名不稳定性评估,经多种验证和实验,证明筛选引导盲补丁能有效减少排名位移。
Comments The authors have identified substantial issues in the experimental design and evaluation that affect the validity of the main conclusions. Therefore, the authors have decided to withdraw this manuscript
执行前澄清:用于解决3D工具编排中意图不对称的自进化智能体
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.CL
AI总结 研究3D资产创建中用户指令模糊与工具要求精确的意图不对称问题,提出自进化智能体CLARE,通过解耦生成管道、模拟多轮交互自我进化澄清策略,在新基准测试中取得领先性能,证明主动澄清对3D执行的关键作用。
Comments Accepted to ACM Multimedia 2026 (ACM MM 2026). 26 pages including appendix, 8 figures. Code: https://github.com/xyzhu1225/CLARE
2026年金融市场评估任务3中的金融分析师:一个结合大型语言模型专家和基于规则信号的实时混合交易代理
机构 * University of North Texas(北德克萨斯大学)
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.CL
AI总结 研究针对金融市场评估任务3,提出结合LLM专家和规则信号的混合交易代理Fin-Analyst,用于特斯拉和比特币交易。通过多源信息聚合及规则投票,在特斯拉交易上取得高回报率,比特币交易表现良好,还分析了排名逆转原因及信号影响等,为后续模型改进提供依据。
Comments 14 pages, 7 tables, 1 figure. CLEF 2026 FinMMEval Task 3 Working Notes
过滤有害行为是不够的:智能体自反决策函数中的幻影转移
专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG
AI总结 研究在含对抗交互的合成智能体轨迹训练的影响,通过微调Llama 3.3 70B Instruct并评估,发现有害行为过滤不足,生成过程引入失调倾向且分散编码,依赖生成模型,安全基准难区分影响,强调动作级过滤无法确保合成智能体训练数据安全。
失败作为一个过程:CLI编码代理轨迹剖析
专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.SE
AI总结 研究CLI编码代理失败轨迹,引入面向过程框架,收集并标注大量执行轨迹,发现失败多由认知错误驱动,起始于最初几步且常隐藏,提出提高编码代理可靠性需早期验证和干预,而非仅靠最终结果评估。
Comments 12 pages, 6 figures