arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10535 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10535 篇

2606.22731 2026-06-23 cs.AI cs.MA 新提交 70%

Closed-loop Auto Research for Molecular Property Prediction: Discovering and Certifying Generalizable Improvements

分子性质预测的闭环自动研究:发现并认证可泛化的改进

Jingjie Ning, Xiaochuan Li, Ji Zeng, Chenyan Xiong, Guolin Ke

机构 * DP Technology

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出闭环自动研究框架,通过语言模型代理编辑表示、模型代码和外部证据,在分子性质预测任务上评估改进的泛化性,发现特征、模型和数据三个轴线的可迁移性因基准而异,并验证了污染过滤对迁移的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20601 2026-06-23 cs.HC cs.AI 新提交 70%

Zhinong AI: A Design-Science Study of an AI-Enabled Agricultural Decision-Support Platform for Smallholder Production

Zhinong AI:面向小农生产的AI赋能农业决策支持平台的设计科学研究

Zhaoyang Li, Jiaqi Liu, Ruijie Zhang

机构 * University of Sanya(三亚大学) Hebei International Studies University(河北国际关系学院)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本文通过设计科学研究,提出了一个集成信息推送、问答、诊断、日历管理等功能的小农决策支持平台,并构建了分层架构、闭环流程、评估指标和治理框架,为AI农业原型转化为可测试、负责任的基础设施提供了结构化研究框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09316 2026-06-23 cs.AI 版本更新 70%

Anything2Skill: Compiling External Knowledge into Reusable Skills for Agents

Anything2Skill: 将外部知识编译为智能体的可复用技能

Qianjun Pan, Yutao Yang, Junsong Li, Jie Zhou, Kai Chen, Xin Li, Qin Chen, Liang He

机构 * East China Normal University(华东师范大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Anything2Skill框架,将异构外部知识编译为可复用、可检索、可执行的技能,结合RAG显著提升智能体任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21522 2026-06-23 cs.AI 版本更新 70%

Pessimistic Verification for Open Ended Math Questions

开放数学问题的悲观验证

Yanxing Huang, Zihan Tang, Zejin Lin, Peng Li, Yang Liu

机构 * Qiuzhen College, Tsinghua University, Beijing, China Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China Dept. of Comp. Sci \& Tech., Institute for AI, Tsinghua University, Beijing, China

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 提出悲观验证范式,通过多个并行验证器拒绝有缺陷的解决方案,并引入渐进式悲观验证以增强精度和效率,在竞赛级数学问题上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01316 2026-06-19 cs.AI 版本更新 70%

Science Earth: Towards A Planet-Scale Operating System for AI-Native Scientific Discovery

Science Earth: 迈向面向AI原生科学发现的行星级操作系统

Zhe Zhao, Haibin Wen, Yingcheng Wu, Jiaming Ma, Yifan Wen, Jinglin Jian, Jiacheng Ge, Xiangru Tang, Bo An, Ming Yin, Sanfeng Wu, Mengdi Wang, Le Cong

机构 * Department of Pathology, Department of Genetics, Stanford University School of Medicine(病理学系、遗传学系,斯坦福大学医学院) Princeton AI Lab, Department of Electrical & Computer Engineering, Princeton University(普林斯顿人工智能实验室、电气与计算机工程系,普林斯顿大学) Scripps Research, La Jolla, CA, USA(斯克里普斯研究机构,洛杉矶,加利福尼亚州,美国) Division of Biostatistics, Department of Population Health, New York University Grossman School of Medicine(生物统计学部、人口健康系,纽约大学格罗斯曼医学院) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Department of Computer Science, Yale University(计算机科学系,耶鲁大学) Department of Physics, Princeton University(物理系,普林斯顿大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Science Earth行星级科学运行时,通过EACN协议实现AI能力动态连接与自组织协作,在跨太平洋Kuramoto同步研究和单细胞分析中验证了分布式自校正科学推理。

Comments Withdrawn by the authors. (1) The author list and authorship roles had not been finalized and agreed upon by all listed authors prior to submission. (2) The specific contribution of the system in the K3 synchronization example (Section on Kuramoto/nonlinear physics) requires further validation before it can be reported. The authors are addressing both points and may resubmit a corrected version.

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16839 2026-06-16 cs.SE 新提交 70%

Towards LLM Accelerated Rapid Reviews for Software Tool Discovery -- Case for Log Anomaly Detection

面向软件工具发现的LLM加速快速综述——以日志异常检测为例

Jesse Nyyssölä, Hamza Bin Mazhar, Alexander Bakhtin, Matteo Esposito, Nana Reinikainen, Yuqing Wang, Ying Song, Davide Taibi, Mika Mäntylä

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.SE

AI总结 提出一种结合LLM筛选和编码代理的流水线,用于快速识别和运行软件工具,在日志异常检测案例中实现高效综述。

Comments 52nd Euromicro Conference on Software Engineering and Advanced Applications (SEAA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12834 2026-06-12 cs.AI 新提交 70%

Fantastic Scientific Agents and How to Build Them: AgentBuild for Rietveld Refinement

神奇的科学智能体及其构建方法:用于Rietveld精修的AgentBuild

Woong Shin, Craig A. Bridges, Marshall T. McDonnell, Rafael Ferreira da Silva

机构 * UT-Battelle, LLC(UT-Battelle有限责任公司) US Department of Energy (DOE)(美国能源部)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出AgentBuild框架,通过科学家编写的合同(包含评分标准、课程和知识库)自动构建科学智能体,用于X射线衍射数据的Rietveld精修,实现可复用的智能体编译而非手动调优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11238 2026-06-12 q-fin.GN cs.AI 新提交 70%

Artificial Intelligence in Ship Finance: Applications, Opportunities, and a Case Study in AI-Augmented Loan Origination

人工智能在船舶金融中的应用:机遇与AI增强贷款发起的案例研究

Lasse Dierich, Orestis Schinas

机构 * ShipFinance.ai HHX.blue GmbH Technical University of Munich(慕尼黑技术大学) University of the Aegean(爱琴海大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文探讨AI在船舶金融中的应用,提出基于大语言模型的模块化架构,用于文档理解、信息提取和工作流自动化,以支持贷款申请流程。

Comments 9 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29151 2026-06-12 math.AG cs.AI cs.NE 版本更新 70%

Real-rootedness of the Poincaré polynomials of $\overline{\mathcal M}_{0,n}$: an AI-assisted proof

Poincaré多项式的实根性:一个AI辅助的证明

Gergely Bérczi, Young-Hoon Kiem

机构 * Department of Mathematics, Aarhus University(阿arhus大学数学系) School of Mathematics, Korea Institute for Advanced Study(韩国高级研究院数学系)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 通过引入双变量变形揭示隐藏的交错结构,证明了稳定有理曲线模空间Poincaré多项式的实根性,并进一步推广到Fulton-MacPherson空间。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10241 2026-06-10 cs.AI 新提交 70%

Regimes: An Auditable, Held-Out-Gated Improvement Loop Demonstrated on LongMemEval with ActiveGraph

Regimes: 一种可审计的、保留验证集的改进循环——在ActiveGraph上的LongMemEval演示

Yohei Nakajima

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Regimes,一种基于事件溯源的可审计自主改进循环,通过ActiveGraph运行时实现故障记录、重放和保留集验证,在LongMemEval-S上提升0.05-0.10的准确率。

Comments 30 pages, 5 figures. Code and committed runs: https://github.com/yoheinakajima/regimes

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09674 2026-06-09 cs.AI cs.LO math.CO 新提交 70%

(Auto)formalization is supposed to be easy: Trellis process semantics for spelling out rigorous proofs

(自动)形式化应该很简单:用于详细阐述严格证明的Trellis过程语义

Wesley Pegden

机构 * Department of Mathematical Sciences, Carnegie Mellon University(卡内基梅隆大学数学科学系)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Trellis系统,通过确定性约束工作流和LLM代理迭代细化自然语言证明,实现Lean自动形式化,强调严格证明的可细化性。

Comments 15 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09084 2026-06-09 cs.CR cs.AI 新提交 70%

Context-Fractured Decomposition Attacks on Tool-Using LLM Agents: Exploiting Artifact Provenance Gaps

上下文碎片化解构攻击:利用工具使用LLM代理的工件来源鸿沟

Xiaofeng Lin, Yukai Yang, Daniel Guo, Sahil Arun Nale, Charles Fleming, Guang Cheng

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 针对工具使用LLM代理,提出上下文碎片化解构(CFD)攻击,利用跨上下文工件来源鸿沟实现多步越狱,成功率提升高达28.3个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08661 2026-06-09 cs.CR cs.AI cs.DB 新提交 70%

Data Agents Under Attack: Vulnerabilities in LLM-Driven Analytical Systems

数据代理遭受攻击:LLM驱动的分析系统中的漏洞

Kuncan Wang, Ziting Wang, Peizhuo Lv, Haoyang Li, Guoliang Li, Gao Cong, Wei Dong

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) The Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究系统分析了LLM驱动的数据代理的安全漏洞,提出了分层漏洞框架和攻击分类法,并在六个系统上评估了攻击效果,揭示了当前系统的重大安全缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11484 2026-06-09 cs.AI 版本更新 70%

Engagement Process: Rethinking the Temporal Interface of Action and Observation

参与过程:重新思考动作与观察的时间接口

Jialian Li, Yuchen Cao, Junhong Liu, Weiran Guo, Xutao Wang, Jiaming Song, Jiahao Zhang, Jie Chen

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 工作流自动化 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出参与过程(EP)模型,通过显式时间接口处理动作与观察的不同时间尺度交互,支持多速率协调和子系统组合,揭示隐藏的时间行为并使策略适应显式时间成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03461 2026-06-03 cs.AI 70%

What Makes Interaction Trajectories Effective for Training Terminal Agents?

什么使得交互轨迹对训练终端代理有效?

Sidi Yang, Chaofan Tao, Jierun Chen, Tiezheng Yu, Ruoyu Wang, Yuxin Jiang, Yiming Du, Wendong Xu, Jing Xiong, Taiqiang Wu, Lifeng Shang, Xiaohui Li, Ngai Wong, Haoli Bai

机构 * The University of Hong Kong(香港大学) Huawei Technologies(华为技术有限公司) Nanyang Technological University(南洋理工大学)

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文通过Terminal-Lego流水线研究交互轨迹的教学效能,发现低分代理(DeepSeek-V3.2)的轨迹比高分代理(Claude Opus 4.6)更能提升学生泛化能力,归因于环境接地监督(EGS),并展示了极佳的数据效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02540 2026-06-02 cs.CL 70%

SkillHarm: Lifecycle-Aware Skill-Based Attacks via Automated Construction

SkillHarm: 通过自动化构建实现生命周期感知的基于技能的攻

Yuting Ning, Zhehao Zhang, Yash Kumar Lal, Boyu Gou, Junyi Li, Weitong Ruan, Chentao Ye, Rahul Gupta, Diyi Yang, Yu Su, Huan Sun

机构 * The Ohio State University(俄亥俄州立大学) Amazon AGI(亚马逊人工智能实验室) Stanford University(斯坦福大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 提出SkillHarm基准,通过固定载荷投毒和自我变异投毒两种攻击场景,系统评估基于技能的攻击在技能使用生命周期中的风险,并构建自动化管道AutoSkillHarm生成大规模攻击样本。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15278 2026-06-02 cs.CV cs.AI 70%

Visual Persuasion: What Influences Decisions of Vision-Language Models?

视觉说服:什么影响了视觉语言模型的决策?

Manuel Cherep, Pranav M R, Pattie Maes, Nikhil Singh

机构 * Massachusetts Institute of Technology(麻省理工学院) MIT Media Lab(MIT媒体实验室)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 提出一个框架,通过控制图像选择任务并系统性地扰动输入,利用视觉提示优化方法推断视觉语言模型的潜在视觉效用,揭示影响模型决策的视觉偏好。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29786 2026-05-29 cs.AI 70%

Croissant Tasks: A Metadata Format for Reproducible Machine Learning Evaluations

Croissant Tasks:一种用于可重复机器学习评估的元数据格式

Omar Benjelloun, Leonardo Martins Bianco, Isabelle Guyon, Thanh Gia Hieu Khuong, Jonathan Lebensold, Sebastian Lobentanzer, Luis Oala, Benedictus Kent Rachmat, Ihsan Ullah, Peyman Vahidi, Joaquin Vanschoren

机构 * Google DeepMind(谷歌DeepMind) ChaLearn Université Paris-Saclay(巴黎-萨克雷大学) Jetty Mila, Quebec AI Institute(魁北克AI研究所) Inst. of Computational Biology, Helmholtz Munich(海德堡慕尼黑计算生物学研究所) German Center for Diabetes Research(德国糖尿病研究中心) School of CIT, TUM(技术大学 CIT 学校) Helmholtz AI(海德堡人工智能研究所) Brickroad Eindhoven Univ. of Technology(埃因霍温技术大学)

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 提出Croissant Tasks元数据格式,通过声明式规范解耦任务问题与解决方案,结合自动化LLM管道实现概念可重复性,使自主代理能从零生成可复现的评估流水线。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20023 2026-05-26 cs.AI cs.MA 70%

When Skills Don't Help: A Negative Result on Procedural Knowledge for Tool-Grounded Agents in Offensive Cybersecurity

当技能无济于事:关于程序性知识在进攻性网络安全中工具型智能体的负面结果

Samuel Jacob Chacko, James Hugglestone, Chashi Mahiul Islam, Xiuwen Liu

机构 * Florida State University(佛罗里达州立大学)

专题命中 工作流自动化 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 本文通过重新分析一项控制实验,发现当环境反馈带宽高时,技能(Skills)对智能体性能的边际效益消失甚至产生负面影响,并提出了可证伪的假设。

Comments Accepted as a poster at ACM CAIS 2026 AgentSkills Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05795 2026-05-26 cs.LG 70%

Reward Shaping and Action Masking for Compositional Tasks using Behavior Trees and LLMs

使用行为树和LLM的组合任务奖励塑造与动作掩码

Nicholas Potteiger, Ankita Samaddar, Taylor T. Johnson, Xenofon Koutsoukos

机构 * Vanderbilt University(范德比大学)

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.LG

AI总结 提出MRBT结构,结合LLM自动生成奖励和动作掩码,通过SMT验证和神经符号RL循环,提升组合任务训练效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17269 2026-05-21 cs.CV cs.AI 70%

FineVision: Open Data Is All You Need

FineVision: 你只需要开放数据

Luis Wiedmann, Orr Zohar, Amir Mahla, Xiaohan Wang, Rui Li, Thibaud Frere, Leandro von Werra, Aritra Roy Gosthipaty, Andrés Marafioti

机构 * Hugging Face Technical University of Munich(慕尼黑技术大学) Stanford University(斯坦福大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出FineVision,一个包含2400万样本的高质量数据集,通过半自动化流程整合了200多个来源,通过严格的数据清洗和人工审核确保数据质量,训练基于该数据集的模型在广泛评估中表现更优,推动数据驱动的视觉语言模型研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16407 2026-05-19 cs.LO cs.CL cs.CR cs.PL 70%

Proof-Carrying Certificates for LLM Pipelines: A Trust-Boundary Architecture

为LLM流水线提供证明携带证书:一种信任边界架构

George Koomullil

机构 * Ascendr, Inc.(Ascendr公司)

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 本文提出一种验证大型语言模型周围确定性结构计算的框架,扩展了Lean 4信任边界架构至现代LLM流水线的通用接口。核心贡献包括三个证书家族和两个操作符,用于高风险部署中的专利检索、金融监管等场景。

Comments 83 pages, 1 figure, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13579 2026-05-14 cs.AI 70%

Position: Assistive Agents Need Accessibility Alignment

位置:辅助代理需要可访问性对齐

Jie Hu, Changyuan Yan, Yu Zheng, Ziqian Wang, Jiaming Zhang

机构 * School of Artificial Intelligence and Robotics(人工智能与机器人学院) Hunan University(湖南大学) Changsha, China(中国长沙)

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文指出辅助代理设计需考虑可访问性对齐,通过分析778个任务实例,揭示现有代理在辅助场景中的失败原因,并提出生命周期导向的设计流程。

Comments 9 pages, 1 figures, Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12755 2026-05-14 cs.AI 70%

State-Centric Decision Process

以状态为中心的决策过程

Sungheon Jeong, Ryozo Masukawa, Sanggeon Yun, Mahdi Imani, Mohsen Imani

机构 * University of California, Irvine(加州大学尔湾分校) Northeastern University(东北大学)

专题命中 工作流自动化 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出SDP框架,通过让智能体逐步构建缺失的状态空间和转换规则,解决语言环境缺乏运行时结构的问题,并在多个基准测试中取得最佳无训练结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09990 2026-05-12 cs.CL 70%

Merlin: Deterministic Byte-Exact Deduplication for Lossless Context Optimization in Large Language Model Inference

Merlin:用于无损上下文优化的大语言模型推理中的确定性字节精确去重

Sietse Schelpe

机构 * Corbenic AI, Inc.(Corbenic AI公司)

专题命中 工作流自动化 :autonomous agent(abstract);workflow(abstract);分类 cs.CL

AI总结 Merlin通过高效去重和上下文优化提升大语言模型推理效率,减少冗余文本处理瓶颈,实验显示在高冗余数据中减少71%输入,保持数据完整性。

Comments Preprint. Implementation and open-source community version available at: https://github.com/corbenicai/merlin-community - https://doi.org/10.5281/zenodo.20090991

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06524 2026-05-12 cs.AI 70%

Process Matters more than Output for Distinguishing Humans from Machines

过程比输出更能区分人类与机器

Milena Rmus, Mathew D. Hardy, Thomas L. Griffiths, Mayank Agrawal

机构 * Roundtable Technologies Inc.(Roundtable技术公司) Princeton University(普林斯顿大学)

专题命中 工作流自动化 :autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出CogCAPTCHA30测试人类与机器的行为过程差异,发现过程特征比性能指标更有效区分两者,但任务特定过程监督在跨任务迁移时效果下降,凸显过程定义的瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05682 2026-05-12 cs.HC cs.AI cs.CY 70%

PersonaTeaming: Supporting Persona-Driven Red-Teaming for Generative AI

PersonaTeaming: 支持基于人设的生成AI红队测试

Wesley Hanwen Deng, Mingxi Yan, Sunnie S. Y. Kim, Akshita Jha, Lauren Wilcox, Kenneth Holstein, Motahhare Eslami, Leon A. Gatys

机构 * Carnegie Mellon University(卡内基梅隆大学) Apple(苹果公司)

专题命中 工作流自动化 :workflow(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出PersonaTeaming方法,通过整合人设提升红队测试的自动化与人机协作能力,实验显示其在攻击成功率和提示多样性方面优于现有方法,并通过用户界面促进人机协同创新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08139 2026-05-12 cs.DC cs.AI 70%

Intelligent Autonomous Orchestration for Distributed Cloud Resources using Complex-Stability Analysis

基于复杂稳定性分析的分布式云资源智能自主编排

Gopal Krishna Shyam, Priyanka Bharti

机构 * Department of Computer Science \& Engineering Presidency University, Bengaluru, India Email Department of Computer Science \& Engineering REVA University, Bengaluru, India Email

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出C-SAS框架,利用复分析方法实现系统均衡,通过实时计算稳定性指数抑制振荡,实验显示其在VM波动和资源效率方面优于传统PID和ML方法。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06976 2026-05-11 stat.ML cs.LG stat.CO 70%

A Differentiable Bayesian Relaxation for Latent Partial-Order Inference

一种可微的贝叶斯松弛用于潜在偏序推断

Dongqing Li, Geoff K. Nicholls, Shiyi Sun, You Luo

机构 * University of Oxford(牛津大学) University College London(伦敦大学学院)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.LG

AI总结 本文提出一种可微贝叶斯松弛方法,用于从具有偏序结构的数据中推断潜在偏序,通过平滑替代硬约束模型,实现连续后验并支持梯度基MCMC和变分推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05921 2026-05-08 cs.AI cs.HC 70%

Intentmaking and Sensemaking: Human Interaction with AI-Guided Mathematical Discovery

意图生成与意义构建:人类与AI引导的数学发现的交互

Alex Bäuerle, Adam Connors, Alexander Novikov, Adam Zsolt Wagner, Ngân Vũ, Fernanda Viegas, Martin Wattenberg, Lucas Dixon

机构 * Google DeepMind(谷歌DeepMind)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文探讨了专家数学家使用AlphaEvolve进行高级问题研究的流程,提出意图生成与意义构建的协作框架,强调AI工具应作为协作而非黑箱助手。

详情

展开后加载摘要…

URL PDF HTML 收藏