arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 93944 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35728 篇

2604.18463 2026-04-21 cs.AI cs.LG cs.RO 81%

Using large language models for embodied planning introduces systematic safety risks

使用大型语言模型进行具身规划引入了系统性的安全风险

Tao Zhang, Kaixian Qu, Zhibin Li, Jiajun Wu, Marco Hutter, Manling Li, Fan Shi

机构 * ETH Zurich(苏黎世联邦理工学院) University College London(伦敦大学学院) Stanford University(斯坦福大学) Northwestern University(西北大学) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究评估了大型语言模型在机器人规划中的安全性,发现即使规划能力高,安全风险仍显著存在,揭示了规划能力与安全意识之间的乘法关系。

Comments Project page: https://despite-safety.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11407 2026-04-21 cs.CL cs.AI 81%

Retrieval as Generation: A Unified Framework with Self-Triggered Information Planning

检索即生成:一个统一框架与自触发信息规划

Bo Li, Mingda Wang, Gexiang Fang, Shikun Zhang, Wei Ye

机构 * National Engineering Research Center for Software Engineering, Peking University(软件工程国家工程研究中心,北京大学) School of Computer Science, Peking University(北京大学计算机学院) School of Health Sciences and Biomedical Engineering, Hebei University of Technology(河北工业大学健康科学与生物医学工程学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 GRIP框架通过生成引导检索与信息规划,实现检索与推理的紧密耦合,支持动态多步推理,实验表明其在问答基准上优于RAG基线并接近GPT-4o。

Comments Github: https://github.com/WisdomShell/GRIP HuggingFace:https://huggingface.co/collections/WisdomShell/grip

Journal ref ACL2026, Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16585 2026-04-21 cs.LG cs.AI 81%

The Global Neural World Model: Spatially Grounded Discrete Topologies for Action-Conditioned Planning

全局神经世界模型:用于动作条件规划的空间接地离散拓扑

Noureddine Kermiche

机构 * Western Digital Corporation(西部数据公司)

专题命中 规划决策 :planning(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出全局神经世界模型,通过平衡的连续熵约束实现拓扑量化,采用连续动作条件联合嵌入预测架构,将环境映射到离散2D网格,防止流形漂移,通过最大熵探索学习通用过渡动态。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13541 2026-04-20 cs.NE cs.AI cs.LG cs.RO 81%

Scalable Multi-Task Learning through Spiking Neural Networks with Adaptive Task-Switching Policy for Intelligent Autonomous Agents

通过具有自适应任务切换策略的脉冲神经网络实现可扩展的多任务学习用于智能自主代理

Rachmad Vidya Wicaksana Putra, Avaneesh Devkota, Muhammad Shafique

机构 * eBRAIN Lab, New York University (NYU) Abu Dhabi(eBRAIN实验室,纽约大学(NYU)阿布扎比分校)

专题命中 规划决策 :autonomous agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出SwitchMT方法,通过自适应任务切换策略和深度脉冲Q网络实现高效的多任务学习,提升自主代理在多个Atari游戏中表现。

Comments Accepted at the 63rd ACM/IEEE Design Automation Conference (DAC), July 26-29, 2026 in Long Beach, CA, USA. [Codes: https://github.com/rachmadvwp/SwitchMT]

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17091 2026-04-17 cs.LG cs.AI cs.RO 81%

Learning to Plan, Planning to Learn: Adaptive Hierarchical RL-MPC for Sample-Efficient Decision Making

学习与规划:自适应分层RL-MPC用于样本高效决策

Toshiaki Hori, Jonathan DeCastro, Deepak Gopinath, Avinash Balachandran, Guy Rosman

机构 * Toyota Research Institute(丰田研究院) Learning to Plan, Planning to Learn: Adaptive Hierarchical RL-MPC for Sample-Efficient Decision Making(学习规划,规划学习:自适应分层RL-MPC用于样本高效决策)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种融合强化学习和MPC规划的分层方法,通过自适应聚合MPPI样本提升策略鲁棒性,实现在复杂规划问题中提高样本效率和任务成功率。

Comments 27 pages, 10 figures, 8th Annual Learning for Dynamics & Control Conference (L4DC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13609 2026-04-16 cs.LG cs.AI 81%

Golden Handcuffs make safer AI agents

黄金手铐使AI代理更安全

Aram Ebtekar, Michael K. Cohen

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了一种贝叶斯缓解方法,通过扩展代理的主观奖励范围以包含大负值,从而在一般环境中提高安全性。设计了一种简单的覆盖机制,当预测值低于固定阈值时,将控制权交给安全导师。证明了该代理在能力与安全方面的双重属性。

Comments 26 pages, preliminary version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12493 2026-04-15 cs.CL cs.AI 81%

Latent Planning Emerges with Scale

在规模下显现的潜在规划

Michael Hanna, Emmanuel Ameisen

机构 * ILLC, University of Amsterdam(伊拉斯姆斯自由大学,阿姆斯特丹大学) Anthropic

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文研究了LLM在简单规划任务中潜在规划能力随规模增加而增强的现象,发现模型能通过内部表示生成未来词并影响上下文,但复杂任务如押韵对句中规划能力有限。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09580 2026-04-14 cs.AI cs.LG 81%

OOWM: Structuring Embodied Reasoning and Planning via Object-Oriented Programmatic World Modeling

OOWM: 通过面向对象的程序化世界建模结构化具身推理与规划

Hongyu Chen, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Big Data Analysis and Processing(广东省大数据分析与处理重点实验室) X-Era AI Lab(X-Era AI实验室)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 OOWM通过软件工程形式化方法构建具身推理框架,利用UML类图和活动图实现环境状态与控制策略的显式建模,结合监督微调与分组相对策略优化提升规划效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13126 2026-04-10 cs.AI cs.CL 81%

Iterative Formalization and Planning in Partially Observable Environments

迭代形式化与在部分可观测环境中的规划

Liancheng Gong, Wang Zhu, Jesse Thomason, Li Zhang

机构 * Drexel University(德雷塞尔大学) University of Southern California(南加州大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出PDDLego框架,通过将环境和目标分解为完全可观测的片段,实现迭代形式化、规划、扩展和优化,提升在部分可观测环境中的规划成功率和鲁棒性。

Comments In Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26433 2026-04-07 cs.LG cs.AI 81%

ACT: Agentic Classification Tree

ACT:代理分类树

Vincent Grari, Tim Arni, Thibault Laugel, Sylvain Lamprier, James Zou, Marcin Detyniecki

机构 * AXA AI Research(AXA人工智能研究) Stanford University(斯坦福大学) EPFL, Lausanne, Switzerland(瑞士洛桑联邦理工学院) Polish Academy of Sciences, IBS PAN, Warsaw, Poland(波兰科学院计算机科学研究所)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 ACT通过将决策树扩展到非结构化输入,利用自然语言问题和LLM反馈提升透明度和可解释性,实验证明其在文本基准上优于基于提示的方法。

Comments 25 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02910 2026-04-06 cs.AI cs.CL 81%

Analysis of Optimality of Large Language Models on Planning Problems

大型语言模型在规划问题中的最优性分析

Bernd Bohnet, Michael C. Mozer, Kevin Swersky, Wil Cunningham, Aaron Parisi, Kathleen Kenealy, Noah Fiedel

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文研究了大型语言模型在规划问题中的最优性,通过Blocksworld领域和Path-Star图任务,发现增强推理的LLM在复杂多目标配置中显著优于传统规划器,且能精确跟踪理论最优限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02617 2026-04-06 cs.AI cs.CR cs.IR cs.LG cs.SI 81%

AutoVerifier: An Agentic Automated Verification Framework Using Large Language Models

AutoVerifier:基于大语言模型的代理自动化验证框架

Yuntao Du, Minh Dinh, Kaiyuan Zhang, Ninghui Li

机构 * Purdue University(普渡大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出AutoVerifier框架,利用大语言模型自动化验证技术性声明,通过构建知识图谱实现六层递进验证,展示其在量子计算领域的应用效果。

Comments Winner of 2025-2026 Radiance Technologies Innovation Bowl

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02350 2026-04-06 cs.LG cs.AI 81%

Differentiable Symbolic Planning: A Neural Architecture for Constraint Reasoning with Learned Feasibility

可微符号规划:一种用于具有学习可行性的约束推理的神经架构

Venkatakrishna Reddy Oruganti

机构 * Sithara Inc.(Sithara公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出可微符号规划(DSP),通过神经架构实现离散符号推理并保持全可微性,结合通用认知内核(UCK)在约束推理基准中取得高准确率。

Comments 12 pages, 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00795 2026-04-02 cs.AI cs.LG 81%

Preference Guided Iterated Pareto Referent Optimisation for Accessible Route Planning

基于偏好迭代帕累托参考优化的无障碍路线规划

Paolo Speziali, Arno De Greef, Mehrdad Asadi, Willem Röpke, Ann Nowé, Diederik M. Roijers

机构 * Gemeente Amsterdam(阿姆斯特丹市政府)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出PG-IPRO算法,通过用户反馈优化路线规划,提高交互直观性并提升计算效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26685 2026-03-31 cs.RO cs.AI cs.CV cs.LG 81%

Contextual Graph Representations for Task-Driven 3D Perception and Planning

基于任务驱动的3D感知与规划的上下文图表示

Christopher Agia

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文研究了现有具身AI环境在机器人任务规划与3D场景图交集中的适用性,构建了评估现有经典规划器的基准,并探索图神经网络在规划领域关系结构不变性中的应用。

Comments University of Toronto Undergraduate Thesis, 2021. 85 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25981 2026-03-30 cs.RO cs.AI cs.CL 81%

Policy-Guided World Model Planning for Language-Conditioned Visual Navigation

基于策略引导的世界模型规划用于语言条件的视觉导航

Amirhosein Chahe, Lifeng Zhou

机构 * Drexel University(德雷塞尔大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出PiJEPA框架,结合学习导航策略与潜在世界模型规划,通过微调Octo策略和冻结预训练视觉编码器,提升语言指导下的视觉导航准确性与指令遵循性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25334 2026-03-27 cs.AI cs.LG 81%

Agentic Trust Coordination for Federated Learning through Adaptive Thresholding and Autonomous Decision Making in Sustainable and Resilient Industrial Networks

面向可持续和抗灾工业网络的联邦学习代理信任协调

Paul Shepherd, Tasos Dagiuklas, Bugra Alkan, Jonathan Rodriguez

机构 * London South Bank University(伦敦南岸大学) Instituto de Telecomunicações(电信研究所)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种轻量级代理信任协调方法,通过自适应阈值和自主决策提升联邦学习在可持续和抗灾工业网络中的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23245 2026-03-25 cs.LG cs.AI 81%

Neural ODE and SDE Models for Adaptation and Planning in Model-Based Reinforcement Learning

神经ODE和SDE模型用于基于模型的强化学习中的适应与规划

Chao Han, Stefanos Ioannou, Luca Manneschi, T. J. Hayward, Michael Mangan, Aditya Gilra, Eleni Vasilaki

机构 * School of Computer Science, The University of Sheffield, UK(谢菲尔德大学计算机科学学院,英国) Cancer Research UK National Biomarker Centre, The University of Manchester, UK(英国曼彻斯特大学癌症研究UK国家生物标志物中心) School of Chemical, Materials and Biological Engineering, The University of Sheffield, UK(谢菲尔德大学化学、材料和生物工程学院,英国) Machine Learning group, Centrum Wiskunde & Informatica, Amsterdam, Netherlands(荷兰阿姆斯特丹Centrum Wiskunde & Informatica机器学习组) Institute for Ecological Economics, Vienna University of Economics and Business, Austria(奥地利维也纳经济与商业大学生态经济研究所)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文利用神经ODE和SDE建模随机动力学,通过实验展示SDE在复杂场景中提升策略样本效率的效果,并引入隐式SDE模型应对部分可观测性问题。

Journal ref Transactions on Machine Learning Research (10/2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21065 2026-03-24 cs.AI cs.CL 81%

LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning

LongCat-Flash-Prover:通过集成工具的强化学习推进原生形式推理

Jianing Wang, Jianfei Zhang, Qi Guo, Linsen Guo, Rumei Li, Chao Zhang, Chong Peng, Cunguang Wang, Dengchang Zhao, Jiarong Shi, Jingang Wang, Liulin Feng, Mengxia Shen, Qi Li, Shengnan An, Shun Wang, Wei Shi, Xiangyu Xi, Xiaoyu Li, Xuezhi Cao, Yi Lu, Yunke Zhao, Zhengyu Chen, Zhimin Lin, Wei Wang, Peng Pei, Xunliang Cai

机构 * Meituan(美团)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出LongCat-Flash-Prover,一个5600亿参数的混合专家模型,通过集成工具的强化学习提升Lean4中的原生形式推理能力,实现了自动形式化、草图生成和证明三大能力,并通过混合专家迭代框架和分层重要性采样策略提升训练效率。

Comments 43 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13876 2026-03-23 cs.AI cs.CL 81%

Improved Generalized Planning with LLMs through Strategy Refinement and Reflection

通过策略细化与反思改进基于LLM的通用规划

Katharina Stein, Nils Hodel, Daniel Fišer, Jörg Hoffmann, Michael Katz, Alexander Koller

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出通过生成伪代码并自动调试,结合反思步骤提升LLM生成的通用规划质量,实验显示改进后配置在17个基准领域达到82%的平均覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18074 2026-03-20 cs.LG cs.AI cs.IR stat.AP 81%

Lightweight Adaptation for LLM-based Technical Service Agent: Latent Logic Augmentation and Robust Noise Reduction

轻量级适应用于基于LLM的技术服务代理:潜在逻辑增强与鲁棒噪声消除

Yi Yu, Junzhuo Ma, Chenghuang Shen, Xingyan Liu, Jing Gu, Hangyi Sun, Guangquan Hu, Jianfeng Liu, Weiting Liu, Mingyue Pu, Yu Wang, Zhengdong Xiao, Rui Xie, Longjiu Luo, Qianrong Wang, Gurong Cui, Honglin Qiao, Wenlian Lu

机构 * School of Mathematics and Sciences, Fudan University, Shanghai, China(复旦大学数学科学学院,上海,中国) Shanghai Center for Mathematical Sciences, Fudan University, Shanghai, China(复旦大学上海数学中心,上海,中国) Alibaba Group, Hangzhou, China(阿里巴巴集团,杭州,中国) Institute of Science and Technology for Brain-Inspired Intelligence, Fudan University, Shanghai, China(脑启发式智能科学技术研究院,复旦大学,上海,中国) Center for Applied Mathematics & Shanghai Key Laboratory of Contemporary Applied Mathematics, Fudan University, Shanghai, China(应用数学中心及上海当代应用数学重点实验室,复旦大学,上海,中国)

专题命中 规划决策 :agent(title);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出轻量级适应框架,通过潜在逻辑增强和鲁棒噪声消除提升技术服务代理的稳定性和性能,同时采用混合奖励机制降低训练成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03182 2026-03-20 cs.RO cs.AI cs.CL cs.SC 81%

Simulation to Rules: A Dual-VLM Framework for Formal Visual Planning

模拟到规则:一个双VLM框架用于正式视觉规划

Yilun Hao, Yongchao Chen, Chuchu Fan, Yang Zhang

机构 * MIT(麻省理工学院) Harvard University(哈佛大学) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出VLMFP框架,结合SimVLM和GenVLM实现自动生成PDDL问题和领域文件,提升视觉规划的精确性和泛化能力。

Comments 40 pages, 6 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14225 2026-03-19 cs.HC cs.AI cs.SE 81%

"I'm Not Reading All of That": Understanding Software Engineers' Level of Cognitive Engagement with Agentic Coding Assistants

我并非在读取所有内容:理解软件工程师对代理编码助手的认知参与度

Carlos Rafael Catalan, Lheane Marie Dizon, Patricia Nicole Monderin, Emily Kuang

机构 * York University(约克大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 研究探讨软件工程师在使用代理编码助手时的认知参与度变化,指出当前设计缺乏反思和验证机制,提出通过更丰富的交互方式和认知强制机制来提升深度思考。

Comments 7 pages, 5 figures, 2 tables, published and presented in CHI 2026 Workshop on Tools for Thought

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15797 2026-03-19 cs.LG cs.AI 81%

OMNIFLOW: A Physics-Grounded Multimodal Agent for Generalized Scientific Reasoning

OMNIFLOW:一种基于物理的多模态代理用于通用科学推理

Hao Wu, Yongheng Zhang, Yuan Gao, Fan Xu, Fan Zhang, Ruobing Xie, Ruijian Gou, Yuxuan Liang, Xiaomeng Huang, Xian Wu

机构 * Tsinghua University(清华大学) Tencent(腾讯) Shenzhen Loop Area Institute(深圳河套学院) Ocean University of China(海洋大学) HKUST (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :agent(title);workflow(abstract);分类 cs.AI、cs.LG

AI总结 OMNIFLOW通过引入语义-符号对齐机制和物理引导的推理流程,实现了多模态模型在物理定律下的科学推理,显著提升了零样本泛化和少样本适应能力,提供透明且物理一致的推理报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23592 2026-03-18 cs.RO cs.AI cs.SE 81%

KEEP: A KV-Cache-Centric Memory Management System for Efficient Embodied Planning

KEEP: 一种面向高效具身规划的KV缓存中心化内存管理系统

Zebin Yang, Tong Xie, Baotong Lu, Shaoshan Liu, Bo Yu, Meng Li

机构 * Institute for Artificial Intelligence(人工智能研究院) School of Integrated Circuits, Peking University(集成电路学院,北京大学) Shenzhen Institute of Artificial Intelligence(深圳人工智能研究院) Microsoft Research(微软研究院) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进创新中心)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出KEEP系统,通过静态动态内存构建算法、多跳内存重计算算法和层平衡内存加载,提升具身规划效率,实验表明在ALFRED数据集上速度提升2.68倍,优于CacheBlend方法。

Comments DAC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25140 2026-03-18 cs.AI cs.CL 81%

ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory

ReasoningBank: 通过推理记忆扩展智能体自我进化

Siru Ouyang, Jun Yan, I-Hung Hsu, Yanfei Chen, Ke Jiang, Zifeng Wang, Rujun Han, Long T. Le, Samira Daruki, Xiangru Tang, Vishy Tirumalashetty, George Lee, Mahsan Rofouei, Hangfei Lin, Jiawei Han, Chen-Yu Lee, Tomas Pfister

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Google Cloud AI Research(谷歌云人工智能研究) Yale University(耶鲁大学) Google Cloud AI(谷歌云人工智能)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出ReasoningBank,通过整合智能体自我评估的成功与失败经验,提升其持续学习能力,并引入MaTTS加速学习过程,提升任务表现与效率。

Comments Accepted to ICLR 2026; Code: https://github.com/google-research/reasoning-bank

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14486 2026-03-17 cs.CL cs.AI 81%

Infinite Problem Generator: Verifiably Scaling Physics Reasoning Data with Agentic Workflows

无限问题生成器:通过代理工作流可验证地扩展物理推理数据

Aditya Sharan, Sriram Hebbale, Dhruv Kumar

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出IPG框架,通过公式-as-代码方法生成可解物理问题,解决大语言模型训练中高质量数据稀缺的问题,发布包含1335个经典力学问题的ClassicalMechanicsV1数据集,展示高结构多样性及复杂度与代码长度的强相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14312 2026-03-17 cs.AI cond-mat.dis-nn cs.LG cs.MA q-bio.BM 81%

Autonomous Agents Coordinating Distributed Discovery Through Emergent Artifact Exchange

自主代理通过涌现式物品交换协调分布式发现

Fiona Y. Wang, Lee Marom, Subhadeep Pal, Rachel K. Luu, Wei Lu, Jaime A. Berkovich, Markus J. Buehler

专题命中 规划决策 :autonomous agent(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出ScienceClaw + Infinite框架,通过自主代理在无中央协调下进行科学探究,展示异构工具链、代理间涌现式收敛及可追溯推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14229 2026-03-17 cs.AI cs.SE 81%

Agentic DAG-Orchestrated Planner Framework for Multi-Modal, Multi-Hop Question Answering in Hybrid Data Lakes

基于代理的DAG编排规划框架:用于混合数据湖中多模态、多跳问答系统

Kirushikesh D B, Manish Kesarwani, Nishtha Madaan, Sameep Mehta, Aldrin Dennis, Siddarth Ajay, Rakesh B R, Renu Rajagopal, Sudheesh Kairali

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出A.DOT规划框架,通过编译自然语言查询为DAG执行计划,实现多模态多跳问答,提升准确性和效率,并生成可追溯的证据链。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13443 2026-03-17 cs.SE cs.AI cs.PL 81%

NormCode Canvas: Making LLM Agentic Workflows Development Sustainable via Case-Based Reasoning

NormCode Canvas:通过基于案例的推理使LLM代理工作流开发可持续

Xin Guan, Yunshan Li, Ze Wang

机构 * Psylens AI, China(Psylens AI,中国) Shenzhen University, China(深圳大学,中国) University College London, United Kingdom(伦敦大学学院,英国)

专题命中 规划决策 :agentic(title);planning(abstract);分类 cs.AI、cs.SE

AI总结 NormCode Canvas通过基于案例的推理实现多步骤LLM工作流的可持续开发,其核心是NormCode语言,确保每个执行检查点都是自包含的案例,从而消除隐含共享状态带来的问题。

Comments 16 pages, 5 figures. Submitted to ICCBR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏