arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-11 至 2026-02-11 共收录 115 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 10 篇

2602.09132 2026-02-11 cs.DB cs.ET cs.MA 85%

SciDataCopilot: An Agentic Data Preparation Framework for AGI-driven Scientific Discovery

SciDataCopilot: 一种面向AGI驱动科学发现的代理数据准备框架

Jiyong Rao, Yicheng Qiu, Jiahui Zhang, Juntao Deng, Shangquan Sun, Fenghua Ling, Hao Chen, Nanqing Dong, Zhangyang Gao, Siqi Sun, Yuqiang Li, Dongzhan Zhou, Guangyu Wang, Lijun Wu, Conghui He, Xuhong Wang, Jing Shao, Xiang Liu, Yu Zhu, Mianxin Liu, Qihao Zheng, Yinghui Zhang, Jiamin Wu, Xiaosong Wang, Shixiang Tang, Wenlong Zhang, Bo Zhang, Wanli Ouyang, Runkai Zhao, Chunfeng Song, Lei Bai, Chi Zhang

专题命中 工具调用 :agentic(title,abstract);autonomous agent(abstract);workflow(abstract)

AI总结 SciDataCopilot通过自主代理框架实现端到端的数据准备,提升科学发现效率与一致性,推动实验驱动的科学通用智能发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08268 2026-02-11 cs.AI 83%

Puda: Private User Dataset Agent for User-Sovereign and Privacy-Preserving Personalized AI

Puda:用户主权与隐私保护的个性化AI用户数据代理

Akinori Maeda, Yuto Sekiya, Sota Sugimura, Tomoya Asai, Yu Tsuda, Kohei Ikeda, Hiroshi Fujii, Kohei Watanabe

机构 * Research Institute of Advanced Technology, SoftBank Corp.(软银公司先进科技研究所) Turnt Up Technologies, Inc.(Turnt Up技术公司) TechArts Co., Ltd.(TechArts公司) Acutus Software, Inc.(Acutus软件公司)

专题命中 工具调用 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 Puda通过用户主权架构实现多粒度数据管理,平衡隐私保护与个性化AI的使用需求。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15214 2026-02-11 cs.CL 83%

Self-Guided Function Calling in Large Language Models via Stepwise Experience Recall

通过逐步经验回忆实现大语言模型的自引导函数调用

Sijia Cui, Aiyao He, Shuai Xu, Hongming Zhang, Yanna Wang, Qingyang Zhang, Yajing Wang, Bo Xu

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Nanjing University of Information Science & Technology(南京信息工程大学) Institute of Computing Technology, Chinese Academy of Sciences(计算技术研究所,中国科学院)

专题命中 工具调用 :function calling(title,abstract);planning(abstract);分类 cs.CL

AI总结 SEER通过逐步经验回忆方法,提升大语言模型在多步骤工具使用中的准确性和效率。

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09372 2026-02-11 cs.CL 79%

AgentSkiller: Scaling Generalist Agent Intelligence through Semantically Integrated Cross-Domain Data Synthesis

AgentSkiller: 通过语义整合的跨领域数据合成提升通用智能代理能力

Zexu Sun, Bokai Ji, Hengyi Cai, Shuaiqiang Wang, Lei Wang, Guangxia Li, Xu Chen

机构 * AMU, Baidu Inc.(百度公司) School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) Singapore Management University(新加坡管理学院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)

专题命中 工具调用 :agent(title);function calling(abstract);分类 cs.CL

AI总结 AgentSkiller通过语义整合的跨领域数据合成提升通用智能代理能力,生成高质量交互数据以增强模型功能调用性能。

Comments 33 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09496 2026-02-11 cs.HC 67%

Jokeasy: Exploring Human-AI Collaboration in Thematic Joke Generation

Jokeasy:探索主题笑话生成中的人机协作

Yate Ge, Lin Tian, Chiqian Xu, Luyao Xu, Meiying Li, Yuanda Hu, Weiwei Guo

专题命中 工具调用 :agent(abstract);workflow(abstract)

AI总结 Jokeasy通过人机协作提升主题笑话生成,结合搜索功能与双角色LLM代理,优化创意流程与素材整合。

Comments Accepted at IASDR 2025. This is the author-accepted version. Correspondence to first author: geyate@gmail.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09517 2026-02-11 cs.CL 57%

Knowledge Integration Decay in Search-Augmented Reasoning of Large Language Models

在大语言模型的搜索增强推理中知识整合衰减

Sangwon Yu, Ik-hwan Kim, Donghun Kang, Bongkyu Hwang, Junhwa Choi, Suk-hoon Jung, Seungki Hong, Taehee Lee, Sungroh Yoon

机构 * Department of Electrical and Computer Engineering, Seoul National University, Seoul, Korea(电气与计算机工程系,首尔国立大学,韩国首尔) Interdisciplinary Program in Artificial Intelligence, Seoul National University, Seoul, Korea(人工智能交叉学科项目,首尔国立大学,韩国首尔)

专题命中 工具调用 :agentic(abstract);分类 cs.CL

AI总结 本研究提出SAKE方法,通过在推理过程前后锚定检索知识,缓解大语言模型在搜索增强推理中的知识整合衰减问题,提升多跳问答和复杂推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.03449 2026-02-11 cs.SE 57%

GHTraffic: A Dataset for Reproducible Research in Service-Oriented Computing

GHTraffic:面向服务计算的可重复研究数据集

Thilini Bhagya, Jens Dietrich, Hans Guesgen, Steve Versteeg

专题命中 工具调用 :tool use(abstract);分类 cs.SE

AI总结 GHTraffic是一个包含大量HTTP事务的数据集,用于支持服务计算领域的可重复研究,通过提取GitHub数据和合成数据构建,提供了一种新的研究工具和评估标准。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10105 2026-02-11 cs.RO 50%

DexImit: Learning Bimanual Dexterous Manipulation from Monocular Human Videos

DexImit:从单目人类视频中学习双臂灵巧操作

Juncheng Mu, Sizhe Yang, Yiming Bao, Hojin Bae, Tianming Wei, Linning Xu, Boyi Li, Huazhe Xu, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) NVIDIA(英伟达)

专题命中 工具调用 :tool use(abstract)

AI总结 DexImit通过四阶段生成流程,将单目人类视频转化为物理合理的机器人数据,以解决双臂灵巧操作的泛化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08200 2026-02-11 quant-ph q-bio.QM 50%

Pangenome-guided sequence assembly via binary optimisation

通过二进制优化进行全基因组引导的序列组装

Josh Cudby, James Bonfield, Chenxi Zhou, Richard Durbin, Sergii Strelchuk

专题命中 工具调用 :workflow(abstract)

AI总结 本文提出了一种基于二进制优化的全基因组引导序列组装框架,通过图遍历优化问题解决复杂区域的短读数据组装问题,提高了组装效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00076 2026-02-11 cond-mat.mtrl-sci 50%

Materials discovery acceleration by using condition generative methodology

通过条件生成方法加速材料发现

Caiyuan Ye, Yuzhi Wang, Xintian Xie, Tiannian Zhu, Jiaxuan Liu, Yuqing He, Lili Zhang, Junwei Zhang, Zhong Fang, Lei Wang, Zhipan Liu, Hongming Weng, Quansheng Wu

专题命中 工具调用 :workflow(abstract)

AI总结 本研究提出PODGen框架,通过条件生成方法显著提升拓扑绝缘体的发现效率,生成成功率提高5.3倍,识别出多种可合成的拓扑绝缘体。

Journal ref Nat. Commun. 2025, 16, 1930

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 45 篇

2510.14406 2026-02-11 cs.AI cs.CL 92%

IMAGINE: Integrating Multi-Agent System into One Model for Complex Reasoning and Planning

IMAGINE:将多智能体系统整合到一个模型中以实现复杂推理和规划

Xikai Zhang, Bo Wang, Likang Xiao, Yongzhi Li, Quan Chen, Wenjun Wu, Liu Liu

机构 * Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Kuaishou Technology(快手科技)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 IMAGINE通过整合多智能体系统的推理与规划能力,实现高效复杂推理和规划,实验显示其在TravelPlanner任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02424 2026-02-11 cs.AI 89%

ReAcTree: Hierarchical LLM Agent Trees with Control Flow for Long-Horizon Task Planning

ReAcTree:具有控制流的分层LLM代理树用于长时间任务规划

Jae-Woo Choi, Hyungmin Kim, Hyobin Ong, Youngwoo Yoon, Minsu Jang, Dohyung Kim, Jaehong Kim

机构 * ETRI & UST(ETRI与UST) UST

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 ReAcTree通过分层代理树和控制流实现复杂任务规划,显著提升长周期任务的完成效率和成功率。

Comments Accepted as a Full Paper at AAMAS 2026. This is the extended version including full appendices. Code is available at https://github.com/Choi-JaeWoo/ReAcTree.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09341 2026-02-11 cs.AI 88%

Auditing Multi-Agent LLM Reasoning Trees Outperforms Majority Vote and LLM-as-Judge

对多智能体大语言模型推理树进行审计优于多数投票和LLM作为裁判

Wei Yang, Shixuan Li, Heng Ping, Peiyu Zhang, Paul Bogdan, Jesse Thomason

机构 * University of Southern California, Los Angeles, CA, USA(美国南加州大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 通过构建推理树路径搜索机制,AgentAuditor在多智能体系统中实现了优于多数投票和LLM作为裁判的推理准确性提升

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11276 2026-02-11 cs.HC cs.AI 88%

Words to Describe What I'm Feeling: Exploring the Potential of AI Agents for High Subjectivity Decisions in Advance Care Planning

描述我感受的词语:探索AI代理在前瞻性医疗计划中的潜在作用

Kellie Yu Hui Sim, Pin Sym Foong, Chenyu Zhao, Melanie Yi Ning Quek, Swarangi Subodh Mehta, Kenny Tsu Wei Choo

机构 * Singapore University of Technology and Design(新加坡科技设计大学) National University of Singapore(国立新加坡大学)

专题命中 规划决策 :planning(title,abstract);AI agent(title);agent(abstract);分类 cs.AI

AI总结 本文探讨了AI代理在前瞻性医疗计划中的应用,通过实验发现AI可作为个人倡导者,提升个体与代理之间的相互理解。

Comments Accepted at CHI 2026. 34 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12777 2026-02-11 cs.MA cs.AI 88%

Multi-Agent Reinforcement Learning Simulation for Environmental Policy Synthesis

多智能体强化学习模拟用于环境政策综合

James Rudd-Jones, Mirco Musolesi, María Pérez-Ortiz

机构 * Centre for Artificial Intelligence, Department of Computer Science, University College London(人工智能研究中心,计算机科学系,伦敦大学学院) Department of Computer Science and Engineering, University of Bologna(计算机科学与工程系,博洛尼亚大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出利用多智能体强化学习增强气候模拟,以解决政策综合中的非线性动态、异质智能体和不确定性量化等挑战。

Comments Published in AAMAS'25 Blue Sky Ideas Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01550 2026-02-11 cs.AI 83%

S1-NexusAgent: a Self-Evolving Agent Framework for Multidisciplinary Scientific Research

S1-NexusAgent:一个多学科科学研究的自演化代理框架

NexusAgent Team

机构 * S1-NexusAgent Team Institute of Automation Chinese Academy of Sciences(S1-NexusAgent团队自动化研究所中国科学院)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 S1-NexusAgent通过自演化机制和双环架构,实现多学科科学研究中的复杂工作流建模与高效工具协调,验证了其在长视界规划和复杂任务中的卓越性能。

Comments In progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10357 2026-02-11 cs.AI 83%

Optimus-3: Dual-Router Aligned Mixture-of-Experts Agent with Dual-Granularity Reasoning-Aware Policy Optimization

Optimus-3: 具有双粒度推理感知策略优化的双路由对齐专家混合代理

Zaijing Li, Yuquan Xie, Rui Shao, Gongwei Chen, Weili Guan, Dongmei Jiang, Yaowei Wang, Liqiang Nie

机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen Campus)(计算机科学与技术学院,哈尔滨工业大学(深圳校区)) Pengcheng Laboratory(鹏城实验室) School of Information Science and Technology, Harbin Institute of Technology (Shenzhen Campus)(信息科学与技术学院,哈尔滨工业大学(深圳校区)) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 Optimus-3通过双路由对齐专家混合架构和双粒度推理感知策略优化,实现了系统1与系统2的协同,提升了开放性任务的解决能力。

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09227 2026-02-11 cs.RO 82%

From Legible to Inscrutable Trajectories: (Il)legible Motion Planning Accounting for Multiple Observers

从可理解到不可理解的轨迹:考虑多个观察者的(不)可理解运动规划

Ananya Yammanuru, Maria Lusardi, Nancy M. Amato, Katherine Driggs-Campbell

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出MMLO-LMP问题,设计DUBIOUS算法,实现对不同动机观察者的轨迹可理解性与可见性限制的平衡。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09798 2026-02-11 cs.AI 79%

Symbolic Pattern Temporal Numeric Planning with Intermediate Conditions and Effects

具有中间条件和效果的符号模式时间数字规划

Matteo Cardellini, Enrico Giunchiglia

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种扩展的符号模式规划方法,用于处理具有中间条件和效果的时间规划问题,实验显示其在多个领域表现优异。

Comments Under review at the Artificial Intelligence Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08533 2026-02-11 cs.AI 79%

Dialogue Model Optimization via Agent Game and Adaptive Tree-based GRPO

通过智能体游戏和自适应树形GRPO优化对话模型

Kun Peng, Conghui Tan, Yu Liu, Guohua Tang, Zhongqian Sun, Wei Yang, Zining Zhu, Lei Jiang, Yanbing Liu, Hao Peng

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Tencent(腾讯)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出一种结合智能体游戏和自适应树形GRPO的对话模型优化方法,通过动态环境构建和自适应奖励范围设计,提升对话的长期价值捕获与样本效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18083 2026-02-11 cs.LG cs.RO 79%

What Do You Need for Compositional Generalization in Diffusion Planning?

在扩散规划中你需要什么才能实现组合泛化?

Quentin Clark, Florian Shkurti

机构 * Department of Computer Science, University of Toronto(计算机科学系,多伦多大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出Eq-Net架构,通过位移等变性、局部感受野和推断选择实现扩散规划的组合泛化,展示其在导航和操作任务中的有效性。

Comments 8 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10114 2026-02-11 cs.RO 78%

Decoupled MPPI-Based Multi-Arm Motion Planning

解耦的基于MPPI的多臂运动规划

Dan Evron, Elias Goldsztejn, Ronen I. Brafman

机构 * The Department of Computer Science at Ben-Gurion University of the Negev(本·古里安大学内盖夫分校计算机科学系)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出MR-STORM算法,通过分布式方式解决多臂运动规划问题,有效处理动态障碍物并提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09714 2026-02-11 cs.RO 78%

Fast Motion Planning for Non-Holonomic Mobile Robots via a Rectangular Corridor Representation of Structured Environments

通过结构化环境的矩形走廊表示实现非完整移动机器人的快速运动规划

Alejandro Gonzalez-Garcia, Sebastiaan Wyns, Sonia De Santis, Jan Swevers, Wilm Decré

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究提出了一种基于矩形走廊表示的高效运动规划框架,用于非完整移动机器人在复杂结构化环境中的快速导航。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09123 2026-02-11 cs.RO cs.SY eess.SY 78%

Agile asymmetric multi-legged locomotion: contact planning via geometric mechanics and spin model duality

敏捷非对称多足运动:通过几何力学和自旋模型对偶性进行接触规划

Jackson Habala, Gabriel B. Margolis, Tianyu Wang, Pratyush Bhatt, Juntao He, Naheel Naeem, Zhaochen Xu, Pulkit Agrawal, Daniel I. Goldman, Di Luo, Baxi Chong

机构 * Department of Mechanical Engineering, Pennsylvania State University(宾夕法尼亚州立大学机械工程系) MIT Improbable AI Lab, Maschusetts Institute of Technology(麻省理工学院Improbable AI实验室) Department of Physics, Georgia Institute of Technology(佐治亚理工学院物理系) Department of Physics, Tsinghua University(清华大学物理系)

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究提出了一种基于几何力学和自旋模型对偶性的原理性框架,用于发现多足运动中的新控制结构,实现了六足机器人非对称运动策略,使前进速度提高50%。

Comments 10 pages, 7 figures. arXiv admin note: text overlap with arXiv:2302.03019

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21797 2026-02-11 cs.CV 78%

MoWM: Mixture-of-World-Models for Embodied Planning via Latent-to-Pixel Feature Modulation

MoWM: 通过潜在到像素特征调制的混合世界模型实现具身规划

Yangcheng Yu, Xin Jin, Yu Shang, Xin Zhang, Haisheng Su, Wei Wu, Yong Li

机构 * Tsinghua University(清华大学) Manifold AI Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 MoWM通过融合潜在世界模型与像素特征,提升具身规划中动作解码的精度与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.03006 2026-02-11 eess.SY cs.SY 78%

Can occupant behaviors affect urban energy planning? Distributed stochastic optimization for energy communities

occupant behaviors 是否会影响城市能源规划?面向能源社区的分布式随机优化

Julien Leprince, Amos Schledorn, Daniela Guericke, Dominik Franjo Dominkovic, Henrik Madsen, Wim Zeiler

专题命中 规划决策 :planning(title,abstract)

AI总结 本文通过分布式随机优化方法,研究 occupant 行为对城市能源规划的影响,揭示了 occupant 行为是影响能源社区规划的主要不确定性因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09598 2026-02-11 cs.CL 77%

Learning from the Irrecoverable: Error-Localized Policy Optimization for Tool-Integrated LLM Reasoning

从不可恢复中学习:用于工具集成大语言模型推理的误差局部化策略优化

Qiao Liang, Yuke Zhu, Chao Ge, Lei Yang, Ying Shen, Bo Zheng, Sheng Guo

专题命中 规划决策 :tool use(abstract);planning(abstract);agentic(abstract);分类 cs.CL

AI总结 ELPO通过误差局部化策略优化提升工具集成大语言模型推理的性能,有效解决稀疏奖励和信用分配问题。

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14622 2026-02-11 cs.DB 75%

Beyond Text-to-SQL: Autonomous Research-Driven Database Exploration with DAR

超越文本到SQL:基于DAR的自主研究驱动数据库探索

Ostap Vykhopen, Viktoria Skorik, Maksym Tereshchenko, Veronika Solopova

专题命中 规划决策 :agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 DAR是一种多代理系统,通过自主探索数据完成端到端数据库研究,显著提升分析效率并生成基于证据的洞察。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00928 2026-02-11 cs.MA math.OC 75%

Virtual Force-Based Routing of Modular Agents on a Graph

基于虚拟力的模块化代理在图上的路由

Adam Casselman, Manav Vora, Melkior Ornik

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于虚拟力的模块化代理路由算法,通过平衡路径最优性和模块连接成本效益,实现多目标节点的高效访问。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13761 2026-02-11 cs.AI cs.CL 73%

THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning

THOR:通过强化学习进行工具集成的分层优化以实现数学推理

Qikai Chang, Zhenrong Zhang, Pengfei Hu, Jun Du, Jiefeng Ma, Yicheng Pan, Jianshu Zhang, Quan Liu, Jianqing Gao

机构 * University of Science and Technology of China(中国科学技术大学) iFLYTEK Research(iFLYTEK研究院)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 THOR通过强化学习实现工具集成的分层优化,提升数学推理和代码生成能力。

Comments 22 pages, 13 figures, ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏