arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-13 至 2026-02-13 共收录 106 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 8 篇

2509.24226 2026-02-13 eess.SY cs.SY 88%

Multi-Agent Guided Policy Search for Non-Cooperative Dynamic Games

多智能体引导策略搜索用于非合作动态博弈

Jingqi Li, Gechen Qu, Jason J. Choi, Somayeh Sojoudi, Claire Tomlin

专题命中 工具调用 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出多智能体引导策略搜索方法,通过引入近似先验正则化,解决非合作动态博弈中的策略不稳定问题,实验显示其在非线性车辆编队和篮球 formations 中表现更优。

Comments This paper has been accepted for presentation at the IEEE American Control Conference (ACC) 2026. We sincerely appreciate the reviewers' valuable and constructive feedback. The latest version of the manuscript incorporates their suggestions, including additional clarifications of theoretical assumptions, convergence guarantees, and experimental details

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05014 2026-02-13 cs.AI cs.CL cs.IR 86%

DeepRead: Document Structure-Aware Reasoning to Enhance Agentic Search

DeepRead: 一种基于文档结构的推理以增强代理搜索

Zhanli Li, Huiwen Tian, Lvzhou Luo, Yixuan Cao, Ping Luo

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences, CAS(中国科学院大学) Wenlan School of Business, Zhongnan University of Economics(中南财经政法大学文澜商学院)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool-use(abstract);分类 cs.AI、cs.CL

AI总结 DeepRead通过结构感知的文档推理增强代理搜索,有效提升文档理解精度。

Comments This version has significantly enhanced the clarity of our research

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12096 2026-02-13 cs.RO cs.AI 79%

Multi Graph Search for High-Dimensional Robot Motion Planning

多图搜索用于高维机器人运动规划

Itamar Mishani, Maxim Likhachev

专题命中 工具调用 :planning(title,abstract);分类 cs.AI

AI总结 本文提出多图搜索算法,用于高维机器人运动规划,通过多图扩展实现高效且可靠的路径搜索。

Comments Submitted for Publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11551 2026-02-13 cs.CL 74%

SIGHT: Reinforcement Learning with Self-Evidence and Information-Gain Diverse Branching for Search Agent

SIGHT: 基于自证证据和信息增益多样分支的强化学习

Wenlin Zhong, Jinluan Yang, Yiquan Wu, Yi Liu, Jianhang Yao, Kun Kuang

机构 * Zhejiang University(浙江大学) Chongqing Ant Consumer Finance Co., Ltd.(重庆蚂蚁消费金融有限公司) Alibaba Group(阿里巴巴集团)

专题命中 工具调用 :agent(title);分类 cs.CL

AI总结 SIGHT通过自证证据和信息增益驱动多样化分支,提升搜索代理的自主推理能力,减少冗余并增强探索策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11581 2026-02-13 cs.IR cs.AI cs.CL 62%

Analytical Search

分析搜索

Yiteng Tu, Shuo Miao, Weihang Su, Yiqun Liu, Qingyao Ai

机构 * DCST, Tsinghua University(清华大学智能驾驶与车路协同研究院) Quan Cheng Laboratory(量子工程实验室)

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文提出分析搜索范式,旨在通过证据导向和多步骤推理解决复杂分析需求,提升信息检索的端到端能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09349 2026-02-13 cs.LG 57%

Large Language Models for Designing Participatory Budgeting Rules

基于大型语言模型的设计参与式预算规则

Nguyen Thach, Xingchen Sha, Hau Chan

机构 * University of Nebraska-Lincoln(内布拉斯加大学林肯分校) Northwestern University(西北大学)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 本文提出LLMRule框架,利用大型语言模型自动化设计参与式预算规则,提升预算分配的效用同时保持公平性。

Comments Accepted as full paper to AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11912 2026-02-13 quant-ph 50%

Millisecond-Scale Calibration and Benchmarking of Superconducting Qubits

超导量子比特的毫秒级校准与基准测试

Malthe A. Marciniak, Rune T. Birke, Johann B. Severin, Fabrizio Berritta, Daniel Kjær, Filip Nilsson, Smitha N. Themadath, Sangeeth Kallatt, James L. Webb, Kristoffer Bentsen, Tonny Madsen, Zhenhai Sun, Svend Krøjer, Christopher W. Warren, Jacob Hastrup, Morten Kjaergaard

专题命中 工具调用 :workflow(abstract)

AI总结 本研究提出了一种在FPGA上实现的毫秒级超导量子比特校准与基准测试方法,通过高效算法和稀疏采样技术实现快速且精确的参数估计和优化。

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11740 2026-02-13 cs.MA cs.RO 50%

Counterfactual Conditional Likelihood Rewards for Multiagent Exploration

反事实条件似然奖励用于多智能体探索

Ayhan Alp Aydeniz, Robert Loftin, Kagan Tumer

机构 * Oregon State University(俄勒冈州立大学) University of Sheffield(谢菲尔德大学)

专题命中 工具调用 :agent(abstract)

AI总结 本文提出反事实条件似然奖励,通过评估智能体对团队探索的独特贡献,提升多智能体系统在稀疏奖励环境下的探索效率和协作能力。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 33 篇

2602.11541 2026-02-13 cs.AI cs.LG 90%

Budget-Constrained Agentic Large Language Models: Intention-Based Planning for Costly Tool Use

预算约束下的代理型大语言模型:基于意图的规划以应对昂贵的工具使用

Hanbing Liu, Chunhao Tian, Nan An, Ziyuan Wang, Pinyan Lu, Changyuan Yu, Qi Qi

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Shanghai University of Finance(上海财经大学) Baidu Inc.(百度公司)

专题命中 规划决策 :planning(title,abstract);tool use(title);agentic(title);分类 cs.AI、cs.LG

AI总结 本文提出INTENT框架,通过意图感知的分层世界模型,在预算约束下提升工具使用任务的成功率并保持鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09829 2026-02-13 cs.IR 90%

Internalizing Multi-Agent Reasoning for Accurate and Efficient LLM-based Recommendation

内部化多智能体推理以实现准确且高效的基于LLM的推荐

Yang Wu, Haoze Wang, Qian Li, Jun Zhang, Huan Yu, Jie Jiang

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);agentic(abstract)

AI总结 本文提出STAR模型,通过轨迹驱动的内部化方法,将多智能体推理能力高效整合到单模型中,实现准确且高效的推荐系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15414 2026-02-13 cs.AI 88%

MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs

通过战略性大语言模型的自我对战激励多智能体推理的MARSHAL

Huining Yuan, Zelai Xu, Zheyue Tan, Xiangmin Yi, Mo Guang, Kaiwen Long, Haojia Hui, Boxun Li, Xinlei Chen, Bo Zhao, Xiao-Ping Zhang, Chao Yu, Yu Wang

机构 * SIGS, Tsinghua University(清华大学信号与系统系) EE, Tsinghua University(清华大学电子工程系) Aalto University(阿alto大学) Li Auto Inc.(李汽车公司) Infinigence AI Project Page Code Models(Infinigence AI项目页面代码模型)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 MARSHAL通过战略性LLM的自我对战激励多智能体推理,实现多智能体系统的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11416 2026-02-13 cs.CR cs.LG 88%

Optimizing Agent Planning for Security and Autonomy

优化安全与自主性的智能体规划

Aashish Kolluri, Rishi Sharma, Manuel Costa, Boris Köpf, Tobias Nießen, Mark Russinovich, Shruti Tople, Santiago Zanella-Béguelin

专题命中 规划决策 :agent(title,abstract);planning(title);AI agent(abstract);分类 cs.LG

AI总结 本文提出了一种安全意识智能体,通过增强人工监督交互和规划任务进展与政策合规性,提高自主性并减少对人工监督的依赖。

Comments 33 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11170 2026-02-13 cs.CL 88%

PRIME: Policy-Reinforced Iterative Multi-agent Execution for Algorithmic Reasoning in Large Language Models

PRIME:基于策略强化的迭代多智能体执行框架用于大语言模型中的算法推理

Jiawei Xu, Zhenyu Yu, Ziqian Bi, Minh Duc Pham, Xiaoyi Qu, Danyang Zhang

机构 * Purdue University(普渡大学) University of Malaya(马来亚大学) Faculty of Information Technology, Beijing University of Technology(北京理工大学信息学院) School of Computer Science, Georgia Institute of Technology(佐治亚理工学院计算机科学学院) Department of Industrial and Systems Engineering, Lehigh University(莱斯大学工业与系统工程系)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 PRIME通过多智能体框架提升大语言模型在算法推理中的性能,显著提高复杂任务的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16839 2026-02-13 cs.AI 88%

Roundtable Policy: Confidence-Weighted-Consensus Aggregation Improves Multi-Agent-System Reasoning

圆桌政策:置信度加权共识聚合提升多智能体系统推理

Yu Yao, Jiayi Dong, Yang Yang, Ju Li, Yilun Du

机构 * mit(麻省理工学院)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 圆桌政策通过多语言模型加权共识提升多智能体系统在复杂科学任务中的推理能力

Comments Project page: https://ai4scidisc.github.io/roundtable/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11409 2026-02-13 cs.AI 87%

TRACER: Trajectory Risk Aggregation for Critical Episodes in Agentic Reasoning

TRACER:轨迹风险聚合用于代理推理中的关键事件

Sina Tayebati, Divake Kumar, Nastaran Darabi, Davide Ettori, Ranganath Krishnan, Amit Ranjan Trivedi

机构 * University of Illinois at Chicago(伊利诺伊大学芝加哥分校) AI Labs at Capital One(Capital One 人工智能实验室)

专题命中 规划决策 :agentic(title);agent(abstract);AI agent(abstract);tool use(abstract)

AI总结 TRACER通过轨迹级不确定性度量提升复杂对话工具使用中的不确定性检测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11666 2026-02-13 cs.AI cs.CL 86%

PhyNiKCE: A Neurosymbolic Agentic Framework for Autonomous Computational Fluid Dynamics

PhyNiKCE:一种用于自主计算流体动力学的神经符号代理框架

E Fan, Lisong Shi, Zhengtong Li, Chih-yung Wen

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 PhyNiKCE通过神经符号框架提升CFD模拟的可信度与效率,实现96%的性能提升并减少59%的自我校正循环。

Comments 30 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12055 2026-02-13 cs.AI cs.MA cs.RO 85%

Multi UAVs Preflight Planning in a Shared and Dynamic Airspace

共享动态空域中多无人机预飞行规划

Amath Sow, Mauricio Rodriguez Cesen, Fabiola Martins Campos de Oliveira, Mariusz Wzorek, Daniel de Leng, Mattias Tiger, Fredrik Heintz, Christian Esteve Rothenberg

机构 * Linköping University(林雪平大学) Universidade Estadual de Campinas(坎皮纳斯州立大学) Universidade Federal do ABC(ABC联邦大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 DTAPP-IICR通过增量迭代冲突解决方法,实现了在动态共享空域中大规模无人机预飞行规划的高效与高成功率。

Comments AAMAS 2026 accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11782 2026-02-13 cs.AI cs.SE 84%

FlowMind: Execute-Summarize for Structured Workflow Generation from LLM Reasoning

FlowMind: 从LLM推理生成结构化工作流的执行-总结

Yihao Liu, Ziyun Zhang, Zile He, Huaqian Cai

机构 * Peking University(北京大学) East China University of Technology(东华大学) National Key Laboratory of Data Space Technology and System(数据空间技术与系统国家重点实验室)

专题命中 规划决策 :workflow(title,abstract);tool use(abstract);分类 cs.AI、cs.SE

AI总结 FlowMind通过执行-总结框架将LLM推理转化为结构化工作流,提高工作流的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11412 2026-02-13 cs.CY cs.AI cs.HC 83%

When Visibility Outpaces Verification: Delayed Verification and Narrative Lock-in in Agentic AI Discourse

当可见性超越验证:代理AI discourse中的延迟验证与叙述锁定

Hanjing Shi, Dominic DiFranzo

机构 * Lehigh University(莱文大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文研究了代理AI讨论中可见性与验证时间的关系,揭示了高可见度讨论因延迟验证导致的叙述锁定现象,并提出知识摩擦作为平衡平台的干预措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08987 2026-02-13 cs.CE 82%

Rapid prediction of cardiac activation in the left ventricle with geometric deep learning: a step towards cardiac resynchronization therapy planning

基于几何深度学习的左心室心脏激活快速预测:迈向心脏再同步治疗规划的一步

Ehsan Naghavi, Haifeng Wang, Vahid Ziaei Rad, Julius Guccione, Ghassan Kassab, Vishnu Boddeti, Seungik Baek, Lik-Chuan Lee

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本研究利用几何深度学习模型预测左心室激活时间图,以提高CRT治疗规划的精准度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12143 2026-02-13 cs.AI cs.LG 81%

STAR : Bridging Statistical and Agentic Reasoning for Large Model Performance Prediction

STAR:连接统计推理与代理推理以提升大模型性能预测

Xiaoxiao Wang, Chunxiao Li, Junying Wang, Yijin Guo, Zijian Chen, Chunyi Li, Xiaohong Liu, Zicheng Zhang, Guangtao Zhai

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 STAR框架通过结合统计推理与代理推理,有效提升大模型性能预测的准确性与可靠性,尤其在数据稀疏情况下表现突出。

Comments 10 pages, 8 figures, 17 tables. Code available at https://github.com/xiaoxiaostudy/star

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11882 2026-02-13 cs.LG cs.AI cs.CV cs.RO 81%

Where Bits Matter in World Model Planning: A Paired Mixed-Bit Study for Efficient Spatial Reasoning

位在世界模型规划中的作用:一种混合位研究以实现高效的空问推理

Suraj Ranganath, Anish Patnaik, Vaishak Menon

机构 * University of California San Diego(加州大学圣地亚哥分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究通过混合位方法探讨位分配对世界模型规划的影响,发现不同比特分配策略在空间推理中的表现差异显著,提出模块意识和预算意识的量化策略作为未来研究方向。

Comments Workshop submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11220 2026-02-13 cs.LG cs.CL 81%

Patch the Distribution Mismatch: RL Rewriting Agent for Stable Off-Policy SFT

修补分布不匹配:用于稳定离策略SFT的RL重写代理

Jiacheng Wang, Ping Jian, Zhen Yang, Zirong Chen, Keren Liao, Zhongbin Guo

机构 * School of Computer Science & Technology, Beijing Institute of Technology(计算机科学与技术学院,北京理工大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL、cs.LG

AI总结 本文提出基于强化学习的RL重写代理,通过优化分布对齐和多样性,提升下游SFT效果并减少遗忘。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18095 2026-02-13 cs.AI cs.CL 81%

SMaRT: Select, Mix, and ReinvenT -- A Strategy Fusion Framework for LLM-Driven Reasoning and Planning

SMaRT: 选择、混合与再发明 -- 一种用于大语言模型驱动推理与规划的策略融合框架

Nikhil Verma, Manasa Bharadwaj, Wonjun Jang, Harmanpreet Singh, Yixiao Wang, Homa Fashandi, Chul Lee

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 SMaRT框架通过融合多样化推理策略,提升大语言模型在推理与规划任务中的性能和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18382 2026-02-13 cs.RO 78%

One Demo Is All It Takes: Planning Domain Derivation with LLMs from A Single Demonstration

一个演示就足够:从单个演示中利用LLM进行规划域推导

Jinbang Huang, Yixin Xiao, Zhanguang Zhang, Mark Coates, Jianye Hao, Yingxue Zhang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) McGill University(麦吉尔大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 PDDLLM通过结合LLM推理与物理模拟,从单个演示中自动推导规划域,提升长时间跨度任务规划的自动化与可靠性。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09255 2026-02-13 cs.RO cs.AI 77%

STaR: Scalable Task-Conditioned Retrieval for Long-Horizon Multimodal Robot Memory

STaR:可扩展的任务条件检索用于长时多模态机器人记忆

Mingfeng Yuan, Hao Zhang, Mahan Mohammadi, Runhao Li, Jinjun Shan, Steven L. Waslander

机构 * University of Toronto Institute for Aerospace Studies(多伦多大学航空航天研究所) University of Toronto Robotics Institute(多伦多大学机器人研究所) Department of Earth and Space Science(地球与空间科学系) Lassonde School of Engineering(拉索nde工程学院) York University(约克大学)

专题命中 规划决策 :planning(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 STaR通过任务条件检索算法提升机器人长时多模态记忆的可扩展性和上下文推理能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12181 2026-02-13 cs.GT cs.LG cs.MA 70%

Convex Markov Games and Beyond: New Proof of Existence, Characterization and Learning Algorithms for Nash Equilibria

凸马尔可夫游戏及更进一步:Nash均衡的存在性、特征及学习算法的新证明

Anas Barakat, Ioannis Panageas, Antonios Varvitsiotis

机构 * Singapore University of Technology and Design(新加坡科技设计大学) University of California Irvine, USA(加州大学 Irvine 分校) Centre for Quantum Technologies, National University of Singapore(新加坡国立大学量子中心) Archimedes/Athena Research Center, Greece(阿基米德/雅典娜研究中心)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出通用效用马尔可夫游戏(GUMGs)理论框架,证明Nash均衡的存在性与一阶静态点一致,并设计无模型策略梯度算法,扩展了传统cMGs的理论边界。

Comments AISTATS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11829 2026-02-13 cs.LG cs.GT 70%

Towards Sustainable Investment Policies Informed by Opponent Shaping

面向可持续投资政策的对手塑造驱动的投资策略

Juan Agustin Duque, Razvan Ciuca, Ayoub Echchahed, Hugo Larochelle, Aaron Courville

机构 * University of Montreal and MILA(蒙特利尔大学和MILA)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出通过对手塑造算法优化投资策略,以解决可持续发展中的社会困境问题。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11176 2026-02-13 cs.CL cs.AI cs.CE cs.LG 67%

Evaluating Few-Shot Temporal Reasoning of LLMs for Human Activity Prediction in Smart Environments

评估LLM在智能环境中的少样本时间推理用于人类活动预测

Maral Doctorarastoo, Katherine A. Flanigan, Mario Bergés, Christopher McComb

机构 * organization= Department of Civil \& Environmental Engineering, Carnegie Mellon University , addressline= 5000 Forbes Ave , city= Pittsburgh , state= PA , postcode= 15213 , country= USA organization= Department of Mechanical Engineering, Carnegie Mellon University , addressline= 5000 Forbes Ave , city= Pittsburgh , state= PA , postcode= 15213 , country= USA

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文研究了预训练语言模型在智能环境中的少样本时间推理能力,通过评估其在人类活动预测中的表现,发现其在低数据环境下具备强大的时间理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13779 2026-02-13 cs.CL cs.AI cs.LG 67%

NewsInterview: a Dataset and a Playground to Evaluate LLMs' Ground Gap via Informational Interviews

NewsInterview: 一个用于通过信息性访谈评估LLM地面间隙的数据集和游乐场

Alexander Spangher, Michael Lu, Sriya Jeslyn Kalyan, Hyundong Justin Cho, Weiyan Shi, Jonathan May

机构 * University of California, Berkeley(加州大学伯克利分校) University of Southern California(南加州大学) Information Sciences Institute(信息科学研究所) Northeastern University(东北大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 NewsInterview通过信息性访谈数据集和模拟环境,揭示LLMs在战略对话和多轮规划方面的能力不足,强调需提升其对话策略与说服力。

Comments Accepted at ACL 2025: https://aclanthology.org/2025.acl-long.1580/

详情

展开后加载摘要…

URL PDF HTML 收藏