arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-06 至 2026-02-06 共收录 95 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 40 篇

2510.25634 2026-02-06 cs.RO cs.AI 57%

Learning to Plan & Schedule with Reinforcement-Learned Bimanual Robot Skills

学习计划与调度的强化学习双臂机器人技能

Weikang Wan, Fabio Ramos, Xuning Yang, Caelan Garrett

机构 * NVIDIA University of California San Diego(加州大学圣地亚哥分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于强化学习的双臂机器人技能计划与调度框架,通过分层结构提升复杂任务的执行效率与协调性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02276 2026-02-06 cs.AI 57%

Rewarding Explainability in Drug Repurposing with Knowledge Graphs

利用知识图谱提升药物再利用中的可解释性

Susana Nunes, Samy Badreddine, Catia Pesquita

机构 * LASIGE, Faculty of Sciences, University of Lisbon(里斯本大学科学学院LASIGE) Sony AI(索尼人工智能) University of Trento(特伦托大学) Bruno Kessler Institute(布鲁诺·凯塞林研究所)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出REx方法,利用知识图谱链接预测生成科学解释,通过奖励机制和领域本体学提升药物再利用的预测性能和解释质量。

Comments 9 pages, 4 figures, accepted at conference IJCAI 2025

Journal ref Proceedings of the Thirty-Fourth International Joint Conference on Artificial Intelligence (IJCAI-25), pp. 4624-4632, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14865 2026-02-06 cs.LG 57%

Hierarchical Subspaces of Policies for Continual Offline Reinforcement Learning

策略分层子空间用于持续离线强化学习

Anthony Kobanda, Rémy Portelas, Odalric-Ambrym Maillard, Ludovic Denoyer

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 HiSPO通过分层策略子空间实现持续离线强化学习,有效解决导航任务中的遗忘与可扩展性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05120 2026-02-06 cs.CC cs.LG 57%

Certifiable Boolean Reasoning Is Universal

可验证的布尔推理是通用的

Wenhao Li, Anastasis Kratsios, Hrad Ghoukasian, Dennis Zvigelsky

机构 * University of Toronto(多伦多大学) McMaster University(麦基尔大学) Vector Institute(向量研究所) Scuola Normale Superiore di Pisa(比萨normal高等学院)

专题命中 规划决策 :agentic(abstract);分类 cs.LG

AI总结 本文提出了一种深度学习架构,能够确证性地推理并通用性地处理任何布尔任务,且在简单布尔任务中参数需求低。

Comments Submitted to COLT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05036 2026-02-06 cs.LG 57%

Feedback Control for Multi-Objective Graph Self-Supervision

多目标图自监督学习的反馈控制

Karish Grover, Theodore Vasiloudis, Han Xie, Sixing Lu, Xiang Song, Christos Faloutsos

机构 * Carnegie Mellon University(卡内基梅隆大学) Amazon(亚马逊)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 ControlG通过反馈控制框架解决多目标图自监督学习中的目标协调问题,通过时间分配优化提升性能并揭示学习驱动因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06001 2026-02-06 cs.RO 50%

Visuo-Tactile World Models

视觉-触觉世界模型

Carolina Higuera, Sergio Arnaud, Byron Boots, Mustafa Mukadam, Francois Robert Hogan, Franziska Meier

机构 * Paul G. Allen School of Computer Science, University of Washington(华盛顿大学保罗·G·阿伦计算机科学学院) FAIR, Meta(FAIR,Meta)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出视觉-触觉世界模型,通过融合视觉与触觉传感提升机器人在接触丰富任务中的物理建模能力,实验显示其在物体永恒性和运动定律遵守方面表现更优,并在真实机器人任务中实现更高的成功率。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05730 2026-02-06 cs.CV 50%

Depth as Prior Knowledge for Object Detection

深度作为先验知识用于目标检测

Moussa Kassem Sbeyti, Nadja Klein

机构 * Scientific Computing Center, Karlsruhe Institute of Technology(卡尔斯鲁厄理工大学科学计算中心)

专题命中 规划决策 :planning(abstract)

AI总结 DepthPrior通过利用深度作为先验知识提升目标检测性能,无需修改检测器架构,实现小目标检测精度提升。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10102 2026-02-06 physics.ed-ph physics.soc-ph 50%

On the design of a profession-oriented course on Theoretical Mechanics for physics education students

关于为物理教育学生设计一门理论力学专业课程的设计

Marianne Korner, Christos N. Likos

专题命中 规划决策 :planning(abstract)

AI总结 本文介绍了为物理教育学生设计一门理论力学课程,旨在通过精心设计的课程内容和教学方法,弥合理论物理与实际教学需求之间的差距。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11523 2026-02-06 math.OC 50%

An infinite horizon sufficient stochastic maximum principle for regime switching diffusions and applications

无限时间充分随机最大原理及其在 regime switching 扩散中的应用

Kai Ding, Xun Li, Siyu Lv, Xin Zhang

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种无限时间 horizon 的随机最大原理,用于 regime switching 扩散的最优控制问题,并通过线性二次生产计划问题展示了其应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05273 2026-02-06 cs.RO 50%

Affordance-Aware Interactive Decision-Making and Execution for Ambiguous Instructions

具有包容性的交互决策与执行以应对模糊指令

Hengxuan Xu, Fengbo Lan, Zhixin Zhao, Shengjie Wang, Mengqiao Liu, Jieqian Sun, Yu Cheng, Tao Zhang

机构 * Department of Automation, Tsinghua University(清华大学自动化系) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息学院) Computer Science and Engineering Department, Chinese University of Hong Kong(香港中文大学计算机科学与工程系)

专题命中 规划决策 :planning(abstract)

AI总结 AIDE通过双流框架整合交互式探索与视觉-语言推理,实现对模糊指令的高效决策与执行,提升机器人在陌生环境中的任务规划能力。

Comments 14 pages, 10 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05131 2026-02-06 cs.DC 50%

Towards Advancing Research with Workflows: A perspective from the Workflows Community Summit -- Amsterdam, 2025

迈向研究进展的工作流:来自工作流社区峰会的视角——阿姆斯特丹,2025

Irene Bonati, Silvina Caino-Lores, Tainã Coleman, Sagar Dolas, Sandro Fiore, Venkatesh Kannan, Marco Verdicchio, Sean R. Wilkinson, Rafael Ferreira da Silva

专题命中 规划决策 :workflow(abstract)

AI总结 2025年工作流社区峰会探讨了工作流在科研中的挑战与机遇,提出通过改进评估指标、标准化、人才培养等措施推动工作流技术发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04972 2026-02-06 cs.CY 50%

Learning Context Matters: Measuring and Diagnosing Personalization Gaps in LLM-Based Instructional Design

学习上下文很重要:在基于LLM的教学设计中测量和诊断个性化差距

Johaun Hatchett, Debshila Basu Mallick, Brittany C. Bradford, Richard G. Baraniuk

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种框架,用于测量和诊断学习上下文对基于LLM教学系统的影响,发现提供学习上下文能改善LLM的教学策略,但尚未实现可靠的个性化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04914 2026-02-06 cond-mat.mtrl-sci 50%

From Literature to Lab: Closed-Loop Advancement of Perovskite Solar Cells via Domain Knowledge Guided LLM

从文献到实验室:通过领域知识引导的LLM实现钙钛矿太阳能电池的闭环进步

Penglei Sun, Shuyan Chen, Xiang Liu, Longhan Zhang, Huajie You, Chang Yan, Yongqi Zhang, Xiaowen Chu, Tong-yi Zhang

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出通过领域知识引导的LLM框架,实现钙钛矿太阳能电池的闭环进步,自主设计出高效配方并接近世界纪录。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10555 2026-02-06 cs.CV 50%

SurgLaVi: Large-Scale Hierarchical Dataset for Surgical Vision-Language Representation Learning

SurgLaVi:大规模分层数据集用于外科视觉-语言表示学习

Alejandra Perez, Chinedu Nwoye, Ramtin Raji Kermani, Omid Mohareri, Muhammad Abdullah Jamal

机构 * Intuitive Surgical, Inc.(Intuitive Surgical公司) Center for Research and Formation in Artificial Intelligence (CinfonIA), Universidad de los Andes(人工智能研究中心(CinfonIA))

专题命中 规划决策 :workflow(abstract)

AI总结 SurgLaVi是一个大规模分层外科视觉-语言数据集,通过自动化流程生成高质量标注,用于提升手术视频的表示学习和多任务迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02648 2026-02-06 eess.SY cs.CY cs.GT cs.MA cs.SI cs.SY 50%

Steering the Herd: A Framework for LLM-based Control of Social Learning

引导 herd:一种基于 LLM 的社会学习控制框架

Raghu Arghal, Kevin He, Shirin Saeedi Bidokhti, Saswati Sarkar

专题命中 规划决策 :agent(abstract)

AI总结 本文提出了一种基于 LLM 的社会学习控制框架,研究信息中介如何通过动态规划和贝叶斯更新影响社会福利和群体行为。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 16 篇

2602.05446 2026-02-06 cs.HC 90%

DiLLS: Interactive Diagnosis of LLM-based Multi-agent Systems via Layered Summary of Agent Behaviors

通过代理行为分层总结实现基于大语言模型的多代理系统交互诊断:DiLLS

Rui Sheng, Yukun Yang, Chuhan Shi, Yanna Lin, Zixin Chen, Huamin Qu, Furui Cheng

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);agentic(abstract)

AI总结 DiLLS通过多层行为总结,帮助开发者更高效地诊断和理解基于LLM的多代理系统故障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06008 2026-02-06 cs.AI cs.LG 90%

AgenticPay: A Multi-Agent LLM Negotiation System for Buyer-Seller Transactions

AgenticPay: 一种基于多智能体LLM的买方卖方交易谈判系统

Xianyang Liu, Shangding Gu, Dawn Song

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 AgenticPay是一种基于多智能体LLM的买方卖方交易谈判系统,通过自然语言驱动的多轮谈判解决市场交易问题,评估智能体在经济互动中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06038 2026-02-06 cs.RO cs.AI cs.CV cs.LG cs.MA 88%

CommCP: Efficient Multi-Agent Coordination via LLM-Based Communication with Conformal Prediction

CommCP:通过基于大语言模型的通信实现高效的多智能体协调

Xiaopan Zhang, Zejin Wang, Zhixu Li, Jianpeng Yao, Jiachen Li

机构 * Trustworthy Autonomous Systems Laboratory at the University of California, Riverside, CA, USA(加州大学河滨分校可信自主系统实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 CommCP通过基于大语言模型的通信框架,提升多智能体协作任务的成功率和探索效率。

Comments IEEE International Conference on Robotics and Automation (ICRA 2026); Project Website: https://comm-cp.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05289 2026-02-06 cs.CL cs.AI cs.MA 88%

Towards a Science of Collective AI: LLM-based Multi-Agent Systems Need a Transition from Blind Trial-and-Error to Rigorous Science

迈向集体人工智能的科学:基于LLM的多智能体系统需要从盲目试错转向严谨的科学

Jingru Fan, Dewen Liu, Yufan Dang, Huatao Li, Yuheng Wang, Wei Liu, Feiyu Duan, Xuanwen Ding, Shu Yao, Lin Wu, Ruijie Shi, Wai-Shing Leung, Yuan Cheng, Zhongyu Wei, Cheng Yang, Chen Qian, Zhiyuan Liu, Maosong Sun

机构 * Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Tsinghua University(清华大学) King’s College London(伦敦大学国王学院) Peng Cheng Laboratory(鹏城实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出通过建立协作收益度量(Γ)和因素归因范式,推动多智能体系统从盲目试错向严谨科学转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06039 2026-02-06 cs.AI 88%

DyTopo: Dynamic Topology Routing for Multi-Agent Reasoning via Semantic Matching

DyTopo:通过语义匹配实现多智能体推理的动态拓扑路由

Yuxing Lu, Yucheng Hu, Xukai Zhao, Jiuxin Cao

机构 * Peking University, Beijing, China(北京大学) Georgia Institute of Technology, Atlanta, United States(佐治亚理工学院) Southeast University, Location, Country(东南大学) Tsinghua University(清华大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 DyTopo通过语义匹配实现多智能体推理的动态拓扑路由,提升多轮推理性能并提供可解释的协调轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05586 2026-02-06 eess.SY cs.SY 88%

Observer-based Control of Multi-agent Systems under STL Specifications

基于观测器的多智能体系统在STL规范下的控制

Tommaso Zaccherini, Siyuan Liu, Dimos V. Dimarogonas

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出基于观测器的去中心化控制器,用于满足STL规范的多智能体系统,在考虑状态估计误差的情况下确保任务满足。

Comments This paper has been submitted for consideration to the 23rd IFAC World Congress

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05004 2026-02-06 cs.CL cs.AI 87%

CoWork-X: Experience-Optimized Co-Evolution for Multi-Agent Collaboration System

CoWork-X:面向多智能体协作系统的经验优化共进化

Zexin Lin, Jiachen Yu, Haoyang Zhang, Yuzhao Li, Zhonghang Li, Yujiu Yang, Junjie Wang, Xiaoqiang Ji

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)科学与工程学院) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)人工智能学院) Tsinghua University(清华大学) AutoGame Research(AutoGame研究) Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人研究院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI、cs.CL

AI总结 CoWork-X通过主动共进化框架,优化多智能体协作系统的实时协调与多轮适应,实现稳定性能提升和降低延迟与令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02276 2026-02-06 cs.LG cs.AI cs.CL q-bio.QM 87%

CellForge: Agentic Design of Virtual Cell Models

CellForge: 虚拟细胞模型的代理设计

Xiangru Tang, Zhuoyun Yu, Jiapeng Chen, Yan Cui, Daniel Shao, Weixu Wang, Fang Wu, Yuchen Zhuang, Wenqi Shi, Zhi Huang, Arman Cohan, Xihong Lin, Fabian Theis, Smita Krishnaswamy, Mark Gerstein

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 CellForge通过多代理协作自主设计虚拟细胞模型,生成高竞争力的计算方法,推动计算生物学的自主科学方法开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20900 2026-02-06 cs.CL 85%

Learning to Summarize by Learning to Quiz: Adversarial Agentic Collaboration for Long Document Summarization

通过学习提问来学习总结:对抗性代理协作用于长文档摘要

Weixuan Wang, Minghao Wu, Barry Haddow, Alexandra Birch

机构 * School of Informatics, University of Edinburgh(信息学院,爱丁堡大学) Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 SummQ通过对抗性代理协作提升长文档摘要质量,利用生成和评审代理以及问题生成机制实现摘要的迭代优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18238 2026-02-06 cs.CY cs.AI 83%

Collaborating with AI Agents: Field Experiments on Teamwork, Productivity, and Performance

与AI代理合作:关于团队合作、生产率和表现的实地实验

Harang Ju, Sinan Aral

机构 * Johns Hopkins Carey Business School(约翰霍普金斯 Carey 商学院) MIT Sloan School of Management(麻省理工 Sloan 管理学院)

专题命中 多智能体 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本研究通过实地实验发现,人类与AI合作能提升广告生产率和质量,通过任务导向沟通、委托工作和识别AI合作者三种机制实现。

Comments 59 pages, 3 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05987 2026-02-06 cs.HC 82%

From Human-Human Collaboration to Human-Agent Collaboration: A Vision, Design Philosophy, and an Empirical Framework for Achieving Successful Partnerships Between Humans and LLM Agents

从人与人协作到人与智能体协作:一种愿景、设计哲学和实现人与LLM智能体成功合作的实证框架

Bingsheng Yao, Chaoran Chen, April Yi Wang, Sherry Tongshuang Wu, Toby Jia-jun Li, Dakuo Wang

专题命中 多智能体 :agent(title,abstract);AI agent(abstract)

AI总结 本文提出通过借鉴远程人类协作的研究来设计和研究人与LLM智能体的合作,建立新的协作范式和研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04912 2026-02-06 cs.IR cs.CL cs.LG 73%

Atomic Information Flow: A Network Flow Model for Tool Attributions in RAG Systems

原子信息流:一种用于RAG系统工具归因的网络流模型

James Gao, Josh Zhou, Qi Sun, Ryan Huang, Steven Yoo

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 原子信息流通过分解工具输出和LLM调用为原子单元,提升RAG系统中工具归因的准确性和上下文压缩效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05803 2026-02-06 eess.SY cs.SY 67%

Privacy-Preserving Dynamic Average Consensus by Masking Reference Signals

通过掩码参考信号实现隐私保护的动态平均一致性

Mihitha Maithripala, Zongli Lin

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种通过掩码参考信号实现隐私保护的动态平均一致性方法,该方法在保持收敛性能的同时保护参考信号隐私。

Comments Accepted at ACC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05011 2026-02-06 math.OC cs.SY eess.SY 67%

Banach Control Barrier Functions for Large-Scale Swarm Control

Banach控制屏障函数用于大规模群体控制

Xuting Gao, Guillem Pascual, Scott Brown, Sonia Martínez

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出基于Banach控制屏障函数的框架,用于安全控制大规模群体系统,通过定义稳定梯度流和最优传输算法,实现与宏观目标一致的分布式解决方案。

Comments Accepted by IEEE ACC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11300 2026-02-06 cs.HC cs.AI 57%

Beyond touch-based human-machine interface: Control your machines in natural language by utilizing large language models and OPC UA

超越基于触控的人机界面:通过利用大语言模型和OPC UA控制机器

Bernd Hofmann, Niklas Piechulek, Sven Kreitlein, Joerg Franke, Patrick Bruendl

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 利用大语言模型和OPC UA实现自然语言控制机器,通过工具调用提升工业人机交互的自然度。

详情

展开后加载摘要…

URL PDF HTML 收藏