arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-02 至 2026-02-02 共收录 107 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 40 篇

2601.21706 2026-02-02 cs.LG cs.SY eess.SY 57%

SmartMeterFM: Unifying Smart Meter Data Generative Tasks Using Flow Matching Models

SmartMeterFM: 通过流匹配模型统一智能电表数据生成任务

Nan Lin, Yanbo Wang, Jacco Heres, Peter Palensky, Pedro P. Vergara

机构 * Delft University of Technology(代尔夫特理工大学) Alliander N.V.(Alliander公司)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出通过流匹配模型统一智能电表数据生成任务,解决数据缺失和分辨率不足问题,提升生成数据的现实性和效率。

Comments 10 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.02662 2026-02-02 cs.LG 57%

Grounding Large Language Models in Interactive Environments with Online Reinforcement Learning

通过在线强化学习将大语言模型接地于交互环境

Thomas Carta, Clément Romac, Thomas Wolf, Sylvain Lamprier, Olivier Sigaud, Pierre-Yves Oudeyer

机构 * Inria (Flowers)(Inria(Flowers)) University of Bordeaux(波尔多大学) Hugging Face Univ Angers, LERIA, SFR MATHSTIC(昂热大学,LERIA,SFR MATHSTIC) Sorbonne Université(索邦大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出GLAM方法,通过在线强化学习将大语言模型接地于交互环境,以提升样本效率和泛化能力,并探讨在线学习的影响。

Comments The associated code can be found at https://github.com/flowersteam/Grounding_LLMs_with_online_RL. This is an extended version of the paper published at ICML 2023: https://proceedings.mlr.press/v202/carta23a

Journal ref PMLR 202 (2023):3676-3713

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.09861 2026-02-02 cs.AI cs.GT cs.MA cs.RO 57%

Generalized dynamic cognitive hierarchy models for strategic driving behavior

通用动态认知层次模型用于战略驾驶行为

Atrisha Sarkar, Kate Larson, Krzysztof Czarnecki

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出通用动态认知层次模型,用于建模自然驾驶行为和自动驾驶车辆的行为规划,通过自动机策略和稳健响应解决有限理性和共同知识假设问题。

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 36(5), 5173-5182 (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22662 2026-02-02 cs.AI cs.MA 57%

Task-Aware LLM Council with Adaptive Decision Pathways for Decision Support

具有自适应决策路径的任务感知大语言模型委员会用于决策支持

Wei Zhu, Lixing Yu, Hao-Ren Yao, Zhiwen Tang, Kun Yue

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 TALC通过任务感知的LLM委员会和自适应决策路径,提升决策支持任务的成功率和搜索效率。

Comments A shorter version of this work has been accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22512 2026-02-02 cs.LG 57%

DRL-Enabled Trajectory Planing for UAV-Assisted VLC: Optimal Altitude and Reward Design

基于深度强化学习的无人机辅助可见光通信轨迹规划:最优高度与奖励设计

Tian-Tian Lin, Yi Liu, Xiao-Wei Tang, Yunmei Shi, Yi Huang, Zhongxiang Wei, Qingqing Wu, Yuhan Dong

机构 * Department of Information and Communication Engineering, Tongji University(信息与通信工程系,同济大学) Department of Electronic Engineering, Shanghai Jiao Tong University(电子工程系,上海交通大学) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出基于深度强化学习的无人机辅助可见光通信轨迹规划方法,通过优化无人机飞行高度和奖励机制,显著提高数据收集效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27410 2026-02-02 cs.AI 57%

Closing the Expression Gap in LLM Instructions via Socratic Questioning

通过苏格拉底提问缩小LLM指令的表达差距

Jianwen Sun, Yukang Feng, Yifan Chang, Chuanhao Li, Zizhen Li, Jiaxin Ai, Fanrui Zhang, Yu Dai, Kaipeng Zhang

机构 * Nankai University(南开大学) Shanghai Innovation Institute(上海创新研究院) Wuhan University(武汉大学) Shanghai AI Laboratory(上海人工智能实验室) Shanda AI Research(上海沙达人AI研究所)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 通过苏格拉底提问方法,提出Nous代理以主动探测用户意图,解决人类与AI协作中的意图表达差距问题,提升效率和输出质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12657 2026-02-02 cs.CL 57%

Synthetic Socratic Debates: Examining Persona Effects on Moral Decision and Persuasion Dynamics

合成苏格拉底辩论:考察人格对道德决策与说服动态的影响

Jiarui Liu, Yueqi Song, Yunze Xiao, Mingqian Zheng, Lindia Tjuatja, Jana Schaich Borg, Mona Diab, Maarten Sap

机构 * Carnegie Mellon University(卡内基梅隆大学) Duke University(杜克大学)

专题命中 规划决策 :AI agent(abstract);分类 cs.CL

AI总结 本文通过模拟AI-AI辩论研究人格对道德决策和说服效果的影响,发现政治意识形态和性格特质对辩论结果影响最大,且随着辩论进行,论证趋于温和。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23127 2026-02-02 cs.HC 50%

"I Choose to Live, for Life Itself": Understanding Agency of Home-Based Care Patients Through Information Practices and Relational Dynamics in Care Networks

我选择为生命本身而活:通过信息实践和护理网络中的关系动态来理解居家护理患者的自主性

Sung-In Kim, Joonyoung Park, Bogoan Kim, Hwajung Hong

专题命中 规划决策 :planning(abstract)

AI总结 本文通过信息实践和关系动态研究,揭示居家护理中患者自主性的表现及其形成机制,并提出设计策略以改善共享护理计划中患者自主性的体现。

Comments Accepted by ACM CHI 2026; 16 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22849 2026-02-02 cs.RO math.OC 50%

Robust Rigid Body Assembly via Contact-Implicit Optimal Control with Exact Second-Order Derivatives

通过接触隐式最优控制实现稳健刚体装配

Christian Dietz, Sebastian Albrecht, Gianluca Frison, Moritz Diehl, Armin Nurkanović

机构 * Autonomous Systems and Control, Siemens AG, Germany(自动化系统与控制,西门子股份有限公司,德国) Department of Microsystems Engineering (IMTEK), University of Freiburg, Germany(微系统工程系(IMTEK),弗赖堡大学,德国) Department of Mathematics, University of Freiburg, Germany(数学系,弗赖堡大学,德国)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种基于接触隐式最优控制的稳健刚体装配方法,通过高效利用导数信息减少物理模拟步骤,实现实验中99%的成功率。

Comments Submitted to Transactions on Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22782 2026-02-02 stat.ME 50%

Optimal Sample Splitting for Observational Studies

观测研究中的最优样本分割

Qishuo Yin, Dylan S. Small

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种基于plasmode数据集的方法,用于确定观测研究中最优样本分割比例,以减少偏倚敏感性,并应用于研究儿童接触二手烟的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01987 2026-02-02 cs.RO cs.CV 50%

CaLiV: LiDAR-to-Vehicle Calibration of Arbitrary Sensor Setups

CaLiV:任意传感器配置的LiDAR到车辆校准

Ilir Tahiraj, Markus Edinger, Dominik Kulmer, Markus Lienkamp

机构 * Technical University of Munich(慕尼黑技术大学)

专题命中 规划决策 :planning(abstract)

AI总结 CaLiV提出了一种基于目标的校准技术,用于多LiDAR系统的传感器到传感器和传感器到车辆的校准,适用于非重叠视野范围,无需外部设备,实现了高精度的平移和旋转误差校正。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22576 2026-02-02 eess.IV cs.CV 50%

Bonnet: Ultra-fast whole-body bone segmentation from CT scans

Bonnet: 从CT扫描中快速完成全身骨骼分割

Hanjiang Zhu, Pedro Martelleto Rezende, Zhang Yang, Tong Ye, Bruce Z. Gao, Feng Luo, Siyu Huang, Jiancheng Yang

机构 * ELLIS Institute Finland(埃利斯研究所芬兰分校) Aalto University(艾尔沃斯大学) Clemson University(克莱姆森大学) ETH Zurich(苏黎世联邦理工学院) Fujian Medical University Union Hospital(福建省医科大学附属医院) Fujian Medical University(福建省医科大学)

专题命中 规划决策 :planning(abstract)

AI总结 Bonnet通过高效算法在2.69秒内实现全身骨骼分割,准确度高且速度快。

Comments 5 pages, 2 figures. Accepted for publication at the 2026 IEEE International Symposium on Biomedical Imaging (ISBI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22405 2026-02-02 math.OC 50%

Visibility in Polygonal Environments with Holes: Finding Best Spots for Hiding and Surveillance

多孔多边形环境中可见性研究:寻找最佳隐藏与监视位置

Neilabh Banzal, Jorge Cortés, Sonia Martínez

专题命中 规划决策 :agent(abstract)

AI总结 本文提出了一种归一化下降算法,用于在多孔多边形环境中寻找最优隐藏或监视位置,通过非光滑分析和随机性处理非凸度量问题,确保高概率收敛到局部极小值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20275 2026-02-02 cs.RO 50%

HAFO: A Force-Adaptive Control Framework for Humanoid Robots in Intense Interaction Environments

HAFO:一种适用于高强度交互环境的人形机器人力自适应控制框架

Chenhui Dong, Haozhe Xu, Wenhao Feng, Zhipeng Wang, Yanmin Zhou, Yifei Zhao, Bin He

机构 * Frontiers Science Center for Intelligent Autonomous Systems, Tongji University(智能自主系统前沿科学中心,同济大学) National Key Laboratory of Autonomous Intelligent Unmanned Systems(自主智能无人系统国家重点实验室) Department of Control Science and Engineering, College of Electronics and Information Engineering, Tongji University(控制科学与工程系,电子信息工程学院,同济大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 规划决策 :agent(abstract)

AI总结 HAFO通过双智能体强化学习框架实现人形机器人在高强度交互环境中的鲁棒运动与精确操作控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21054 2026-02-02 physics.med-ph 50%

Predictive Dosimetry in PSMA-Targeted Radiopharmaceutical Therapies: A PBPK Modeling and Machine Learning Study

PSMA靶向放射性药剂治疗中的预测剂量学:一种基于生理药动学建模和机器学习的研究

Hamid Abdollahi, James Fowler, Carlos Uribe, Arman Rahmim

专题命中 规划决策 :planning(abstract)

AI总结 本研究提出基于PBPK和机器学习的框架,用于预测PSMA靶向放射性药剂治疗中的剂量学终点,通过PET数据实现个性化治疗规划。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 14 篇

2509.21981 2026-02-02 cs.AI cs.MA 90%

Collaborative Belief Reasoning with LLMs for Efficient Multi-Agent Collaboration

基于LLM的协同信念推理用于高效多智能体协作

Zhimin Wang, Duo Wu, Shaokang He, Jinghe Wang, Linjia Kang, Jing Yu, Kai Zhu, Jiawei Li, Zhi Wang

机构 * Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Huawei Tenchnologies Co., Ltd.(华为技术有限公司) University of Science and Technology of China(中国科学技术大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);planning(abstract)

AI总结 CoBel-World通过协同信念世界框架,提升LLM多智能体协作的效率和人类化表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23009 2026-02-02 cs.SE 89%

SolAgent: A Specialized Multi-Agent Framework for Solidity Code Generation

SolAgent: 一种专门用于Solidity代码生成的多智能体框架

Wei Chen, Zhiyuan Peng, Xin Yin, Chao Ni, Chenhao Ying, Bang Xie, Yuan Luo

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.SE

AI总结 SolAgent通过双循环机制和文件系统能力,在智能合约生成中实现高正确性和安全性,Pass@1率达64.39%,减少安全漏洞39.77%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05005 2026-02-02 cs.LG cs.AI cs.RO 88%

Multi-agent Coordination via Flow Matching

通过流匹配实现多智能体协调

Dongsu Lee, Daehee Lee, Amy Zhang

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Sungkyunkwan University(松均大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 MAC-Flow通过流匹配方法实现多智能体协调,平衡了性能与计算效率,显著提升推理速度的同时保持良好表现。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22974 2026-02-02 cs.ET cs.CL 88%

MiTa: A Hierarchical Multi-Agent Collaboration Framework with Memory-integrated and Task Allocation

MiTa: 一种具有内存集成和任务分配的分层多智能体协作框架

XiaoJie Zhang, JianHan Wu, Xiaoyang Qu, Jianzong Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国) Ping An Technology (Shenzhen) Co., Ltd., Shenzhen, China(平安科技(深圳)有限公司,深圳,中国)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 MiTa通过分层结构和内存整合提升多智能体协作效率,实现全局任务分配与片段记忆整合。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22386 2026-02-02 cs.CL cs.MA 88%

Specialists or Generalists? Multi-Agent and Single-Agent LLMs for Essay Grading

专家还是通才?多智能体与单智能体LLM用于作文评分

Jamiu Adekunle Idowu, Ahmed Almasoud

机构 * Sahel AI, Sahel Group Inc.(Sahel AI,Sahel Group Inc.) University College London (UCL)(University College London(UCL)) Prince Sultan University

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 本文比较了多智能体与单智能体LLM在作文评分中的表现,发现多智能体系统在识别弱作文方面更优,而单智能体系统在中等质量作文上表现更好,少样本校准对性能影响显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22209 2026-02-02 cs.MA cs.AI 88%

Learning to Recommend Multi-Agent Subgraphs from Calling Trees

从调用树中学习推荐多智能体子图

Xinyuan Song, Liang Zhao

机构 * Department of Computer Science, Emory University, USA(计算机科学系,埃默里大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于约束决策的多智能体推荐框架,利用历史调用树优化代理选择,支持代理级和系统级推荐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22168 2026-02-02 q-fin.RM cs.AI cs.CR q-fin.CP 88%

Stablecoin Design with Adversarial-Robust Multi-Agent Systems via Trust-Weighted Signal Aggregation

通过对抗鲁棒多智能体系统进行稳定币设计:基于信任加权信号聚合

Shengwei You, Aditya Joshi, Andrey Kuehlkamp, Jarek Nabrzyski

机构 * University of Notre Dame(诺丁汉大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 MVF-Composer通过多智能体模拟和信任加权信号聚合,提升稳定币在对抗性压力下的稳定性,减少汇率偏离和恢复时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15172 2026-02-02 cs.AI 88%

Self-Improvement of Language Models by Post-Training on Multi-Agent Debate

通过多智能体辩论进行语言模型的自改进

Ankur Samanta, Akshayaa Magesh, Runzhe Wu, Ayush Jain, Youliang Yu, Daniel Jiang, Boris Vidolov, Paul Sajda, Yonathan Efroni, Kaveh Hassani

机构 * Meta AI Columbia University(哥伦比亚大学) Meta Superintelligence Labs(Meta超智能实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 通过多智能体辩论和强化学习提升语言模型的自我改进能力,实现推理准确性、自洽性和泛化能力的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23211 2026-02-02 cs.MA 88%

Multi-Agent Systems Should be Treated as Principal-Agent Problems

多智能体系统应被视为委托-代理问题

Paulius Rauba, Simonas Cepenas, Mihaela van der Schaar

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出将多智能体系统视为委托-代理问题,探讨信息不对称和目标不一致对系统行为的影响,并通过谋略现象分析其缓解策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08129 2026-02-02 cs.MA 88%

Emergent Coordination in Multi-Agent Systems via Pressure Fields and Temporal Decay

通过压力场和时间衰减实现多智能体系统中的涌现协调

Roland Rodriguez

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 该研究提出通过压力场和时间衰减实现多智能体系统的隐式协调,优于传统显式控制方法,提升了任务解决效率。

Comments 64 pages, 5 figures, 12 tables. Code available at https://github.com/Govcraft/pressure-field-experiment

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21879 2026-02-02 cs.AI cs.MA 86%

astra-langchain4j: Experiences Combining LLMs and Agent Programming

astra-langchain4j: 结合大语言模型与代理编程的经验

Rem Collier, Katharine Beaumont, Andrei Ciortea

机构 * School of Computer Science, University College Dublin, Ireland(都柏林大学计算机科学学院) School of Computer Science, University of St.Gallen, St. Gallen, Switzerland(圣加尔登大学计算机科学学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract,journal_ref);agentic(abstract);分类 cs.AI

AI总结 本文介绍了将大语言模型与Astra编程语言结合的实践经验,探讨了传统代理工具包对新代理平台设计的影响。

Journal ref Proceedings of the 22nd European Conference on Multi-Agent Systems, Bucharest Romania, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03072 2026-02-02 cs.AI 70%

Preference-based opponent shaping in differentiable games

基于偏好的对手塑造在可微游戏中的应用

Xinyu Qiao, Yudong Hu, Congying Han, Weiyan Wu, Tiande Guo

机构 * University of Chinese Academy of Science(中国科学院大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出基于偏好的对手塑造方法,通过塑造智能体对合作的偏好,提升多智能体游戏中的策略学习效率和泛化能力。

Journal ref Mach Learn 114, 292 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23126 2026-02-02 cs.GT cs.CG 67%

Greedy Routing Reachability Games

贪心路由可达性游戏

Pascal Lenzner, Paraskevi Machaira

专题命中 多智能体 :agent(abstract);autonomous agent(abstract)

AI总结 本文研究了自主代理在形成贪心路由网络时的博弈模型,分析了定向和无向边两种情况下的均衡性质及计算复杂性,并展示了在二维欧几里得空间中贪心路由的近似均衡性能优于德劳内三角剖分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27647 2026-02-02 cs.CV 50%

NegoCollab: A Common Representation Negotiation Approach for Heterogeneous Collaborative Perception

NegoCollab: 一种用于异构协作感知的共同表示协商方法

Congzhang Shao, Quan Yuan, Guiyang Luo, Yue Hu, Danni Wang, Yilin Liu, Rui Pan, Bo Chen, Jinglin Li

专题命中 多智能体 :agent(abstract)

AI总结 NegoCollab通过协商共同表示方法解决异构协作感知中的领域差距问题,提升多智能体协作性能。

Comments 23 pages, Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 工作流自动化 11 篇

2601.22305 2026-02-02 cs.LG 86%

BayesFlow: A Probability Inference Framework for Meta-Agent Assisted Workflow Generation

BayesFlow: 一个用于元代理辅助工作流生成的概率推断框架

Bo Yuan, Yun Zhou, Zhichao Xu, Kiran Ramnath, Aosong Feng, Balasubramaniam Srinivasan

机构 * Georgia Institute of Technology(佐治亚理工学院) Amazon Web Services AI Lab(亚马逊网络服务人工智能实验室)

专题命中 工作流自动化 :workflow(title,abstract);agent(title);分类 cs.LG

AI总结 BayesFlow通过贝叶斯推断和并行前瞻滚动实现工作流生成的原理性改进,提升准确性达9-65个百分点。

Comments EACL 2026 Finding

详情

展开后加载摘要…

URL PDF HTML 收藏