arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-12 至 2026-02-12 共收录 100 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 40 篇

2507.10136 2026-02-12 q-bio.QM cs.AI 57%

A PBN-RL-XAI Framework for Discovering a "Hit-and-Run" Therapeutic Strategy in Melanoma

一种用于在黑色素瘤中发现'突击-撤退'治疗策略的PBN-RL-XAI框架

Zhonglin Liu

机构 * Department of Mathematics, The University of Hong Kong(香港大学数学系)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种PBN-RL-XAI框架,通过动态布尔网络和强化学习发现黑色素瘤中'突击-撤退'治疗策略,揭示了抑制LOXL2蛋白的有效机制。

Comments 7 pages, 7 figures. Accepted by the IEEE International Conference on Bioinformatics and Biomedicine (BIBM) 2025. Code is available at https://github.com/Liu-Zhonglin/pbn-melanoma-project

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12365 2026-02-12 cs.CL cs.DB 57%

Advances in LLMs with Focus on Reasoning, Adaptability, Efficiency and Ethics

大语言模型的进展:聚焦推理、适应性、效率和伦理

Asifullah Khan, Muhammad Zaeem Khan, Aleesha Zainab, Saleha Jamshed, Sadia Ahmad, Kaynat Khatib, Faria Bibi, Abdul Rehman

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 本文综述了大语言模型在推理、适应性、效率和伦理方面的进展,探讨了关键技术和挑战,提出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04534 2026-02-12 cs.LG 57%

Hypercube Policy Regularization Framework for Offline Reinforcement Learning

超立方体策略正则化框架用于离线强化学习

Yi Shen, Hanyan Huang

机构 * Sun Yat-Sen University(中山大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出超立方体策略正则化框架,通过允许智能体探索相似状态对应的动作,提升离线强化学习在低质量数据集中的性能。

Comments Revised version accepted at MLMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11124 2026-02-12 cs.CV 50%

PhyCritic: Multimodal Critic Models for Physical AI

PhyCritic:面向物理AI的多模态批评模型

Tianyi Xiong, Shihao Wang, Guilin Liu, Yi Dong, Ming Li, Heng Huang, Jan Kautz, Zhiding Yu

专题命中 规划决策 :planning(abstract)

AI总结 PhyCritic通过双阶段RLVR流程优化,提升物理AI任务中的感知和推理能力,实现对物理任务的高效评估和改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11113 2026-02-12 cs.RO 50%

A receding-horizon multi-contact motion planner for legged robots in challenging environments

面向挑战环境的腿足机器人回溯地平线多接触运动规划器

Daniel S. J. Derwent, Simon Watson, Bruno V. Adorno

机构 * Manchester Centre for Robotics and AI(机器人与人工智能中心) University of Manchester(曼彻斯特大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种新型回溯地平线多接触运动规划器,用于在挑战性环境中为腿足机器人规划运动,提升了规划效率和质量。

Comments Submitted to Robotics and Autonomous Systems For supplementary video, see https://www.youtube.com/watch?v=RJp8DCmhDa4

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10884 2026-02-12 cs.CV 50%

ResWorld: Temporal Residual World Model for End-to-End Autonomous Driving

ResWorld: 用于端到端自动驾驶的时序残差世界模型

Jinqing Zhang, Zehua Fu, Zelin Xu, Wenying Dai, Qingjie Liu, Yunhong Wang

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University, Beijing, China(虚拟现实技术与系统国家重点实验室,北京航空航天大学) Zhongguancun Laboratory, Beijing, China(中关村实验室) Beijing Jingwei Hirain Technologies Co., Inc.(北京京wei Hirain科技有限公司) Hangzhou Innovation Institute, Beihang University, Hangzhou, China(杭州创新研究院,北京航空航天大学)

专题命中 规划决策 :planning(abstract)

AI总结 ResWorld通过时序残差世界模型和未来引导轨迹细化模块,提升端到端自动驾驶的规划性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04683 2026-02-12 cs.SD 50%

UniAudio 2.0: A Unified Audio Language Model with Text-Aligned Factorized Audio Tokenization

UniAudio 2.0:一种具有文本对齐因子化音频标记化的统一音频语言模型

Dongchao Yang, Yuanyuan Wang, Dading Chong, Songxiang Liu, Xixin Wu, Helen Meng

机构 * The Chinese University of Hong Kong, China(香港中文大学)

专题命中 规划决策 :planning(abstract)

AI总结 UniAudio 2.0通过引入ReasoningCodec和统一自回归架构,实现了文本对齐的因子化音频标记化,提升了音频理解和生成性能,并在多种任务中展现了强大的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10559 2026-02-12 cs.RO 50%

Towards Safe Path Tracking Using the Simplex Architecture

基于简单形架构的安全路径跟踪

Georg Jäger, Nils-Jonathan Friedrich, Hauke Petersen, Benjamin Noack

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于简单形架构的路径跟踪控制器,结合强化学习和高保证控制器,以实现安全性和高性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10736 2026-02-12 eess.SP 50%

Transfer to Sky: Unveil Low-Altitude Route-Level Radio Maps via Ground Crowdsourced Data

天空转移:通过地面众包数据揭示低空路线级无线电地图

Wenlihan Lu, Huacong Chen, Ruiyang Duan, Weijie Yuan, Shijian Gao

专题命中 规划决策 :planning(abstract)

AI总结 本文提出利用地面众包数据和模拟学习,通过转移学习框架提升低空路线级无线电地图预测的准确性,实验表明其在预测RSRP方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10656 2026-02-12 eess.AS cs.SD 50%

AudioRAG: A Challenging Benchmark for Audio Reasoning and Information Retrieval

AudioRAG:一个用于音频推理和信息检索的挑战性基准

Jingru Lin, Chen Zhang, Tianrui Wang, Haizhou Li

专题命中 规划决策 :agentic(abstract)

AI总结 AudioRAG是一个用于评估音频推理和信息检索能力的挑战性基准,通过整合检索增强生成技术,为未来研究提供更强大的基准。

Comments Accepted by Audio-AAAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10561 2026-02-12 cs.RO 50%

Morphogenetic Assembly and Adaptive Control for Heterogeneous Modular Robots

形态生成与自适应控制用于异构模块化机器人

Chongxi Meng, Da Zhao, Yifei Zhao, Minghao Zeng, Yanmin Zhou, Zhipeng Wang, Bin He

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University, Shanghai, China(上海智能自主系统研究院,同济大学,上海,中国) Department of Mechanical and Automation Engineering and T Stone Robotics Institute, The Chinese University of Hong Kong, Hong Kong(机械与自动化工程系和T Stone机器人研究院,香港中文大学,香港)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种闭环自动化框架,用于异构模块化机器人,通过分层规划和退火-方差MPPI控制器实现高效动态组装与实时运动控制。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10526 2026-02-12 cs.CY cs.SY eess.SY 50%

The Infrastructure Equation: Water, Energy, and Community Policy for Georgia's Data Center Boom

基础设施方程:佐治亚州数据中心热潮的水资源、能源与社区政策

Mickey M. Rogers, William M. Ota, Nathaniel Burola, Tepring Piquado

专题命中 规划决策 :planning(abstract)

AI总结 本报告探讨佐治亚州数据中心发展对水资源、能源和社区的影响,提出政策路线图以平衡基础设施增长与可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09849 2026-02-12 cs.RO 50%

BagelVLA: Enhancing Long-Horizon Manipulation via Interleaved Vision-Language-Action Generation

BagelVLA: 通过交错视觉-语言-动作生成增强长时程操作

Yucheng Hu, Jianke Zhang, Yuanfei Luo, Yanjiang Guo, Xiaoyu Chen, Xinshu Sun, Kun Feng, Qingzhou Lu, Sheng Chen, Yangang Zhang, Wei Li, Jianyu Chen

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :planning(abstract)

AI总结 BagelVLA通过整合语言规划、视觉预测和动作生成,提升复杂长时程操作任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00244 2026-02-12 eess.SY cs.SY physics.ao-ph 50%

Multi-threshold time series analysis enables characterization of variable renewable energy droughts in Europe

多阈值时间序列分析有助于表征欧洲可变可再生能源干旱

Martin Kittel, Wolf-Peter Schill

专题命中 规划决策 :planning(abstract)

AI总结 本文通过多阈值分析表征欧洲可变可再生能源干旱,揭示风能与太阳能互补性对缓解干旱的影响,为能源系统规划提供关键参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18976 2026-02-12 cs.CY cs.SI 50%

Prioritizing Risk Factors in Media Entrepreneurship on Social Networks: Hybrid Fuzzy Z-Number Approaches for Strategic Budget Allocation and Risk Management in Advertising Construction Campaigns

社交媒体上媒体创业的风险因素优先级:用于广告建设活动战略预算分配和风险管理的混合模糊Z数方法

Ahmad Gholizadeh Lonbar, Hamidreza Hasanzadeh, Fahimeh Asgari, Elham Khamoushi, Hajar Kazemi Naeini, Roya Shomali, Saeed Asadi

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种基于Z数理论的混合模糊方法,用于优化社交媒体广告活动的预算分配和风险管理。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 13 篇

2602.10514 2026-02-12 cs.RO cs.AI cs.LG 88%

Co-jump: Cooperative Jumping with Quadrupedal Robots via Multi-Agent Reinforcement Learning

Co-jump: 通过多智能体强化学习实现四足机器人协同跳跃

Shihao Dong, Yeke Chen, Zeren Luo, Jiahui Zhang, Bowen Xu, Jinghan Lin, Yimin Han, Ji Ma, Zhiyou Yu, Yudong Zhao, Peng Lu

机构 * Adaptive Robotic Controls Lab (ArcLab), Department of Mechanical Engineering, University of Hong Kong(香港大学机械工程系自适应机器人控制实验室) EngineAI

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究通过多智能体强化学习实现四足机器人协同跳跃,显著提升垂直跳跃能力,无需显式通信或预设运动原语。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11076 2026-02-12 eess.SY cs.AI cs.SY eess.SP 88%

Interpretable Attention-Based Multi-Agent PPO for Latency Spike Resolution in 6G RAN Slicing

可解释的基于注意力的多智能体PPO用于6G RAN切片中的延迟尖峰解决

Kavan Fatehi, Mostafa Rahmani Ghourtani, Amir Sonee, Poonam Yadav, Alessandra M Russo, Hamed Ahmadi, Radu Calinescu

机构 * University of York, UK(约克大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出AE-MAPPO,通过整合六个注意力机制,实现6G RAN切片中延迟尖峰的快速诊断与高效解决,兼具SLA合规性和可解释性。

Comments This work has been accepted to appear in the IEEE International Conference on Communications (ICC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24303 2026-02-12 cs.AI 88%

Retrieval- and Argumentation-Enhanced Multi-Agent LLMs for Judgmental Forecasting (Extended Version with Supplementary Material)

检索与论证增强的多智能体大语言模型用于判断性预测(含补充材料)

Deniz Gorur, Antonio Rago, Francesca Toni

机构 * Imperial College London(帝国理工学院伦敦分校) King's College London(国王学院伦敦分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出一种多智能体框架,结合检索与论证增强技术,提升判断性预测的准确性与可解释性。

Comments 24 pages, 3 figures, Accepted to AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10685 2026-02-12 cs.MA cs.LG 88%

Beyond Task Performance: A Metric-Based Analysis of Sequential Cooperation in Heterogeneous Multi-Agent Destructive Foraging

超越任务表现:基于度量的异构多智能体破坏性觅食中序列合作分析

Alejandro Mendoza Barrionuevo, Samuel Yanes Luis, Daniel Gutiérrez Reina, Sergio L. Toral Marín

机构 * Department of Electronic Engineering, University of Sevilla(电子工程系,塞维利亚大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出一套通用合作度量标准,用于分析异构多智能体在破坏性觅食中的序列合作,涵盖效率、协调、依赖、公平性及敏感性,通过现实场景验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10186 2026-02-12 cs.MA cs.AI cs.GT math.DS 88%

Convergence and Connectivity: Dynamics of Multi-Agent Q-Learning in Random Networks

收敛与连通性:多智能体Q学习在随机网络中的动态

Dan Leonte, Aamal Hussain, Raphael Huser, Francesco Belardinelli, Dario Paccagnan

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文研究了多智能体Q学习在随机网络中的收敛与连通性问题,通过分析Erdős-Rényi和Stochastic Block模型,探讨了智能体交互概率、探索率和收益矩阵对收敛条件的影响,并通过模拟验证了网络交互控制对收敛的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02437 2026-02-12 stat.ML cs.LG 88%

Decentralized Reinforcement Learning for Multi-Agent Multi-Resource Allocation via Dynamic Cluster Agreements

通过动态聚类协议实现多智能体多资源分配的去中心化强化学习

Antonio Marino, Esteban Restrepo, Claudio Pacchierotti, Paolo Robuffo Giordano

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出了一种基于动态聚类的去中心化强化学习方法,用于多智能体多资源分配问题,实现了更稳定和鲁棒的协调性能。

Journal ref IEEE Robotics and Automation Letters, 2025, 10 (8), pp.8123-8130

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10523 2026-02-12 eess.SY cs.SY 88%

Scale-Free delta-Level Coherent Output Synchronization of Multi-Agent Systems with Adaptive Protocols and Bounded Disturbances

无标度delta级协同输出同步的多智能体系统:自适应协议与有界扰动

Anton A. Stoorvogel, Ali Saberi, Donya Nojavanzadeh

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出了一种基于智能体模型的自适应协议,用于在有界扰动下实现多智能体系统的无标度delta级协同输出同步。

Comments This paper is now submitted to the "International Journal of Robust and Nonlinear Control."

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13553 2026-02-12 cs.MA cs.AI cs.CL 73%

LLM-Mediated Guidance of MARL Systems

基于大语言模型的多智能体强化学习系统引导

Philipp D. Siedler, Ian Gemp

机构 * Aleph Alpha Research(Aleph Alpha研究机构) Google DeepMind(谷歌DeepMind)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出利用大语言模型介导的干预,通过自然语言和规则控制器提升多智能体强化学习系统的训练效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10937 2026-02-12 cs.AI cs.CL cs.MA 73%

SCALE: Towards Collaborative Content Analysis in Social Science with Large Language Model Agents and Human Intervention

SCALE:基于大语言模型代理和人工干预的社会科学研究内容分析

Chengshuai Zhao, Zhen Tan, Chau-Wai Wong, Xinyan Zhao, Tianlong Chen, Huan Liu

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 SCALE通过大语言模型代理和人工干预,实现了社会科学中复杂内容分析的高效模拟与提升。

Comments Accepted by the Annual Meeting of the Association for Computational Linguistics (ACL) 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11057 2026-02-12 cs.LG 70%

Divide, Harmonize, Then Conquer It: Shooting Multi-Commodity Flow Problems with Multimodal Language Models

分割、调和、然后征服:利用多模态语言模型解决多商品流问题

Xinyu Yuan, Yan Qiao, Zonghui Wang, Wenzhi Chen

机构 * Zhejiang University(浙江大学) Hefei University of Technology(合肥工业大学) Co-corresponding authors(共同通讯作者)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 Pram利用多模态语言模型解决多商品流问题,通过分解和调和子问题实现高效优化,性能接近线性规划求解器且运行时间显著降低。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09877 2026-02-12 cs.CL 70%

The Devil Behind Moltbook: Anthropic Safety is Always Vanishing in Self-Evolving AI Societies

Moltbook背后的魔鬼:在自我进化的AI社会中,人类安全始终在消失

Chenxu Wang, Chaozhuo Li, Songyang Liu, Zejian Chen, Jinyu Hou, Ji Qi, Rui Li, Litian Zhang, Qiwei Ye, Zheng Liu, Xu Chen, Xi Zhang, Philip S. Yu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Renmin University of China(中国人民大学) University of Illinois at Chicago(伊利诺伊大学香槟分校)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 研究揭示了自我进化AI社会中安全持续性的不可能性,并提出解决方案以缓解安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10303 2026-02-12 cs.AI cs.GT 70%

Reinforcement Learning in Strategy-Based and Atari Games: A Review of Google DeepMinds Innovations

在策略类和Atari游戏中应用强化学习:谷歌DeepMind创新的综述

Abdelrhman Shaheen, Anas Badr, Ali Abohendy, Hatem Alsaadawy, Nadine Alsayad, Ehab H. El-Shazly

机构 * Computer Science Engineering Undergraduate Student(计算机科学工程本科生) Egypt Japan University of Science and Technology(埃及-日本科学技术大学) Department of Computer Science and Engineering, School of Electronics, Communications and Computer Engineering(计算机科学与工程系,电子、通信与计算机工程学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文综述了谷歌DeepMind在Atari和策略类游戏中应用强化学习的创新,分析了AlphaGo、AlphaGo Zero和MuZero等模型的核心方法及贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10824 2026-02-12 cs.LO cs.MA 67%

Towards Probabilistic Strategic Timed CTL

面向概率策略时序CTL

Wojciech Jamroga, Marta Kwiatkowska, Wojciech Penczek, Laure Petrucci, Teofil Sidoruk

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出PSTCTL,一种概率战略时序CTL变体,用于在随机多智能体系统中进行验证。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 工作流自动化 6 篇

2602.11114 2026-02-12 cs.MA cs.AI cs.LG cs.SE 89%

Learning to Compose for Cross-domain Agentic Workflow Generation

跨领域代理工作流生成中的学习组合

Jialiang Wang, Shengxiang Xu, Hanmo Liu, Jiachuan Wang, Yuyu Luo, Shimin Di, Min-Ling Zhang, Lei Chen

机构 * Hong Kong University of Science and Technology(香港理工大学) Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) Southeast University(东南大学) University of Tsukuba(茨口大学)

专题命中 工作流自动化 :workflow(title,abstract);agentic(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文提出了一种基于分解-重组-决策机制的跨领域代理工作流生成方法,通过学习可重用能力实现单次生成,提升效率并减少迭代成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10999 2026-02-12 cs.AI 79%

CLI-Gym: Scalable CLI Task Generation via Agentic Environment Inversion

CLI-Gym: 通过代理环境反向工程实现可扩展的CLI任务生成

Yusong Lin, Haiyang Wang, Shuzhe Wu, Lue Fan, Feiyang Pan, Sanyuan Zhao, Dandan Tu

机构 * Huawei Technologies Co., Ltd(华为技术有限公司) Beijing Institute of Technology(北京理工大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 CLI-Gym通过代理环境反向工程生成大规模环境密集型任务,LiberCoder在Terminal-Bench上实现46.1%的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏