arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-12 至 2026-02-12 共收录 40 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 40 篇

2602.10479 2026-02-12 cs.SE 87%

From Prompt-Response to Goal-Directed Systems: The Evolution of Agentic AI Software Architecture

从提示-响应到目标导向系统:代理AI软件架构的演变

Mamdouh Alenezi

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文探讨了代理AI从提示-响应到目标导向系统的架构演变,提出了生产级代理的参考架构、多代理拓扑分类及企业加固检查表,强调标准化代理循环和可审计控制机制的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10490 2026-02-12 cs.IR 85%

ChainRec: An Agentic Recommender Learning to Route Tool Chains for Diverse and Evolving Interests

ChainRec: 一个用于路由工具链的代理推荐学习系统,以应对多样化和演变的兴趣

Fuchun Li, Qian Li, Xingyu Gao, Bocheng Pan, Yang Wu, Jun Zhang, Huan Yu, Jie Jiang, Jinsheng Xiao, Hailong Shi

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 ChainRec通过动态选择推理工具的代理推荐系统,提升冷启动和兴趣演变场景下的推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10133 2026-02-12 cs.SE cs.AI 84%

AgentTrace: A Structured Logging Framework for Agent System Observability

AgentTrace: 一种面向智能体系统的结构化日志框架用于可观测性

Adam AlSayyad, Kelvin Yuxiang Huang, Richik Pal

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.SE

AI总结 AgentTrace是一种面向智能体系统的结构化日志框架,旨在通过动态可观测性和遥测功能提升智能体的安全性和可追溯性。

Comments AAAI 2026 Workshop LaMAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10465 2026-02-12 cs.CR cs.AI cs.DC cs.MA 83%

Authenticated Workflows: A Systems Approach to Protecting Agentic AI

认证工作流:保护代理AI的系统方法

Mohan Rajagopalan, Vinay Rao

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出认证工作流,通过密码学和运行时策略结合,实现企业代理AI的确定性安全,有效防护多种安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10122 2026-02-12 cs.CY cs.AI 83%

A Practical Guide to Agentic AI Transition in Organizations

组织中代理AI转型的实用指南

Eranga Bandara, Ross Gore, Sachin Shetty, Sachini Rajapakse, Isurunima Kularathna, Pramoda Karunarathna, Ravi Mukkamala, Peter Foytik, Safdar H. Bouk, Abdul Rahman, Xueping Liang, Amin Hass, Tharaka Hewa, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan

机构 * Old Dominion University(旧 Dominion 大学) Florida International University(佛罗里达国际大学) Nanyang Technological University(南洋理工大学) University of Colombo(科伦坡大学) Center for Wireless Communications, University of Oulu(无线通信中心,奥卢大学) University of Sri Jayewardenepura(斯里贾yenepura大学) Accenture Technology Labs(埃森哲技术实验室)

专题命中 规划决策 :agentic(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出了一种实用框架,帮助组织将手动流程转型为自动化代理AI系统,通过领域驱动用例识别、任务委托给AI代理及人机协同模型实现可持续的自动化与业务价值对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01304 2026-02-12 cs.AI cs.CL 81%

Agentic Jigsaw Interaction Learning for Enhancing Visual Perception and Reasoning in Vision-Language Models

代理拼图交互学习:提升视觉感知与推理能力在视觉-语言模型中

Yu Zeng, Wenxuan Huang, Shiting Huang, Xikun Bao, Yukun Qi, Yiming Zhao, Qiuchen Wang, Lin Chen, Zehui Chen, Huaian Chen, Wanli Ouyang, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) East China Normal University(华东师范大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 AGILE通过代理拼图交互学习提升视觉-语言模型的感知与推理能力,显著提高拼图任务性能并增强多模态模型的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10702 2026-02-12 cs.RO cs.LG cs.SE 81%

A Unified Experimental Architecture for Informative Path Planning: from Simulation to Deployment with GuadalPlanner

信息路径规划的统一实验架构:从仿真到部署的GuadalPlanner

Alejandro Mendoza Barrionuevo, Dame Seck Diop, Alejandro Casado Pérez, Daniel Gutiérrez Reina, Sergio L. Toral Marín, Samuel Yanes Luis

机构 * Department of Electronic Engineering, University of Sevilla(电子工程系,塞维利亚大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG、cs.SE

AI总结 本文提出GuadalPlanner,通过统一架构实现信息路径规划算法在仿真与现实部署间的无缝衔接,支持多种环境和策略,提升算法评估的一致性与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10485 2026-02-12 cs.AI 79%

Abstraction Generation for Generalized Planning with Pretrained Large Language Models

基于预训练大语言模型的通用规划抽象生成

Zhenhe Cui, Huaxiang Xia, Hangjun Shen, Kailun Luo, Yong He, Wei Liang

机构 * Hunan University of Science and Technology(湖南科技大学) Dongguan University of Technology(东莞理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出利用预训练大语言模型生成通用规划的抽象,并通过自动化调试修正抽象,以提升规划效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10365 2026-02-12 cs.RO math.OC 78%

Solving Geodesic Equations with Composite Bernstein Polynomials for Trajectory Planning

利用复合伯恩斯坦多项式求解测地方程用于轨迹规划

Nick Gorman, Gage MacLin, Maxwell Hammond, Venanzio Cichella

机构 * Department of Mechanical Engineering(机械工程系) University of Iowa(爱荷华大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出基于复合伯恩斯坦多项式的轨迹规划方法,用于在复杂环境中生成连续、动态可行的轨迹,适用于多种自主系统。

Comments Accepted for the 2026 IEEE Aerospace Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09447 2026-02-12 cs.SE cs.AI cs.CL 78%

SWE-AGI: Benchmarking Specification-Driven Software Construction with MoonBit in the Era of Autonomous Agents

SWE-AGI:在自主代理时代利用MoonBit进行规范驱动软件构建的基准测试

Zhirui Zhang, Hongbo Zhang, Haoxiang Fei, Zhiyuan Bao, Yubin Chen, Zhengyu Lei, Ziyue Liu, Yixuan Sun, Mingkun Xiao, Zihang Ye, Yu Zhang, Hongcheng Zhu, Yuxiang Wen, Heung-Yeung Shum

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 规划决策 :autonomous agent(title);分类 cs.AI、cs.CL、cs.SE

AI总结 SWE-AGI通过MoonBit评估LLM在规范驱动下的软件构建能力,揭示了AI辅助开发中代码阅读瓶颈及模型性能随任务难度变化的特性。

Comments 20 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15975 2026-02-12 cs.RO 78%

Fast Task Planning with Neuro-Symbolic Relaxation

快速任务规划与神经符号放松

Qiwei Du, Bowen Li, Yi Du, Shaoshu Su, Taimeng Fu, Zitong Zhan, Zhipeng Zhao, Chen Wang

机构 * Spatial AI & Robotics Lab, Department of Computer Science and Engineering, University at Buffalo(空间人工智能与机器人实验室,计算机科学与工程系,布法罗大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 Flax通过结合神经重要性预测与符号扩展,实现快速可靠的复杂环境任务规划。

Comments 8 pages, 6 figures

Journal ref IEEE Robotics and Automation Letters (RA-L), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16814 2026-02-12 cs.LG cs.CL 73%

From Belief Entrenchment to Robust Reasoning in LLM Agents

从信念固化到LLM代理的稳健推理

Jihwan Oh, Minchan Jeong, Jongwoo Ko, Se-Young Yun

机构 * KAIST AI(韩国科学技术院人工智能研究所)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 DReaMAD通过引入多样化推理和动态辩论机制,有效缓解了LLM代理中的信念固化问题,提升了推理准确性与胜率。

Comments Accepted to TACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10910 2026-02-12 cs.RO 71%

Safe mobility support system using crowd mapping and avoidance route planning using VLM

基于人群映射与避让路线规划的安全移动支持系统

Sena Saito, Kenta Tabata, Renato Miyagusuku, Koichi Ozaki

机构 * Graduate School of Regional Development and Creativity, Division of Engineering and Agriculture, Graduate School, Utsunomiya University(乌市大学研究生院区域发展与创意学院,工程与农业系)

专题命中 规划决策 :planning(title)

AI总结 本文提出利用视觉-语言模型和高斯过程回归生成动态人群密度地图,以提升自主机器人在拥挤环境中的安全导航能力。

Journal ref 2025 IEEE International Conference on Real-time Computing and Robotics (RCAR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10771 2026-02-12 cs.CV cs.RO 71%

From Steering to Pedalling: Do Autonomous Driving VLMs Generalize to Cyclist-Assistive Spatial Perception and Planning?

从转向到踩踏:自动驾驶VLMs是否能泛化到骑行辅助的空间感知与规划?

Krishna Kanth Nakka, Vedasri Nakka

专题命中 规划决策 :planning(title)

AI总结 本文提出CyclingVQA基准,评估自动驾驶VLMs在骑行辅助场景中的感知与推理能力,发现现有模型在骑行特定交通提示理解上存在不足,需进一步改进。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01253 2026-02-12 cs.AI cs.SY eess.SY q-bio.NC 70%

Metareasoning in uncertain environments: a meta-BAMDP framework

在不确定环境中进行元推理:一个元Bayes-适应MDP框架

Prakhar Godara, Tilman Diego Alemán

机构 * Department of Psychology(心理学系) Institut für Geometrie und Praktische Mathematik(几何与应用数学研究所)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出元Bayes-适应MDP框架,用于处理未知奖励和转移分布环境中的元推理问题,并在伯努利老虎机任务中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14671 2026-02-12 cs.CL cs.AI cs.LG 67%

TableDART: Dynamic Adaptive Multi-Modal Routing for Table Understanding

TableDART: 表格理解的动态自适应多模态路由

Xiaobo Xing, Wei Yuan, Tong Chen, Quoc Viet Hung Nguyen, Xiangliang Zhang, Hongzhi Yin

机构 * The University of Queensland, Australia(昆士兰大学) Griffith University, Australia(格里菲斯大学) University of Notre Dame, USA(诺丁汉大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 TableDART通过动态选择文本、图像或融合视角,提升表格理解的准确性和效率,避免昂贵的多模态模型微调。

Comments Accepted to ICLR 2026. 26 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11018 2026-02-12 cs.LG cs.AI stat.ML 62%

OSIL: Learning Offline Safe Imitation Policies with Safety Inferred from Non-preferred Trajectories

OSIL: 通过非偏好轨迹推断学习离线安全模仿策略

Returaj Burnwal, Nirav Pravinbhai Bhatt, Balaraman Ravindran

机构 * Indian Institute of Technology Madras(印度理工学院马德拉斯学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 OSIL通过非偏好轨迹推断安全策略,从离线演示中学习安全且奖励最大化的策略,优于基线方法。

Comments 21 pages, Accepted at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07695 2026-02-12 cs.AI cs.CL cs.IR cs.MM 62%

EventCast: Hybrid Demand Forecasting in E-Commerce with LLM-Based Event Knowledge

EventCast:基于LLM事件知识的电子商务混合需求预测

Congcong Hu, Yuang Shi, Fan Huang, Yang Xiang, Zhou Ye, Ming Jin, Shiyu Wang

机构 * ByteDance China(字节跳动中国) National University of Singapore(新加坡国立大学) Griffith University(格里菲斯大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 EventCast通过整合LLM事件知识提升电子商务需求预测精度,实现86.9%和97.7%的MAE和MSE改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10598 2026-02-12 cs.AI cs.LG 62%

Neuro-symbolic Action Masking for Deep Reinforcement Learning

神经符号动作遮蔽用于深度强化学习

Shuai Han, Mehdi Dastani, Shihan Wang

机构 * Utrecht University(乌得勒支大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 NSAM通过自动学习符号模型与深度策略优化结合,提升深度强化学习的样本效率并减少约束违规。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08835 2026-02-12 cs.AI cs.CY cs.LG 59%

Learning the Value Systems of Societies with Preference-based Multi-objective Reinforcement Learning

基于偏好多目标强化学习的学习社会价值观系统

Andrés Holgado-Sánchez, Peter Vamplew, Richard Dazeley, Sascha Ossowski, Holger Billhardt

机构 * CETINIA, University Rey Juan Carlos(CETINIA皇家卡洛斯大学) Federation University(联邦大学) Deakin University(德肯大学)

专题命中 规划决策 :分类 cs.AI、cs.LG;agent(comments);autonomous agent(comments);multi-agent(comments)

AI总结 本文提出基于偏好多目标强化学习的方法,用于在马尔可夫决策过程中学习社会价值系统,通过聚类和价值对齐模型实现不同用户群体的个性化价值偏好适应。

Comments 18 pages, 3 figures. To be published in proceedings of the 25th International Conference on Autonomous Agents and Multi-Agent Systems (AAMAS 2026). This is a full version that includes the supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11024 2026-02-12 cs.CV cs.AI 57%

Chain-of-Look Spatial Reasoning for Dense Surgical Instrument Counting

密集手术器械计数的链式观察空间推理

Rishikesh Bhyri, Brian R Quaranto, Philip J Seger, Kaity Tung, Brendan Fox, Gene Yang, Steven D. Schwaitzberg, Junsong Yuan, Nan Xi, Peter C W Kim

机构 * State University of New York at Buffalo(纽约州立大学布法罗分校)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 本文提出Chain-of-Look框架,通过结构化视觉链提升密集手术器械计数的准确性,并引入邻近损失函数和SurgCount-HD数据集,实验证明其在复杂场景中的优越性能。

Comments Accepted to WACV 2026. This version includes additional authors who contributed during the rebuttal phase

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11021 2026-02-12 cs.RO cs.AI cs.CV 57%

ContactGaussian-WM: Learning Physics-Grounded World Model from Videos

ContactGaussian-WM: 从视频中学习物理基础的世界模型

Meizhong Wang, Wanxin Jin, Kun Cao, Lihua Xie, Yiguang Hong

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 ContactGaussian-WM通过从稀疏视频中学习物理定律,提升机器人规划与模拟中的复杂动态场景建模能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10923 2026-02-12 cs.LG cs.CY 57%

Spatial-Morphological Modeling for Multi-Attribute Imputation of Urban Blocks

城市街区多属性填补的时空形态建模

Vasilii Starikov, Ruslan Kozliak, Georgii Kontsevik, Sergey Mityagin

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一种结合形态学与空间信息的城市街区多属性填补方法,通过整合全局先验与局部空间信息提升填补精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25112 2026-02-12 cs.AI cs.MA 57%

AI Driven Discovery of Bio Ecological Mediation in Cascading Heatwave Risks

由人工智能驱动的生物生态中介在连锁热浪风险中的发现

Yiquan Wang, Tin-Yeh Huang, Qingyun Gao, Yuhan Chang, Jialin Zhang

机构 * College of Mathematics and System Science, Xinjiang University, Urumqi, Xinjiang, China(数学与系统科学学院,新疆大学) Institute of Geographic Sciences and Natural Resources Research, Chinese Academy of Sciences, Beijing, China(地理科学与自然资源研究所,中国科学院) Department of Industrial and Systems Engineering, The Hong Kong Polytechnic University, Hong Kong, China(工业与系统工程系,香港理工大学) Xinya College, Tsinghua University, Beijing, China(清华学院) College of Architectural Engineering, Xinjiang University, Urumqi, Xinjiang, China(建筑工程学院,新疆大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本研究提出HeDA框架,通过构建知识图谱发现生物生态中介效应,揭示热浪风险的复杂系统性影响,并推动适应策略向动态跨系统韧性转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10439 2026-02-12 cs.SD cs.AI eess.AS 57%

AudioRouter: Data Efficient Audio Understanding via RL based Dual Reasoning

AudioRouter: 通过基于强化学习的双推理实现数据高效的音频理解

Liyang Chen, Hongkai Chen, Yujun Cai, Sifan Li, Qingwen Ye, Yiwei Wang

专题命中 规划决策 :tool use(abstract);分类 cs.AI

AI总结 AudioRouter通过强化学习双推理机制,以更少的数据训练实现LALMs在音频理解上的高效提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10136 2026-02-12 q-bio.QM cs.AI 57%

A PBN-RL-XAI Framework for Discovering a "Hit-and-Run" Therapeutic Strategy in Melanoma

一种用于在黑色素瘤中发现'突击-撤退'治疗策略的PBN-RL-XAI框架

Zhonglin Liu

机构 * Department of Mathematics, The University of Hong Kong(香港大学数学系)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种PBN-RL-XAI框架,通过动态布尔网络和强化学习发现黑色素瘤中'突击-撤退'治疗策略,揭示了抑制LOXL2蛋白的有效机制。

Comments 7 pages, 7 figures. Accepted by the IEEE International Conference on Bioinformatics and Biomedicine (BIBM) 2025. Code is available at https://github.com/Liu-Zhonglin/pbn-melanoma-project

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12365 2026-02-12 cs.CL cs.DB 57%

Advances in LLMs with Focus on Reasoning, Adaptability, Efficiency and Ethics

大语言模型的进展:聚焦推理、适应性、效率和伦理

Asifullah Khan, Muhammad Zaeem Khan, Aleesha Zainab, Saleha Jamshed, Sadia Ahmad, Kaynat Khatib, Faria Bibi, Abdul Rehman

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 本文综述了大语言模型在推理、适应性、效率和伦理方面的进展,探讨了关键技术和挑战,提出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04534 2026-02-12 cs.LG 57%

Hypercube Policy Regularization Framework for Offline Reinforcement Learning

超立方体策略正则化框架用于离线强化学习

Yi Shen, Hanyan Huang

机构 * Sun Yat-Sen University(中山大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出超立方体策略正则化框架,通过允许智能体探索相似状态对应的动作,提升离线强化学习在低质量数据集中的性能。

Comments Revised version accepted at MLMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11124 2026-02-12 cs.CV 50%

PhyCritic: Multimodal Critic Models for Physical AI

PhyCritic:面向物理AI的多模态批评模型

Tianyi Xiong, Shihao Wang, Guilin Liu, Yi Dong, Ming Li, Heng Huang, Jan Kautz, Zhiding Yu

专题命中 规划决策 :planning(abstract)

AI总结 PhyCritic通过双阶段RLVR流程优化,提升物理AI任务中的感知和推理能力,实现对物理任务的高效评估和改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11113 2026-02-12 cs.RO 50%

A receding-horizon multi-contact motion planner for legged robots in challenging environments

面向挑战环境的腿足机器人回溯地平线多接触运动规划器

Daniel S. J. Derwent, Simon Watson, Bruno V. Adorno

机构 * Manchester Centre for Robotics and AI(机器人与人工智能中心) University of Manchester(曼彻斯特大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种新型回溯地平线多接触运动规划器,用于在挑战性环境中为腿足机器人规划运动,提升了规划效率和质量。

Comments Submitted to Robotics and Autonomous Systems For supplementary video, see https://www.youtube.com/watch?v=RJp8DCmhDa4

详情

展开后加载摘要…

URL PDF HTML 收藏