arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-17 至 2026-02-17 共收录 211 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 86 篇

2509.05311 2026-02-17 cs.CR cs.AI cs.LG 62%

Large Language Model Integration with Reinforcement Learning to Augment Decision-Making in Autonomous Cyber Operations

将强化学习与大语言模型集成以增强自主网络操作中的决策能力

Konur Tholl, François Rivest, Mariam El Mezouar, Adrian Taylor, Ranwa Al Mallah

机构 * Royal Military College of Canada(皇家军事学院) Defence Research and Development Canada(加拿大国防研究与发展加拿大) Polytechnique Montreal(蒙特利尔大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过整合预训练的大语言模型与强化学习,提升自主网络操作中的决策能力,显著提高奖励并加速策略收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17979 2026-02-17 cs.GT cs.AI cs.MA econ.GN q-fin.EC stat.AP 61%

Adaptive Agents in Spatial Double-Auction Markets: Modeling the Emergence of Industrial Symbiosis

空间双拍卖市场中的自适应代理:工业共生的形成建模

Matthieu Mastio, Paul Saves, Benoit Gaudou, Nicolas Verstaevel

机构 * IRIT, UMR 5505 CNRS, Université Toulouse Capitole(IRIT,CNRS 5505,图卢兹大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI;autonomous agent(comments)

AI总结 本文提出一个基于代理的空间双拍卖模型,研究自适应企业行为如何在空间约束下促成工业共生的形成。

Comments AAMAS CC-BY 4.0 licence. Adaptive Agents in Spatial Double-Auction Markets: Modeling the Emergence of Industrial Symbiosis. Full paper. In Proc. of the 25th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2026), Paphos, Cyprus, May 25 - 29, 2026, IFAAMAS, 10 pages

Journal ref AAMAS 2026, Paphos, IFAAMAS, 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14910 2026-02-17 cs.AI 57%

Position: Introspective Experience from Conversational Environments as a Path to Better Learning

位置:对话环境中的反思经验作为更好学习的路径

Claudiu Cristian Musat, Jackson Tolins, Diego Antognini, Jingling Li, Martin Klissarov, Tom Duerig

机构 * Google DeepMind(谷歌DeepMind)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出通过对话环境中的反思经验提升学习效果,强调社会互动对推理能力的培养作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14857 2026-02-17 cs.AI 57%

World Models for Policy Refinement in StarCraft II

为《星际2》政策细化设计的世界模型

Yixin Zhang, Ziyi Wang, Yiming Rong, Haoxi Wang, Jinling Jiang, Shuang Xu, Haoran Wu, Shiyu Zhou, Bo Xu

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 StarWM为《星际2》政策细化设计的世界模型,通过预测未来观察和结构化文本表示提升策略决策性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14578 2026-02-17 cs.LG cs.AR 57%

RNM-TD3: N:M Semi-structured Sparse Reinforcement Learning From Scratch

RNM-TD3:从零开始的N:M半结构稀疏强化学习

Isam Vrce, Andreas Kassler, Gökçe Aydos

机构 * Deggendorf Institute of Technology(德格多夫技术学院) Department of Engineering Technology(工程技术系) Technical University of Denmark(丹麦技术大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 RNM-TD3通过N:M结构稀疏性在强化学习中实现压缩、性能和硬件效率的平衡,优于密集模型并在稀疏度下表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14035 2026-02-17 cs.AI 57%

FloCA: Towards Faithful and Logically Consistent Flowchart Reasoning

FloCA: 向忠实且逻辑一致的流程图推理迈进

Jinzi Zou, Bolin Wang, Liang Li, Shuo Zhang, Nuo Xu, Junzhou Zhao

机构 * MoE KLINNS Lab, Xi’an Jiaotong University, Xi’an 710049, P. R. China(西安交通大学) China Mobile Group Shaanxi Co., Ltd.(中国移动集团陕西公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 FloCA通过结合LLM和外部工具实现流程图推理,解决现有方法在流程图拓扑表示和幻觉问题上的不足,提升对话系统的准确性和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22391 2026-02-17 cs.CV cs.AI 57%

Top-Down Semantic Refinement for Image Captioning

自上而下语义细化用于图像描述生成

Jusheng Zhang, Kaitong Cai, Jing Yang, Jian Wang, Chengpei Tang, Keze Wang

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 自上而下语义细化通过高效MCTS算法提升图像描述生成的性能与质量

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18487 2026-02-17 cs.RO cs.CV cs.LG 57%

Grounding Bodily Awareness in Visual Representations for Efficient Policy Learning

在视觉表示中 grounding 身体意识以实现高效的策略学习

Junlin Wang, Zhiyun Lin

机构 * SUSTech Shenzhen(深圳科技大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出ICon方法,通过对比学习提升机器人操作中策略学习的效率和跨机器人迁移能力。

Comments A preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16730 2026-02-17 cs.CR cs.AI 57%

RapidPen: Fully Automated IP-to-Shell Penetration Testing with LLM-based Agents

RapidPen: 基于大语言模型的完全自动化IP到Shell渗透测试框架

Sho Nakatani

机构 * SecDevLab Inc(SecDevLab公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 RapidPen基于大语言模型实现完全自动化IP到Shell渗透测试,通过任务规划与反馈循环高效发现并利用漏洞,降低安全测试成本与门槛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13685 2026-02-17 cs.SD cs.AI 57%

AuTAgent: A Reinforcement Learning Framework for Tool-Augmented Audio Reasoning

AuTAgent: 一个用于工具增强音频推理的强化学习框架

Siqian Tong, Xuan Li, Yiwei Wang, Baolong Bi, Yujun Cai, Shenghua Liu, Yuchen He, Chengpeng Hao

机构 * Institute of Acoustics, Chinese Academy of Sciences(中国科学院声学研究所) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) The University of Queensland(昆士兰大学) University of Chinese Academy of Sciences(中国科学院大学) University of California, Merced(加州大学默塞德分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 AuTAgent通过强化学习框架学习何时及使用哪些工具,提升音频模型的推理能力,实验显示在多个基准上显著提高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13347 2026-02-17 cs.CV cs.AI cs.RO 57%

Visual Foresight for Robotic Stow: A Diffusion-Based World Model from Sparse Snapshots

机器人存取的视觉预见:一种基于稀疏快照的扩散世界模型

Lijun Zhang, Nikhil Chacko, Petter Nilsson, Ruinian Xu, Shantanu Thakar, Bai Lou, Harpreet Sawhney, Zhebin Zhang, Mudit Agrawal, Bhavana Chandrashekhar, Aaron Parness

机构 * Amazon, Seattle, US(亚马逊(美国西雅图))

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 FOREST通过基于稀疏快照的扩散模型,提升仓库存取操作的预测精度,为仓储规划提供有效预见信号。

Comments 20 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13273 2026-02-17 cs.DB cs.AI cs.DC 57%

MergePipe: A Budget-Aware Parameter Management System for Scalable LLM Merging

MergePipe: 一种面向可扩展大语言模型融合的预算感知参数管理系统

Yuanyi Wang, Yanggan Gu, Zihao Wang, Kunxi Li, Yifan Yang, Zhaoyi Yan, Congkai Xie, Jianmin Wu, Hongxia Yang

机构 * Hong Kong Polytechnic University(香港理工大学) Zhejiang University(浙江大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 MergePipe通过预算感知的参数管理实现高效的大语言模型融合,减少I/O并提升整体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13207 2026-02-17 cs.NI cs.AI 57%

A Safety-Constrained Reinforcement Learning Framework for Reliable Wireless Autonomy

面向可靠无线自主性的安全约束强化学习框架

Abdikarim Mohamed Ibrahim, Rosdiadee Nordin

机构 * Faculty of Engineering and Technology(工程与技术学院) Sunway University(Sunway大学) Future Cities Research Institute(未来城市研究 institutes)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出一种主动安全约束强化学习框架,通过整合证明携带控制与赋能预算,以确保无线自主性中的安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11797 2026-02-17 q-fin.PM cs.LG q-fin.CP 57%

Data-Driven Merton's Strategies via Policy Randomization

基于策略随机化的数据驱动梅顿策略

Min Dai, Yuchao Dong, Yanwei Jia, Xun Yu Zhou

机构 * Department of Applied Mathematics and School of Accounting and Finance, The Hong Kong Polytechnic University(应用数学系和会计与金融学院,香港理工大学) Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong(系统工程与工程管理系,香港中文大学) Department of Industrial Engineering and Operations Research & Data Science Institute, Columbia University(工业工程与运筹学系及数据科学研究所,哥伦比亚大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出基于策略随机化的数据驱动方法,用于解决不完全市场中的梅顿期望效用最大化问题,通过强化学习算法实现优于传统方法的性能。

Comments 45 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13800 2026-02-17 cs.RO cs.HC 56%

Ontological grounding for sound and natural robot explanations via large language models

通过大语言模型实现声音和自然的机器人解释的本体论基础

Alberto Olivares-Alarcos, Muhammad Ahsan, Satrio Sanjaya, Hsien-I Lin, Guillem Alenyà

机构 * Institute of Electrical and Control Engineering, National Yang Ming Chiao Tung University(电子与控制工程研究所,国立阳明交通大学)

专题命中 规划决策 :agent(abstract);autonomous agent(comments)

AI总结 本文提出结合本体推理与大语言模型的框架,以生成自然且语义准确的机器人解释,提升人机交互的透明度和可解释性。

Comments An extended abstract of this article is accepted for presentation at AAMAS 2026: Olivares-Alarcos, A., Muhammad, A., Sanjaya, S., Lin, H. and Alenyà, G. (2026). Blending ontologies and language models to generate sound and natural robot explanations. In Proceedings of the International Conference on Autonomous Agents and Multiagent Systems. IFAAMAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14979 2026-02-17 cs.RO 50%

RynnBrain: Open Embodied Foundation Models

RynnBrain: 开放式具身基础模型

Ronghao Dang, Jiayan Guo, Bohan Hou, Sicong Leng, Kehan Li, Xin Li, Jiangpin Liu, Yunxuan Mao, Zhikai Wang, Yuqian Yuan, Minghao Zhu, Xiao Lin, Yang Bai, Qian Jiang, Yaxi Zhao, Minghua Zeng, Junlong Gao, Yuming Jiang, Jun Cen, Siteng Huang, Liuyi Wang, Wenqiao Zhang, Chengju Liu, Jianfei Yang, Shijian Lu, Deli Zhao

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团)

专题命中 规划决策 :planning(abstract)

AI总结 RynnBrain提出了一种开放的具身基础模型,通过统一框架强化感知、推理、规划等能力,显著优于现有模型,并能高效适应多种具身任务。

Comments Homepage: https://alibaba-damo-academy.github.io/RynnBrain.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14948 2026-02-17 cs.RO cs.SY eess.SY 50%

Kalman Filtering Based Flight Management System Modeling for AAM Aircraft

基于卡尔曼滤波的AAM飞行管理系统建模

Balram Kandoria, Aryaman Singh Samyal

机构 * Machine Learning Research Engineer(机器学习研究员)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于卡尔曼滤波的AAM飞行管理系统建模方法,通过动态调整测量信任提高飞行计划验证的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14534 2026-02-17 cs.CV 50%

MoRL: Reinforced Reasoning for Unified Motion Understanding and Generation

MoRL: 用于统一运动理解与生成的强化推理

Hongpeng Wang, Zeyu Zhang, Wenhao Li, Hao Tang

机构 * The University of Sydney(悉尼大学) Peking University(北京大学) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :planning(abstract)

AI总结 MoRL通过结合监督微调和强化学习,提升运动理解与生成的推理能力和现实感,并引入链式运动方法和大规模CoT数据集以增强推理效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14104 2026-02-17 cs.RO cs.SY eess.SY 50%

Rigidity-Based Multi-Finger Coordination for Precise In-Hand Manipulation of Force-Sensitive Objects

基于刚性的多指协调用于力敏感物体的精确手握操作

Xinan Rong, Changhuang Wan, Aochen He, Xiaolong Li, Gangshan Jing

机构 * School of Automation, Chongqing University(重庆大学自动化学院) Department of Mechanical Engineering, City University of Hong Kong(香港城市大学机械工程系)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出双层框架实现多指协调,通过关节控制无需触觉反馈实现高精度力敏感物体操作。

Comments This paper has been accepted by IEEE Robotics and Automation Letters. The experimental video is avaialable at: https://www.youtube.com/watch?v=kcf9dVW0Dpo

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13998 2026-02-17 cs.HC 50%

Customer Service Operations: A Gatekeeper Framework

客户服务中心运营:守门人框架

Maqbool Dada, Brett Hathaway, Evgeny Kagan

专题命中 规划决策 :agent(abstract)

AI总结 本文提出守门人框架,用于分析客户服务中心运营中的渠道选择、人员安排及聊天机器人应用,揭示聊天机器人可提升服务质量。

Journal ref Production and Operations Management 34.9 (2025): 2814-2832

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13866 2026-02-17 cs.RO cs.MA 50%

Modeling and Optimizing the Provisioning of Exhaustible Capabilities for Simultaneous Task Allocation and Scheduling

对同时任务分配与调度的耗尽能力 provisioning 进行建模与优化

Jinwoo Park, Harish Ravichandar, Seth Hutchinson

机构 * Georgia Institute of Technology(佐治亚理工学院) Northeastern University(东北大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出TRAITS框架,通过非线性规划优化异构机器人团队在电池和时间约束下的特性 provisioning,提升任务分配与调度的可行性和效率。

Comments Accepted at AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13833 2026-02-17 cs.RO 50%

Semantic-Contact Fields for Category-Level Generalizable Tactile Tool Manipulation

语义接触场用于类别级可泛化的触觉工具操作

Kevin Yuchen Ma, Heng Zhang, Weisi Lin, Mike Zheng Shou, Yan Wu

专题命中 规划决策 :planning(abstract)

AI总结 SCFields通过融合视觉语义与密集接触估计,实现类别级可泛化的触觉工具操作,显著优于视觉和原始触觉基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13739 2026-02-17 cs.RO cs.SY eess.SY 50%

XIT: Exploration and Exploitation Informed Trees for Active Gas Distribution Mapping in Unknown Environments

XIT:在未知环境中主动气体分布映射的探索与利用树

Mal Fazliu, Matthew Coombes, Sen Wang, Cunjia Liu

专题命中 规划决策 :planning(abstract)

AI总结 XIT通过平衡探索与利用,提升未知环境中自主气体分布映射的效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08320 2026-02-17 cs.DB 50%

Making Databases Searchable with Deep Context

用深度上下文使数据库可搜索

Alekh Jindal, Shi Qiao, Shivani Tripathi, Niloy Debnath, Kunal Singh, Pushpanjali Nema, Sharath Prakash, Aditya Halder, Ronith PR, Sadiq Mohammed, Abdul Hameed, Karan Hanswadkar, Ayush Kshitij, Sarthak Bhatt, Rony Chatterjee, Jyoti Pandey, Christina Pavlopoulou, Ravi Shetye

专题命中 规划决策 :planning(abstract)

AI总结 Tursio通过整合大语言模型,构建语义知识图谱,使非专家用户能高效准确地通过自然语言查询数据库。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06212 2026-02-17 physics.med-ph 50%

Causal machine learning reveals age-dependent radiation dose effects on mandibular osteoradionecrosis

因果学习揭示辐射剂量对下颌骨放射性坏死的年龄依赖性影响

Jingyuan Chen, Yunze Yang, Olivia M. Muller, Lei Zeng, Zhengliang Liu, Tianming Liu, Robert L Foote, Daniel J Ma, Samir H Patel, Zhong Liu, Wei Liu

专题命中 规划决策 :planning(abstract)

AI总结 本文通过因果学习揭示辐射剂量对下颌骨放射性坏死的年龄依赖性影响,发现50-60岁患者对剂量的反应最强,提出个性化治疗优化策略以降低风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00220 2026-02-17 eess.IV cs.CV 50%

Deep learning Based Correction Algorithms for 3D Medical Reconstruction in Computed Tomography and Macroscopic Imaging

基于深度学习的3D医学重建在计算机断层扫描和宏观成像中的校正算法

Tomasz Les, Tomasz Markiewicz, Malgorzata Lorent, Miroslaw Dziekiewicz, Krzysztof Siwek

机构 * University of Technology(技术大学) Military Institute of Medicine(军事医学研究院) Institute of Tuberculosis and Lung Diseases(肺结核和肺病研究所)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种混合两阶段配准框架,结合几何先验和深度学习,提升3D医学重建的精度和解剖真实感。

Comments 23 pages, 9 figures, submitted to Applied Sciences (MDPI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22121 2026-02-17 q-fin.PM q-fin.CP 50%

Multi-period Mean-Buffered Probability of Exceedance in Defined Contribution Portfolio Optimization

多时期均值-缓冲概率超额量在定义贡献型投资组合优化中的应用

Duy-Minh Dang, Chang Chen

专题命中 规划决策 :planning(abstract)

AI总结 本文提出多时期均值-缓冲概率超额量优化方法,用于定义贡献型投资组合优化,展示其在长期财富安全中的优势。

Comments 44 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13604 2026-02-17 physics.class-ph astro-ph.EP astro-ph.IM astro-ph.SR physics.space-ph 50%

Description of 4 Spacecraft, Moving on Elliptic Kepler Orbits

四艘航天器的描述,沿椭圆开普勒轨道运动

Vladimir P. Zhukov, Nikolai K. Iakovlev, Alexander A. Bochkarev, Nikita E. Logvinenko, Sergei M. Kurchev, Vlas A. Karavaikin, Ivan A. Radko

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种用于描述四航天器编队的新方法,通过解析解分析其在椭圆开普勒轨道上的运动,以提高测量太阳系重力场梯度的精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13335 2026-02-17 cs.CV 50%

Meningioma Analysis and Diagnosis using Limited Labeled Samples

利用有限标注样本进行脑膜瘤分析与诊断

Jiamiao Lu, Wei Wu, Ke Gao, Ping Mao, Weichuan Zhang, Tuo Wang, Lingkun Ma, Jiapan Guo, Zanyi Wu, Yuqing Hu, Changming Sun

机构 * Shaanxi University of Science and Technology(陕西科技大学) Department of Neurosurgery, The First Affiliated Hospital of Xi'an Jiaotong University(西安交通大学第一附属医院神经外科) Department of Neurosurgery, The First Affiliated Hospital of Fujian Medical University(福建医科大学第一附属医院神经外科) Department of Radiotherapy, University of Groningen, University Medical Center Groningen(格罗宁根大学放射治疗科,格罗宁根大学医学中心) Department of Nephrology, Chenggong Hospital Affiliated to Xiamen University(厦门大学附属晋江医院肾内科)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种基于特征融合和自适应权重的少样本脑膜瘤学习方法,通过引入新的MRI数据集验证了其在脑膜瘤分类中的优越性能。

Comments 19 pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13281 2026-02-17 cs.SI 50%

Shifted Eigenvector Models for Centrality and Occupancy in Urban Networks

偏移特征向量模型用于城市网络中的中心性与占用

María Magdalena Martínez-Rico, Luis Felipe Prieto-Martínez

专题命中 规划决策 :planning(abstract)

AI总结 本文提出偏移特征向量模型,用于分析城市网络中的中心性与占用,结合拓扑和非拓扑因素,通过最小二乘法估计参数并评估城市干预影响。

详情

展开后加载摘要…

URL PDF HTML 收藏