arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 2982 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 2982 篇

2602.03175 2026-02-23 cs.LG 57%

Probe-then-Commit Multi-Objective Bandits: Theoretical Benefits of Limited Multi-Arm Feedback

探查-然后承诺多目标老虎机:有限多臂反馈的理论优势

Ming Shi

机构 * Department of Electrical Engineering, University at Buffalo(电气工程系,布法罗大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出PtC-P-UCB算法,通过有限探查提升多目标老虎机的性能,实现$1/\sqrt{q}$的加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08831 2026-02-23 cs.CV cs.LG cs.RO 57%

View Invariant Learning for Vision-Language Navigation in Continuous Environments

连续环境中视觉语言导航的视角不变学习

Josh Qixuan Sun, Huaiyuan Weng, Xiaoying Xing, Chul Min Yeum, Mark Crowley

机构 * Department of Electrical and Computer Engineering, University of Waterloo(电气与计算机工程系,滑铁卢大学) Department of Civil and Environmental Engineering, University of Waterloo(土木与环境工程系,滑铁卢大学) Department of Electrical and Computer Engineering, Northwestern University(电气与计算机工程系,西北大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出VIL框架,通过对比学习和教师-学生机制提升连续环境中视觉语言导航的视角鲁棒性,实验表明其在多个基准数据集上性能优越。

Comments This paper is accepted to RA-L 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11337 2026-02-20 cs.RO cs.AI cs.CV 57%

MolmoSpaces: A Large-Scale Open Ecosystem for Robot Navigation and Manipulation

MolmoSpaces: 一个大规模的开放式生态系统用于机器人导航与操作

Yejin Kim, Wilbert Pumacay, Omar Rayyan, Max Argus, Winson Han, Eli VanderBilt, Jordi Salvador, Abhay Deshpande, Rose Hendrix, Snehal Jauhri, Shuo Liu, Nur Muhammad Mahi Shafiullah, Maya Guru, Ainaz Eftekhar, Karen Farley, Donovan Clay, Jiafei Duan, Arjun Guru, Piper Wolters, Alvaro Herrasti, Ying-Chun Lee, Georgia Chalvatzaki, Yuchen Cui, Ali Farhadi, Dieter Fox, Ranjay Krishna

机构 * Allen Institute for AI(艾伦人工智能研究所) University of Washington(华盛顿大学) University of California, Los Angeles(加州大学洛杉矶分校) University of California, Berkeley(加州大学伯克利分校)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 MolmoSpaces是一个大规模开放式生态系统,用于支持机器人导航与操作的大规模基准测试,包含230k多样化的室内环境和130k丰富标注的物体资产,通过8个任务的基准测试验证了其在仿真到现实中的强相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16174 2026-02-19 cs.NI cs.AI cs.MM 57%

Edge Learning via Federated Split Decision Transformers for Metaverse Resource Allocation

通过联邦分裂决策变换器进行边缘学习以实现元宇宙资源分配

Fatih Temiz, Shavbo Salehi, Melike Erol-Kantarci

机构 * School of Electrical Engineering and Computer Science(电气工程与计算机科学学院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出FSDT框架,通过联邦学习与强化学习结合,解决异构多无线电接入环境下的元宇宙资源分配问题,提升QoE并减少计算负担。

Comments 6 pages, 4 figures, Accepted paper at IEEE International Conference on Communications (ICC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16047 2026-02-19 cs.HC cs.SE 57%

A Unified, Cross-Platform Framework for Automatic GUI and Plugin Generation in Structural Bioinformatics and Beyond

一种统一的跨平台框架,用于结构生物信息学及其他领域的自动GUI和插件生成

Sikao Guo, Edoardo Sarti, Frédéric Cazals

专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.SE

AI总结 本文提出了一种统一的跨平台框架,用于自动化生成结构生物信息学及其他领域的GUI和插件,通过MVP模式实现可重用性和跨平台兼容性。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15724 2026-02-18 cs.CV cs.AI 57%

Learning to Retrieve Navigable Candidates for Efficient Vision-and-Language Navigation

学习高效视觉-语言导航中的可导航候选检索

Shutian Gu, Chengkai Huang, Ruoyu Wang, Lina Yao

机构 * University of New South Wales, Sydney, Australia(新南威尔士大学) Macquarie University, Sydney, Australia(麦考瑞大学) Data61, CSIRO, Sydney, Australia(Data61, CSIRO) The School of Computer Science(计算机科学学院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出检索增强框架,通过指令级示例检索和候选剪枝提升LLM在视觉-语言导航中的效率和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05354 2026-02-17 cs.AI 57%

PATHWAYS: Evaluating Investigation and Context Discovery in AI Web Agents

PATHWAYS:评估人工智能网络代理中的调查与上下文发现

Shifat E. Arman, Syed Nazmus Sakib, Tapodhir Karmakar Taton, Nafiul Haque, Shahrear Bin Amin

机构 * Robotics and Mechatronics Engineering, University of Dhaka, Dhaka, Bangladesh(机器人与机电工程系,达卡大学,达卡,孟加拉国)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 PATHWAYS评估了人工智能网络代理在多步骤任务中发现和利用隐藏上下文的能力,揭示了当前架构在适应性调查和判断覆盖方面的不足。

Comments 35 pages, 13 figures

Journal ref Under Review in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10225 2026-02-12 quant-ph cs.AI cs.IT eess.SP math.IT 57%

Quantum Integrated Sensing and Computation with Indefinite Causal Order

具有不定因果顺序的量子集成传感与计算

Ivana Nikoloska

机构 * Signal Processing Systems Group, Department of Electrical Engineering, Eindhoven University of Technology, Eindhoven, 5612 AP, The Netherlands(埃因霍温理工大学电气工程系信号处理系统组)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种在量子不定因果顺序框架下集成传感与计算的方案,通过量子代理同时执行状态观测和计算任务,实现了在磁导航任务中的高效性能。

Comments Submitted for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09540 2026-02-11 cs.SE 57%

SWE-Bench Mobile: Can Large Language Model Agents Develop Industry-Level Mobile Applications?

SWE-Bench Mobile: 大语言模型代理能否开发行业级移动应用?

Muxin Tian, Zhe Wang, Blair Yang, Zhenwei Tang, Kunlun Zhu, Honghua Dong, Hanchen Li, Xinni Xie, Guangjing Wang, Jiaxuan You

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.SE

AI总结 SWE-Bench Mobile评估大语言模型代理在开发行业级移动应用中的能力,发现商业代理表现优于开源替代品,且简单提示策略更有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09002 2026-02-10 cs.RO cs.AI 57%

From Obstacles to Etiquette: Robot Social Navigation with VLM-Informed Path Selection

从障碍到礼仪:基于VLM引导路径选择的机器人社交导航

Zilin Fang, Anxing Xiao, David Hsu, Gim Hee Lee

机构 * School of Computing(计算机学院) Smart Systems Institute(智能系统研究所)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种结合几何规划与上下文社交推理的机器人社交导航框架,通过VLM模型优化路径选择,以减少对人类活动的干扰并遵守社会规范。

Comments Accepted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26098 2026-02-10 cs.AI 57%

GUI Knowledge Bench: Revealing the Knowledge Gap of VLMs in GUI Tasks

GUI知识基准:揭示VLMs在GUI任务中的知识差距

Chenrui Shi, Zedong Yu, Zhi Gao, Ruining Feng, Enqi Liu, Yuwei Wu, Yunde Jia, Liuyu Xiang, Zhaofeng He, Qing Li

机构 * Beijing Institute of Technology, Beijing, China(北京理工大学) State Key Laboratory of General Artificial Intelligence, BIGAI, Beijing, China(国家一般人工智能重点实验室) Beijing University of Posts(北京邮电大学) Tsinghua University, Beijing, China(清华大学) Shenzhen MSU-BIT University, Shenzhen, China(深圳MSU-BIT大学)

专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.AI

AI总结 GUI知识基准揭示VLMs在GUI任务中的知识差距,通过提炼三个维度的GUI知识,评估现有模型的不足并指导更高效的任务完成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22894 2026-02-09 cs.CR cs.AI 57%

DECEPTICON: How Dark Patterns Manipulate Web Agents

DECEPTICON:暗模式如何操纵网络代理

Phil Cuvin, Hao Zhu, Diyi Yang

机构 * Stanford University(斯坦福大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 DECEPTICON研究揭示暗模式通过引导代理轨迹对网络代理构成重大风险,表明需加强防御措施以应对操纵性设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10322 2026-02-05 cs.AI 57%

User-Feedback-Driven Adaptation for Vision-and-Language Navigation

基于用户反馈的视觉-语言导航适应

Yongqiang Yu, Xuhui Li, Hazza Mahmood, Jinxing Zhou, Haodong Hong, Longtao Jiang, Zhiqiang Xu, Qi Wu, Xiaojun Chang

机构 * Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed大学人工智能学院) School of Electrical Engineering and Computer Science, The University of Queensland(电气工程与计算机科学学院,昆士兰大学) University of Science and Technology of China(中国科学技术大学) School of Computer Science, The University of Adelaide(计算机科学学院,阿德莱德大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出基于用户反馈的视觉-语言导航适应方法,通过拓扑感知轨迹构建和持久记忆库机制,提升代理对用户指令的响应能力,实现高效模仿学习和跨指令风格的强适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02158 2026-02-03 cs.AI 57%

Traffic-Aware Navigation in Road Networks

道路网络中的交通感知导航

Sarah Nassar

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Queen’s University(女王大学)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 本研究比较了三种图搜索方法在Kingston道路网络中交通感知导航中的性能,发现Dijkstra和A*在交通感知最优解方面表现最佳,而Yen's算法在预处理和运行效率上取得平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19199 2026-02-03 cs.AI 57%

MAGNET: Towards Adaptive GUI Agents with Memory-Driven Knowledge Evolution

MAGNET:迈向基于记忆驱动的知识演化的自适应GUI代理

Libo Sun, Jiwen Zhang, Siyuan Wang, Zhongyu Wei

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) University of Southern California(南加州大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 MAGNET通过双层记忆机制和动态演化机制,提升GUI代理在界面变化中的适应性和任务执行性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22044 2026-01-30 cs.NI cs.AI 57%

SIA: Symbolic Interpretability for Anticipatory Deep Reinforcement Learning in Network Control

SIA:符号可解释性用于网络控制中的前瞻性深度强化学习

MohammadErfan Jabbari, Abhishek Duttagupta, Claudio Fiandrino, Leonardo Bonati, Salvatore D'Oro, Michele Polese, Marco Fiore, Tommaso Melodia

机构 * IMDEA Networks Institute(IMDEA网络研究所) Northeastern University(东北大学) Universidad Carlos III de Madrid(马德里卡洛斯三世大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 SIA通过融合符号AI与知识图谱,实现前瞻性深度强化学习的实时可解释性,提升网络控制的透明度和效率。

Comments 10 pages, 12 figures, accepted at IEEE INFOCOM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22024 2026-01-30 cs.NI cs.AI 57%

SymbXRL: Symbolic Explainable Deep Reinforcement Learning for Mobile Networks

SymbXRL:符号可解释深度强化学习用于移动网络

Abhishek Duttagupta, MohammadErfan Jabbari, Claudio Fiandrino, Marco Fiore, Joerg Widmer

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 SymbXRL通过符号AI生成可解释的DRL解释,提升网络决策的透明度和可控性。

Comments 10 pages, 9 figures, published in IEEE INFOCOM 2025

Journal ref IEEE INFOCOM 2025 - IEEE Conference on Computer Communications, London, United Kingdom, 19-22 May 2025, pp. 1-10

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02492 2026-01-30 cs.RO cs.AI 57%

Industrial Internet Robot Collaboration System and Edge Computing Optimization

工业互联网机器人协作系统与边缘计算优化

Haopeng Zhao, Dajun Tao, Tian Qi, Jingyuan Xu, Zijie Zhou, Lipeng Liu

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 本文提出一种基于边缘计算的工业机器人协作系统,通过三层神经网络和模拟退火算法优化全局路径规划,提升机器人在随机环境下的导航鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21850 2026-01-28 cs.CV cs.CL 57%

SCoPE VLM: Selective Context Processing for Efficient Document Navigation in Vision-Language Models

SCoPE VLM:面向视觉语言模型高效文档导航的 selective context processing

Gyubeum Lim, Yemo Koo, Vijay Krishna Madisetti

机构 * Georgia Institute of Technology(佐治亚理工学院) Konkuk University(韩国康克伦大学)

专题命中 GUI与网页智能体 :agentic(abstract);分类 cs.CL

AI总结 SCoPE VLM通过引入滚动链机制和定制强化学习方法,实现高效文档导航,提升视觉语言模型在多页文档问答中的代理阅读能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16424 2026-01-26 cs.RO cs.AI 57%

RENEW: Risk- and Energy-Aware Navigation in Dynamic Waterways

RENEW: 动态水道中风险和能耗感知的导航

Mingi Jeong, Alberto Quattrini Li

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 RENEW通过结合风险和能耗感知策略,实现动态水道中自主水面车辆的稳健导航,首次解决自适应不可航行性和拓扑路径多样性问题。

Comments 9 pages, 10 figure, 4 tables, AAAI 2026 (main track; oral acceptance)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04083 2026-01-21 cs.NI cs.LG 57%

Cells on Autopilot: Adaptive Cell (Re)Selection via Reinforcement Learning

Cells on Autopilot: 通过强化学习实现自适应的细胞(重新)选择

Marvin Illian, Ramin Khalili, Antonio A. de A. Rocha, Lin Wang

机构 * Paderborn University, Germany(帕德博恩大学) Huawei Technologies, Germany(华为技术有限公司) Fluminense Federal University, Brazil(弗鲁米嫩塞联邦大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出CellPilot框架,通过强化学习自动学习并优化细胞(重新)选择参数,实验证明其在提升网络性能方面优于传统方法。

Comments 11 pages, 13 figures, 3 tables, v3: Added analysis of heuristic tuning trade-offs (Config-A vs Config-B) across scenarios with corresponding reference-value table; corrected performance numbers in the conclusion; no change to methodology

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12538 2026-01-21 cs.RO cs.LG 57%

EmoBipedNav: Emotion-aware Social Navigation for Bipedal Robots with Deep Reinforcement Learning

EmoBipedNav:基于深度强化学习的具有情绪感知的双足机器人社交导航

Wei Zhu, Abirath Raju, Abdulaziz Shamsah, Anqi Wu, Seth Hutchinson, Ye Zhao

机构 * Laboratory for Intelligent Decision and Autonomous Robots, Woodruff School of Mechanical Engineering, Georgia Institute of Technology(智能决策与自主机器人实验室,伍德鲁夫机械工程学院,佐治亚理工学院) College of Engineering and Petroleum, Kuwait University(工程与石油学院,科威特大学) School of Computational Science and Engineering, Georgia Institute of Technology(计算科学与工程学院,佐治亚理工学院) Khoury College of Computer Sciences, Northeastern University(计算机科学学院,东北大学)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.LG

AI总结 EmoBipedNav通过深度强化学习实现双足机器人在社交环境中的情绪感知导航,结合运动约束与社交动态,提升安全性和交互效率。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10911 2026-01-19 cs.LG 57%

Realistic Curriculum Reinforcement Learning for Autonomous and Sustainable Marine Vessel Navigation

现实课程强化学习用于自主可持续海洋船舶导航

Zhang Xiaocai, Xiao Zhe, Liang Maohan, Liu Tao, Li Haijiang, Zhang Wenbin

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出基于现实课程强化学习的框架,结合数据驱动的海洋模拟和机器学习预测模块,以实现自主且可持续的船舶导航。

Comments Present in The 40th Annual AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09770 2026-01-16 cs.AI 57%

GUI-Eyes: Tool-Augmented Perception for Visual Grounding in GUI Agents

GUI-Eyes: 用于GUI代理视觉接地的工具增强感知

Chen Chen, Jiawei Shao, Dakuan Lu, Haoyi Hu, Xiangcheng Liu, Hantao Yao, Wu Liu

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 GUI-Eyes通过分阶段策略推理和细粒度奖励反馈实现工具感知主动感知,显著提升GUI代理的接地准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09248 2026-01-15 cs.CV cs.AI 57%

Hybrid guided variational autoencoder for visual place recognition

混合引导变分自编码器用于视觉地点识别

Ni Wang, Zihan You, Emre Neftci, Thorben Schoepe

机构 * Amazon Development Center Germany GmbH, Berlin, Germany(亚马逊德国开发中心) Southeast University, Nanjing, China(东南大学) Forschungszentrum Jülich GmbH, Aachen, Germany(尤利希研究中心) imec, Luven, Belgium(imec)

专题命中 GUI与网页智能体 :autonomous agent(abstract);分类 cs.AI

AI总结 本文提出一种混合引导变分自编码器用于视觉地点识别,结合事件视觉传感器和脉冲神经网络,实现紧凑、鲁棒且具有泛化能力的模型,提升移动机器人导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08868 2026-01-15 cs.CV cs.AI cs.RO 57%

Residual Cross-Modal Fusion Networks for Audio-Visual Navigation

残差跨模态融合网络用于音频视觉导航

Yi Wang, Yinfeng Yu, Bin Ren

机构 * School of Computer Science and Technology, Xinjiang University, Urumqi, China(新疆大学计算机科学与技术学院) Joint International Research Laboratory of Silk Road Multilingual Cognitive(丝绸之路多语认知联合国际实验室) School of Mechatronic Engineering and Automation Shanghai University, Shanghai, China(上海大学机电工程与自动化学院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出残差跨模态融合网络,通过双向残差交互实现音频视觉信息互补建模,提升跨域导航性能。

Comments Main paper (10 pages). Accepted for publication by the 14th international conference on Computational Visual Media (CVM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06806 2026-01-13 cs.CV cs.AI cs.RO 57%

SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation

SpatialNav: 利用空间场景图进行零样本视觉-语言导航

Jiwen Zhang, Zejun Li, Siyuan Wang, Xiangyu Shi, Zhongyu Wei, Qi Wu

机构 * Fudan University, Shanghai, China(复旦大学) University of Southern California, Los Angeles, USA(南加州大学) Australian Institute for Machine Learning, Adelaide University, Australia(澳大利亚机器学习研究所) Shanghai Innovation Institute, Shanghai, China(上海创新研究院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 SpatialNav通过构建空间场景图,利用全局空间表示提升零样本视觉-语言导航的效率与性能。

Comments 11 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21799 2026-01-08 cs.AI 57%

D-Artemis: A Deliberative Cognitive Framework for Mobile GUI Multi-Agents

D-Artemis:一种用于移动GUI多智能体的 deliberative 认知框架

Hongze Mi, Yibo Feng, Wenjie Lu, Yuqi Wang, Jinyuan Li, Song Cao, He Cui, Tengfei Tian, Xuelin Zhang, Haotian Luo, Di Sun, Jun Fang, Hua Chai, Naiqiang Tan, Gang Pan

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 D-Artemis通过引入细粒度提示检索和主动对齐机制,提升移动GUI多智能体任务的执行成功率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00116 2026-01-05 cs.LG cs.RO 57%

GRL-SNAM: Geometric Reinforcement Learning with Path Differential Hamiltonians for Simultaneous Navigation and Mapping in Unknown Environments

GRL-SNAM:基于路径微分哈密顿量的几何强化学习用于未知环境中的同时导航与建图

Aditya Sai Ellendula, Yi Wang, Minh Nguyen, Chandrajit Bajaj

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.LG

AI总结 GRL-SNAM通过局部能量优化实现未知环境中的同时导航与建图,利用受控哈密顿优化提升导航质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22942 2026-01-01 cs.RO cs.AI 57%

AINav: Large Language Model-Based Adaptive Interactive Navigation

AINav: 基于大语言模型的自适应交互导航

Kangjie Zhou, Yao Mu, Haoyang Song, Yi Zeng, Pengying Wu, Han Gao, Chang Liu

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) AI Institute, School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院人工智能研究所)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 AINav通过基于大语言模型的自适应交互导航方法,实现复杂环境中的路径规划与目标达成。

Comments 13 pages, 12 figures, accepted to IEEE Robotics & Automation Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏