arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-02 至 2026-02-02 共收录 52 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2512.06013 2026-02-02 cs.CV cs.RO 79%

VAT: Vision Action Transformer by Unlocking Full Representation of ViT

通过解锁ViT的完整表示构建视觉动作变换器

Wenhao Li, Chengwei Ma, Weixin Mao

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 机器人学习 :robot learning(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 VAT通过解锁ViT的完整表示,提出了一种新的视觉动作变换器架构,实现了在模拟操作任务中98.15%的成功率,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23285 2026-02-02 cs.RO cs.AI cs.HC cs.LG 75%

End-to-end Optimization of Belief and Policy Learning in Shared Autonomy Paradigms

端到端优化信念与策略学习在共享自主性范式中的应用

MH Farhadi, Ali Rabiee, Sima Ghafoori, Anna Cetera, Andrew Fisher, Reza Abiri

机构 * University of Rhode Island(罗德岛大学)

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 BRACE框架通过整合信念信息与策略学习,提升了机器人在复杂目标模糊场景中的自主性和效率,实现了更高的成功率和路径效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 16 篇

2508.19236 2026-02-02 cs.RO cs.CV 88%

MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation

MemoryVLA: 视觉-语言-动作模型中用于机器人操作的感知-认知记忆

Hao Shi, Bin Xie, Yingfei Liu, Lin Sun, Fengrong Liu, Tiancai Wang, Erjin Zhou, Haoqiang Fan, Xiangyu Zhang, Gao Huang

机构 * Department of Automation, BNRist, Tsinghua University(自动化系、BNRist、清华大学) Dexmal MEGVII Technology(MEGVII技术) Tianjin University(天津大学) Harbin Institute of Technology(哈尔滨工业大学) StepFun

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 MemoryVLA通过结合感知与认知记忆机制,提升机器人操作中长时间跨度任务的性能,实现对时间依赖任务的高效处理。

Comments ICLR 2026 | The project is available at https://shihao1895.github.io/MemoryVLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22988 2026-02-02 cs.RO 88%

Learning Geometrically-Grounded 3D Visual Representations for View-Generalizable Robotic Manipulation

学习几何基础的3D视觉表示以实现视图通用的机器人操作

Di Zhang, Weicheng Duan, Dasen Gu, Hongye Lu, Hai Zhang, Hang Yu, Junqiao Zhao, Guang Chen

机构 * Tongji University(同济大学) The University of Hong Kong(香港大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出MethodName框架,通过单视角3D预训练和多步蒸馏实现机器人操作的视图通用性,实验显示其在成功率和视图泛化能力上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22672 2026-02-02 cs.RO 84%

Postural Virtual Fixtures for Ergonomic Physical Interactions with Supernumerary Robotic Bodies

姿态虚拟障碍物用于人机交互中的人体工程学物理互动

Theodora Kastritsi, Marta Lagomarsino, Arash Ajoudani

机构 * Human-Robot Interfaces and Interaction Laboratory, Istituto Italiano di Tecnologia, Genoa, Italy(人机交互实验室,意大利理工学院,热那亚,意大利)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出一种基于虚拟障碍物的人体工程学控制框架,通过触觉反馈促进用户形成正确的物理交互姿势。

Comments Published in The International Journal of Robotics Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20321 2026-02-02 cs.RO 83%

TaF-VLA: Tactile-Force Alignment in Vision-Language-Action Models for Force-aware Manipulation

TaF-VLA:面向力感知操控的视觉-语言-动作模型中的触觉-力对齐

Yuzhe Huang, Pei Lin, Wanlin Li, Daohan Li, Jiajun Li, Jiaming Jiang, Chenxi Xiao, Ziyuan Jiao

机构 * Beihang University(北航大学) ShanghaiTech University(上海科技大学) Beijing Institute for General Artificial Intelligence(北京一般人工智能研究院) The University of Hong Kong(香港大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 TaF-VLA通过触觉-力对齐提升视觉-语言-动作模型在力感知操控中的性能。

Comments 17pages,9fig

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17961 2026-02-02 cs.RO 79%

RoboArmGS: High-Quality Robotic Arm Splatting via Bézier Curve Refinement

RoboArmGS: 通过贝塞尔曲线精修实现高质量的机器人手臂泼溅

Hao Wang, Xiaobao Wei, Ying Li, Qingpo Wuwu, Dongli Wu, Jiajun Cao, Ming Lu, Wenzhao Zheng, Shanghang Zhang

机构 * Peking University(北京大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 RoboArmGS通过可学习的贝塞尔曲线精修URDF编排运动,实现高质量机器人手臂运动建模和渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22686 2026-02-02 cs.RO 79%

FlyAware: Inertia-Aware Aerial Manipulation via Vision-Based Estimation and Post-Grasp Adaptation

FlyAware: 基于视觉估计与抓取后适应的惯性感知空中 manipulation

Biyu Ye, Na Fan, Zhengping Fan, Weiliang Deng, Hongming Chen, Qifeng Chen, Ximin Lyu

机构 * School of Intelligent Systems Engineering, Sun Yat-sen University(中山大学智能系统工程学院) Visual Intelligence Lab, Cheng Kar-Shun Robotics Institute, The Hong Kong University of Science and Technology(香港科技大学成卡顺机器人研究所视觉智能实验室) Differential Robotics Technology Company, Ltd.(差分机器人技术有限公司)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 FlyAware 通过基于视觉的预抓取惯性估计与抓取后适应机制,实现空中 manipulators 的稳健操控,验证了其在复杂惯性参数下的有效性。

Comments 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22356 2026-02-02 cs.LG cs.RO 79%

PoSafeNet: Safe Learning with Poset-Structured Neural Nets

PoSafeNet: 基于偏序结构神经网络的安全学习

Kiwan Wong, Wei Xiao, Daniela Rus

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Worcester Polytechnic Institute(沃斯特理工学院)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 PoSafeNet通过偏序结构神经网络实现安全学习,通过可微神经安全层在偏序一致约束顺序下进行闭式投影,提升机器人系统在多障碍导航、受约束操作和自动驾驶中的可行性、鲁棒性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20835 2026-02-02 cs.CV cs.AI 73%

Open-Vocabulary Functional 3D Human-Scene Interaction Generation

开放词汇功能3D人类-场景交互生成

Jie Liu, Yu Sun, Alpar Cseke, Yao Feng, Nicolas Heron, Michael J. Black, Yan Zhang

机构 * Meshcapade University of Amsterdam(阿姆斯特丹大学) Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所) Stanford University(斯坦福大学)

专题命中 机器人操作 :robotics(abstract);embodied AI(abstract);分类 cs.AI、cs.CV

AI总结 FunHSI通过功能驱动框架生成开放词汇任务下的功能正确3D人类-场景交互。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14133 2026-02-02 cs.RO cs.CV 73%

TwinBrainVLA: Unleashing the Potential of Generalist VLMs for Embodied Tasks via Asymmetric Mixture-of-Transformers

TwinBrainVLA: 通过非对称Transformer混合释放通用视觉语言模型在具身任务中的潜力

Bin Yu, Shijie Lian, Xiaopeng Lin, Yuliang Wei, Zhaolong Shen, Changti Wu, Yuzhuo Miao, Xinming Wang, Bailing Wang, Cong Huang, Kai Chen

机构 * HIT(哈尔滨工业大学) ZGCA(中钢集团人工智能研究院) ZGCI(中钢集团智能计算研究院) HUST(华中科技大学) HKUST(GZ)(香港科技大学(广州)) BUAA(北京航空航天大学) ECNU(华东师范大学) CASIA(中国科学院自动化研究所) DeepCybo

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 TwinBrainVLA通过非对称Transformer混合机制,利用冻结的通用视觉语言模型和可训练的专家路径,实现机器人任务中的具身智能提升。

Comments GitHub: https://github.com/ZGC-EmbodyAI/TwinBrainVLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11824 2026-02-02 cs.RO cs.CV 62%

ReGlove: A Soft Pneumatic Glove for Activities of Daily Living Assistance via Wrist-Mounted Vision

ReGlove:一种软式气动手套用于日常活动辅助的腕部视觉引导系统

Rosh Ho, Jian Zhang

机构 * Department of Computer Science, Columbia University(计算机科学系,哥伦比亚大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 ReGlove通过腕部视觉引导和边缘计算实现低成本、高准确率的日常活动辅助,提供基于视觉的上肢康复解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22485 2026-02-02 cs.CR cs.AI cs.CL 57%

FraudShield: Knowledge Graph Empowered Defense for LLMs against Fraud Attacks

FraudShield: 基于知识图谱的LLM对抗欺诈攻击防御方案

Naen Xu, Jinghuai Zhang, Ping He, Chunyi Zhou, Jun Wang, Zhihui Fu, Tianyu Du, Zhaoxiang Wang, Shouling Ji

机构 * Zhejiang University(浙江大学) University of California, Los Angeles(加州大学洛杉矶分校) OPPO Research Institute(OPPO研究院) Zhejiang Key Laboratory of Decision Intelligence(浙江决策智能重点实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 FraudShield通过构建欺诈战术-关键词知识图谱,提升LLM对抗欺诈攻击的能力,实验显示其在多个LLM和欺诈类型上表现优异,且提供可解释的防御线索。

Comments WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22289 2026-02-02 cs.RO 57%

ReloPush-BOSS: Optimization-guided Nonmonotone Rearrangement Planning for a Car-like Robot Pusher

ReloPush-BOSS: 基于优化的非单调重排规划用于车式机器人推手

Jeeho Ahn, Christoforos Mavrogiannis

机构 * Department of Robotics, University of Michigan(机器人系,密歇根大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 ReloPush-BOSS通过优化预重排和深度优先搜索,实现高效非单调重排规划,适用于密集障碍环境中的车式机器人推手任务。

Comments Preprint of final version, accepted to RA-L 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20275 2026-02-02 cs.RO 57%

HAFO: A Force-Adaptive Control Framework for Humanoid Robots in Intense Interaction Environments

HAFO:一种适用于高强度交互环境的人形机器人力自适应控制框架

Chenhui Dong, Haozhe Xu, Wenhao Feng, Zhipeng Wang, Yanmin Zhou, Yifei Zhao, Bin He

机构 * Frontiers Science Center for Intelligent Autonomous Systems, Tongji University(智能自主系统前沿科学中心,同济大学) National Key Laboratory of Autonomous Intelligent Unmanned Systems(自主智能无人系统国家重点实验室) Department of Control Science and Engineering, College of Electronics and Information Engineering, Tongji University(控制科学与工程系,电子信息工程学院,同济大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 HAFO通过双智能体强化学习框架实现人形机器人在高强度交互环境中的鲁棒运动与精确操作控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23214 2026-02-02 physics.optics 50%

Optical forces, helicity, angular momentum and how they are all intertwined

光力、手性、角动量以及它们如何相互交织

Iker Gómez-Viloria, Enrique Ayllón García, Jorge Olmos-Trigo, Quimey Pears Stefano, Jon Lasa-Alonso, Martín Molezuelas-Ferreras, Gabriel Molina-Terriza

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究推导了LG光束对微米级颗粒的光学力和扭矩解析表达式,揭示了手性与轨道角动量对捕获动态的影响,并展示了切向扭矩的独特性质,为光学操控技术的发展提供了新思路。

Journal ref APL Photonics 10, 051101 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18797 2026-02-02 physics.optics 50%

On-chip control of the coherence matrix of four-mode partially coherent light: rank, entropy, and modal Stokes parameters

芯片上四模部分相干光的相干矩阵控制:秩、熵和模态斯托克斯参数

Amin Hashemi, Abbas Shiri, Bahaa E. A. Saleh, Andrea Blanco-Redondo, Ayman F. Abouraddy

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究通过芯片上的六边形网格干涉仪操控四模部分相干光的相干矩阵,实现相干秩、熵和斯托克斯参数的控制,为高维相干矩阵的合成与重建提供了可扩展的方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22414 2026-02-02 cs.SE cs.CR cs.HC 50%

PriviSense: A Frida-Based Framework for Multi-Sensor Spoofing on Android

PriviSense: 一种基于Frida的Android多传感器欺骗框架

Ibrahim Khalilov, Chaoran Chen, Ziang Xiao, Tianshi Li, Toby Jia-Jun Li, Yaxing Yao

专题命中 机器人操作 :manipulation(abstract)

AI总结 PriviSense是一种基于Frida的Android多传感器欺骗框架,用于在rooted设备上实现传感器和系统信号的实时欺骗,以支持可重复的环境敏感应用测试和隐私分析。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 7 篇

2507.07487 2026-02-02 cs.CV 79%

Online Navigation Refinement: Achieving Lane-Level Guidance by Associating Standard-Definition and Online Perception Maps

在线导航优化:通过关联标准定义和在线感知地图实现车道级引导

Jiaxu Wan, Xu Wang, Mengwei Xie, Xinyuan Chang, Xinran Liu, Zheng Pan, Mu Xu, Hong Zhang, Ding Yuan, Yifan Yang

机构 * Amap, Alibaba Group(阿里的Amap部门) School of Aerospace, BUAA(北京航空航天大学航空学院) Key Laboratory of Spacecraft Design Optimization and Dynamic Simulation Technology, Ministry of Education(教育部航天器设计优化与动态仿真技术重点实验室) State Key Laboratory of High-Efficiency Reusable Aerospace Transportation Technology(高效可重复使用航天运输技术国家重点实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出在线导航优化方法,通过关联标准定义地图与在线感知地图,实现车道级导航,提升导航精度与实时性。

Comments Author Affiliation Standardization

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22381 2026-02-02 cs.RO cs.HC 79%

Lantern: A Minimalist Robotic Object Platform

Lantern: 一种极简主义的机器人物体平台

Victor Nikhil Antony, Zhili Gong, Guanchen Li, Clara Jeon, Chien-Ming Huang

机构 * Johns Hopkins University(约翰霍普金斯大学) Rice University(里士满大学)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 Lantern通过极简主义设计和开源平台,探索人机交互场景,降低HRI研究门槛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22545 2026-02-02 cs.RO cs.AI 62%

Adapting Reinforcement Learning for Path Planning in Constrained Parking Scenarios

在受限停车场景中适应强化学习用于路径规划

Feng Tao, Luca Paparusso, Chenyi Gu, Robin Koehler, Chenxu Wu, Xinyu Huang, Christian Juette, David Paz, Ren Liu

机构 * Bosch Research(博世研究)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出了一种深度强化学习框架,用于在受限停车场景中实现高效的实时路径规划,通过序列决策问题建模和新基准的开发,实现了更高的成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22616 2026-02-02 cs.CV 57%

UniGeo: A Unified 3D Indoor Object Detection Framework Integrating Geometry-Aware Learning and Dynamic Channel Gating

UniGeo:一种整合几何感知学习和动态通道门控的统一3D室内目标检测框架

Xing Yi, Jinyang Huang, Feng-Qi Cui, Anyang Tong, Ruimin Wang, Liu Liu, Dan Guo

机构 * School of Computer Science and Information Engineering(计算机科学与信息工程学院) Institute of Advanced Technology(先进技术研究所)

专题命中 具身导航 :robotics(abstract);分类 cs.CV

AI总结 UniGeo通过几何感知学习和动态通道门控机制,提升稀疏点云场景中3D室内目标检测的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22406 2026-02-02 cs.RO 57%

Accurate Pedestrian Tracking in Urban Canyons: A Multi-Modal Fusion Approach

城市峡谷中精确的人行道跟踪:一种多模态融合方法

Shahar Dubiner, Peng Ren, Roberto Manduchi

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种多模态融合方法,通过融合GNSS和惯性数据提升城市峡谷中行人定位精度,优于单独使用GNSS或惯性导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15336 2026-02-02 cs.RO cs.SY eess.SY 57%

Adaptive Cost-Map-based Path Planning in Partially Unknown Environments with Movable Obstacles

在部分未知环境中基于自适应成本图的路径规划

Liviu-Mihai Stan, Ranulfo Bezerra, Shotaro Kojima, Tsige Tadesse Alemayoh, Satoshi Tadokoro, Masashi Konyo, Kazunori Ohno

机构 * Graduate School of Information Sciences, Tohoku University(东京大学信息科学研究生院) Tough Cyberphysical AI Research Center, Tohoku University(东京大学 Tough 联合人工智能研究中心) Sorbonne University(索邦大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出了一种自适应成本图路径规划方法,通过识别可移动障碍物提升机器人在非结构化环境中的导航能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23139 2026-02-02 cs.SE 50%

Automated Testing of Prevalent 3D User Interactions in Virtual Reality Applications

虚拟现实应用中常见3D用户交互的自动化测试

Ruizhen Gu, José Miguel Rojas, Donghwan Shin

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出XRintTest方法,通过交互流程图实现VR应用中常见3D用户交互的自动化测试,提升测试效率和覆盖率。

Comments 31 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 1 篇

2601.22647 2026-02-02 cs.AI 88%

Test-Time Mixture of World Models for Embodied Agents in Dynamic Environments

动态环境中具身智能体的测试时间世界模型混合

Jinwoo Jang, Minjong Yoo, Sihyung Yoon, Honguk Woo

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Sungkyunkwan University(庆尚大学)

专题命中 具身推理 :embodied agent(title,abstract);world model(title,abstract);分类 cs.AI

AI总结 TMoW通过测试时间更新路由函数,提升具身智能体在动态环境中的适应性与持续学习能力。

Comments Accepted at ICLR 2026. 10 pages. Code available at https://github.com/doldam0/tmow

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人基础模型 1 篇

2505.04769 2026-02-02 cs.CV 70%

Vision-Language-Action (VLA) Models: Concepts, Progress, Applications and Challenges

视觉-语言-动作(VLA)模型:概念、进展、应用与挑战

Ranjan Sapkota, Yang Cao, Konstantinos I. Roumeliotis, Manoj Karkee

机构 * Cornell University(康奈尔大学) The Hong Kong University of Science and Technology(香港科学与技术大学) University of the Peloponnese(希腊皮洛斯大学)

专题命中 机器人基础模型 :robotics(abstract);embodied agent(abstract);分类 cs.CV

AI总结 本文综述了视觉-语言-动作(VLA)模型的概念、进展、应用与挑战,探讨了其在自动驾驶、医疗机器人等领域的应用及未来发展方向。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 模仿学习与强化学习 5 篇

2505.18417 2026-02-02 cs.RO cs.AI cs.LG 82%

Reinforcement Learning for Ballbot Navigation in Uneven Terrain

基于强化学习的Ballbot在不平整地形中的导航

Achkan Salehi

机构 * VimaLabs(维马实验室)

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出基于MuJoCo的开源Ballbot模拟器,展示了通过强化学习方法有效导航不平整地形的成果。

Comments 6 pages, 9 figures, 2 tables. Version two corrects figure 4 and adds some experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13709 2026-02-02 cs.LG cs.AI 81%

Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning

基于策略驱动的世界模型适应的鲁棒性离线模型驱动强化学习

Jiayu Chen, Le Xu, Aravind Venugopal, Jeff Schneider

机构 * The University of Hong Kong, Hong Kong SAR(香港大学) INFIFORCE Intelligent Technology Co., Ltd., Hangzhou, China(INFIFORCE智能技术有限公司) Tsinghua University, Beijing, China(清华大学) Carnegie Mellon University, Pittsburgh, PA 15213, USA(卡内基梅隆大学)

专题命中 模仿学习与强化学习 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于策略驱动的世界模型适应框架,通过最大化最小优化问题和Stackelberg学习动态提升离线模型驱动强化学习的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23266 2026-02-02 cs.RO cs.AI 62%

IRL-DAL: Safe and Adaptive Trajectory Planning for Autonomous Driving via Energy-Guided Diffusion Models

IRL-DAL:通过能量引导扩散模型实现自动驾驶的安全自适应轨迹规划

Seyed Ahmad Hosseini Miangoleh, Amin Jalal Aghdasian, Farzaneh Abdollahi

机构 * Department of Electrical Engineering, Amirkabir University of Technology (Tehran Polytechnic)(电气工程系,阿米尔卡比尔技术大学(德黑兰理工大学))

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出IRL-DAL框架,通过能量引导扩散模型实现自动驾驶的安全自适应轨迹规划,结合模仿学习与强化学习,提升行驶安全性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏