arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-01-08 至 2026-01-08 共收录 2 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 2 篇

2601.03449 2026-01-08 cs.RO 70%

FIRE-VLM: A Vision-Language-Driven Reinforcement Learning Framework for UAV Wildfire Tracking in a Physics-Grounded Fire Digital Twin

FIRE-VLM:一种基于视觉-语言驱动的强化学习框架,用于在物理基础火灾数字孪生中无人机火灾跟踪

Chris Webb, Mobin Habibpour, Mayamin Hamid Raha, Ali Reza Tavakkoli, Janice Coen, Fatemeh Afghah

机构 * Clemson University(克莱姆森大学) University of Nevada, Reno(内华达大学拉斯维加斯分校) NSF NCAR(国家科学基金会NCAR)

专题命中 模仿学习与强化学习 :embodied agent(abstract);navigation(abstract);分类 cs.RO

AI总结 FIRE-VLM是一种基于视觉-语言模型的强化学习框架,用于在物理基础火灾数字孪生中实现无人机火灾跟踪,通过结合物理术语与VLM语义的奖励设计,提升了火灾检测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01206 2026-01-08 cs.RO 57%

Action Tokenizer Matters in In-Context Imitation Learning

动作分词器在上下文模仿学习中的重要性

An Dinh Vuong, Minh Nhat Vu, Dong An, Ian Reid

机构 * Department of Computer Vision, Mohammed bin Zayed University of Artificial Intelligence(计算机视觉系,穆罕默德·本·扎耶德人工智能大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

AI总结 本文提出LipVQ-VAE,通过强制潜在动作空间的Lipschitz条件,提升上下文模仿学习中动作的稳定性和平滑性。

Comments IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏