Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization
Zero-WAM:基于人类视频的上下文世界-动作建模用于开放式任务泛化
专题命中 部署与泛化 :action model(title,abstract);分类 cs.RO、cs.CV
AI总结 Zero-WAM是基于人类视频的因果视频-动作模型,通过提出自动流水线构建HumanGen数据集、引入IFP目标,在RoboTwin 2.0仿真7个未见任务上平均成功率达47.0%,实现机器人操作零样本跨任务泛化。
Comments this https URL (https://robbyant-research.github.io/Zero-WAM/)