VLAW: Iterative Co-Improvement of Vision-Language-Action Policy and World Model
VLAW: 视觉-语言-动作策略与世界模型的迭代共改进
机构 * Stanford University(斯坦福大学) ; Tsinghua University(清华大学)
专题命中 动作与事件理解 :video generation(abstract)
AI总结 本文提出通过迭代改进视觉-语言-动作策略与世界模型,提升真实机器人任务的性能和可靠性。
Comments Project Page: https://sites.google.com/view/vlaw-arxiv