Self-Improving Vision-Language-Action Models with Data Generation via Residual RL
机构 * NVIDIA(NVIDIA公司) ; CMU(卡内基梅隆大学) ; UC Berkeley(加州大学伯克利分校) ; UT Austin(德克萨斯大学奥斯汀分校)
专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.RO、cs.CV
Comments 26 pages