Scaling Verification Can Be More Effective than Scaling Policy Learning for Vision-Language-Action Alignment
在视觉-语言-动作对齐中,验证比策略学习更具效率
机构 * Stanford University(斯坦福大学) ; NVIDIA Research(NVIDIA研究)
AI总结 本文提出CoVer-VLA验证方法,通过测试时验证在视觉-语言-动作对齐中实现22%的在分布和13%的分布外收益,同时在现实世界实验中进一步提升45%。