ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning
机构 * NVIDIA ; National Taiwan University(国立台湾大学)
专题命中 VLA模型 :vision-language-action(title,abstract);VLA(abstract,comments);action model(abstract);分类 cs.RO、cs.CV、cs.AI
Comments NeurIPS 2025. Project page: https://jasper0314-huang.github.io/thinkact-vla/