JARVIS-VLA: Post-Training Large-Scale Vision Language Models to Play Visual Games with Keyboards and Mouse
机构 * Peking University(北京大学) ; BIGAI(大疆创新)
专题命中 VLA模型 :VLA(title,abstract);分类 cs.CV、cs.AI
Comments Accepted by ACL 2025
视觉与机器人
视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。
机构 * Peking University(北京大学) ; BIGAI(大疆创新)
专题命中 VLA模型 :VLA(title,abstract);分类 cs.CV、cs.AI
Comments Accepted by ACL 2025
专题命中 VLA模型 :VLA(abstract)
Comments 14 pages, 6 figures