JARVIS-VLA: Post-Training Large-Scale Vision Language Models to Play Visual Games with Keyboards and Mouse
机构 * Peking University(北京大学) ; BIGAI(大疆创新)
专题命中 后训练与偏好优化 :language model(title,abstract);post-training(title,abstract);分类 cs.AI
Comments Accepted by ACL 2025