LabVLA: Grounding Vision-Language-Action Models in Scientific Laboratories
LabVLA:在科学实验室中落地视觉-语言-动作模型
机构 * Zhejiang University(浙江大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Harbin Institute of Technology(哈尔滨工业大学)
专题命中 GUI与屏幕智能体 :grounding(title);分类 cs.AI、cs.LG
AI总结 针对科学实验室中机器人执行协议面临的数据和实体瓶颈,提出模拟数据引擎RoboGenesis和两阶段训练策略LabVLA,在LabUtopia基准上取得最高平均成功率。
Comments Work in progress. Project website at https://zjunlp.github.io/LabVLA/