CoA-VLA: Improving Vision-Language-Action Models via Visual-Textual Chain-of-Affordance
机构 * Shanghai University(上海大学) ; Midea Group(美的集团) ; East China Normal University(华东师范大学)
专题命中 机器人基础模型 :robot foundation model(abstract);robot policy(abstract);分类 cs.RO
Comments Project webpage is available at https://chain-of-affordance.github.io