CF-VLA: Efficient Coarse-to-Fine Action Generation for Vision-Language-Action Policies
CF-VLA:面向视觉-语言-动作策略的高效粗到细动作生成
Fan Du, Feng Yan, Jianxiong Wu, Xinrun Xu, Weiye Zhang, Weinong Wang, Yu Guo, Bin Qian, Zhihai He, Fei Wang, Heng Yang
机构
*
Southern University of Science and Technology(南方科技大学)
;
Xi’an Jiaotong University(西安交通大学)
;
United Nova Technology(联合Nova技术)
;
University of Science and Technology of China(中国科学技术大学)
机构
*
McGill University(麦吉尔大学)
;
Université de Montréal(蒙特利尔大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Mila – Quebec AI Institute(魁北克AI研究所)
Vision Language Action (VLA) Models for Unmanned Aerial Robotics and Bimanual Manipulation: A Review
用于无人机机器人和双手操作的视觉语言动作(VLA)模型综述
Inkyu Sa, Chanoh Park, Hea-Min Lee, Donghee Noh, Ho Seok Ahn
机构
*
Chef Robotics
;
RovifyLab
;
IT Application Research Center, Jeonbuk Regional Branch
;
Department of Electrical, Computer and Software Engineering(电气与计算机软件工程系)
专题命中
VLA模型
:VLA(title,title_cn);vision language action(title,abstract);分类 cs.RO、cs.AI、cs.LG
机构
*
Zhejiang University(浙江大学)
;
Cornell University(康奈尔大学)
;
National University of Singapore(新加坡国立大学)
;
Xi'an University of Electronic Science and Technology(西安电子科技大学)
CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models
Qingqing Zhao, Yao Lu, Moo Jin Kim, Zipeng Fu, Zhuoyang Zhang, Yecheng Wu, Zhaoshuo Li, Qianli Ma, Song Han, Chelsea Finn, Ankur Handa, Ming-Yu Liu, Donglai Xiang, Gordon Wetzstein, Tsung-Yi Lin
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
ALAM:基于代数一致的潜在动作模型用于视觉-语言-动作模型
Zuojin Tang, Haoyun Liu, Xinyuan Chang, Changjie Wu, Dongjie Huo, Yandan Yang, Bin Liu, Zhejia Cai, Feng Xiong, Mu Xu, jiachen Luo, De Ma, Zhiheng Ma, Gang Pan
机构
*
Zhejiang University(浙江大学)
;
Amap, Alibaba Group(阿里集团阿地图)
;
Nanjing University(南京大学)
;
Shenzhen University of Advanced Technology(深圳先进技术大学)
;
Beijing University of Chemical Technology(北京化工大学)
;
Embodied Intelligence General Platform Laboratory, Chery Auto(奇瑞汽车 embodied intelligence 通用平台实验室)
;
Tsinghua University(清华大学)
;
Queen Mary University of London(伦敦大学玛丽女王学院)