机构
*
Bosch Corporate Research, Bosch (China) Investment Ltd.(博世企业研究,博世(中国)投资有限公司)
;
School of Communication and Information Engineering, Shanghai University(上海大学通信与信息工程学院)
Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process
统一扩散VLA:通过联合离散去噪扩散过程实现视觉-语言-动作模型
Jiayi Chen, Wenxuan Song, Pengxiang Ding, Ziyang Zhou, Han Zhao, Feilong Tang, Donglin Wang, Haoang Li
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Westlake University(西交大学)
;
Zhejiang University(浙江大学)
;
Monash University(墨尔本大学)
FD-VLA: Force-Distilled Vision-Language-Action Model for Contact-Rich Manipulation
FD-VLA:力感知的视觉-语言-动作模型用于接触密集的 manipulation
Ruiteng Zhao, Wenshuo Wang, Yicheng Ma, Xiaocong Li, Francis E. H. Tay, Marcelo H. Ang, Haiyue Zhu
机构
*
Advanced Robotics Centre, National University of Singapore(新加坡国立大学先进机器人中心)
;
School of Electrical & Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)
;
College of Information Science and Technology, Eastern Institute of Technology(东部技术学院信息科学与技术学院)
;
John A. Paulson School of Engineering and Applied Sciences, Harvard University(哈佛大学约翰·A·保罗森工程与应用科学学院)
;
Advanced Robotics Centre at National University of Singapore(新加坡国立大学先进机器人中心)
;
Singapore Institute of Manufacturing Technology, Agency for Science, Technology and Research (A*STAR)(新加坡制造技术研究所,科技研究局(A*STAR))
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Zhongguancun Academy, Beijing, China(中关村学院)
;
Shanghai Jiao Tong University(上海交通大学)
;
Tsinghua University(清华大学)
;
Eastern Institute of Technology, Ningbo(宁波东部科技研究院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Nankai University(南开大学)
Spec-VLA: Speculative Decoding for Vision-Language-Action Models with Relaxed Acceptance
Songsheng Wang, Rucheng Yu, Zhihang Yuan, Chao Yu, Feng Gao, Yu Wang, Derek F. Wong
机构
*
NICS-EFC Lab, Department of Electronic Engineering, Tsinghua University(清华大学电子工程系NICS-EFC实验室)
;
Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学系)
;
Infinigence AI
;
Tsinghua University(清华大学)
;
Zhongguancun Academy(中关村学院)
TORL-VLA: Tactile Guided Online Reinforcement Learning for Contact-Rich Manipulation
TORL-VLA:触觉引导的在线强化学习用于接触丰富操作
Huaihang Zheng, Yi Yang, Kai Ma, Shenglin Xu, Tian Xie, Guozheng Li, Xiangyu Wang, Yiren Ma, Si Liu, Yinian Mao, Baoxu Liu
机构
*
Meituan(美团)
;
Beijing Institute of Technology(北京理工大学)
;
Beihang University(北京航空航天大学)
;
State Key Lab of Multimodal Artificial Intelligence Systems, Institute of Automation, CAS(中国科学院自动化研究所多模态人工智能系统国家重点实验室)
;
China University of Mining and Technology (Beijing)(中国矿业大学(北京))
机构
*
Stanford University(斯坦福大学)
;
Technical University of Munich(慕尼黑技术大学)
;
University of Washington(华盛顿大学)
;
Allen Institute for Artificial Intelligence(人工智能研究院)
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Westlake University(西湖大学)
;
Zhejiang University(浙江大学)
;
OpenHelix Team(OpenHelix团队)
;
State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
机构
*
Beijing Academy of Artificial Intelligence, BAAI(北京人工智能研究院)
;
Institute for AI Industry Research (AIR), Tsinghua Univeristy(清华大学人工智能产业研究院)
;
Nanyang Technological University(南洋理工大学)
DeepThinkVLA: Enhancing Reasoning Capability of Vision-Language-Action Models
DeepThinkVLA: 提升视觉-语言-动作模型的推理能力
Cheng Yin, Yankai Lin, Wang Xu, Sikyuen Tam, Xiangrui Zeng, Zhiyuan Liu, Zhouping Yin
机构
*
Department of Computer Science and Technology, Tsinghua University, China(清华大学计算机科学与技术系)
;
Gaoling School of Artificial Intelligence, Renmin University of China, China(中国人民大学 Gallagher 人工智能学院)
;
Beijing Zhongguancun Academy, China(北京中关村学院)
专题命中
VLA模型
:vision-language-action(title,abstract_cn);action model(title);VLA(abstract,abstract_cn);vision language action(abstract)
VLAFlow: A Unified Training Framework for Vision-Language-Action Models via Co-training and Future Latent Alignment
VLAFlow:通过协同训练和未来潜在对齐的视觉-语言-动作模型统一训练框架
Guoyang Xia, Fengfa Li, Hongjin Ji, Lei Ren, Fangxiang Feng, Kun Zhan, Yan Xie
机构
*
Li Auto Inc.(理想汽车)
;
School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))