Learning to Accelerate Vision-Language-Action Models through Adaptive Visual Token Caching
通过自适应视觉令牌缓存学习加速视觉-语言-动作模型
Yujie Wei, Jiahan Fan, Jiyu Guo, Ruichen Zhen, Rui Shao, Xiu Su, Zeke Xie, Shuo Yang
机构
*
Harbin Institute of Technology(哈尔滨工业大学)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Meituan Academy of Robotics Shenzhen, Meituan(美团机器人深圳研究院)
;
Central South University(中南大学)
;
HKUST(GZ)(香港科技大学(广州))
APEX: A Decoupled Memory-based Explorer for Asynchronous Aerial Object Goal Navigation
APEX:一种解耦的记忆型探索者用于异步空中目标导航
Daoxuan Zhang, Ping Chen, Xiaobo Xia, Xiu Su, Ruichen Zhen, Jianqiang Xiao, Shuo Yang
机构
*
Harbin Institute of Technology(哈尔滨工业大学)
;
National University of Singapore(新加坡国立大学)
;
Central South University(中南大学)
;
Meituan Academy of Robotics(美团机器人研究院)
Inject Once Survive Later: Backdooring Vision-Language-Action Models to Persist Through Downstream Fine-tuning
一次注入,后期存活:向视觉-语言-动作模型注入后门以在下游微调中持续存在
Jianyi Zhou, Yujie Wei, Ruichen Zhen, Bo Zhao, Xiaobo Xia, Rui Shao, Xiu Su, Shuo Yang
机构
*
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Meituan Academy of Robotics Shenzhen, Meituan(美团机器人深圳研究院)
;
Shanghai Jiaotong University(上海交通大学)
;
National University of Singapore(新加坡国立大学)
;
Central South University(中南大学)