Learning to Accelerate Vision-Language-Action Models through Adaptive Visual Token Caching
通过自适应视觉令牌缓存学习加速视觉-语言-动作模型
Yujie Wei, Jiahan Fan, Jiyu Guo, Ruichen Zhen, Rui Shao, Xiu Su, Zeke Xie, Shuo Yang
机构
*
Harbin Institute of Technology(哈尔滨工业大学)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Meituan Academy of Robotics Shenzhen, Meituan(美团机器人深圳研究院)
;
Central South University(中南大学)
;
HKUST(GZ)(香港科技大学(广州))
Multi-Objective Multi-Fidelity Bayesian Optimization with Causal Priors
多目标多保真度贝叶斯优化与因果先验
Md Abir Hossen, Mohammad Ali Javidian, Vignesh Narayanan, Jason M. O'Kane, Pooyan Jamshidi
机构
*
Department of Computer Science
;
Engineering, University of South Carolina, SC, USA
;
Computer Science Department, Appalachian State University, NC, USA
;
Engineering, Texas A\&M University, TX, USA
机构
*
College of AI, Tsinghua University(清华大学人工智能学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
AIR, Tsinghua University(清华大学人工智能研究院)
;
TARS
;
College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)
Inject Once Survive Later: Backdooring Vision-Language-Action Models to Persist Through Downstream Fine-tuning
一次注入,后期存活:向视觉-语言-动作模型注入后门以在下游微调中持续存在
Jianyi Zhou, Yujie Wei, Ruichen Zhen, Bo Zhao, Xiaobo Xia, Rui Shao, Xiu Su, Shuo Yang
机构
*
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Meituan Academy of Robotics Shenzhen, Meituan(美团机器人深圳研究院)
;
Shanghai Jiaotong University(上海交通大学)
;
National University of Singapore(新加坡国立大学)
;
Central South University(中南大学)