MMT-ARD: Multimodal Multi-Teacher Adversarial Distillation for Robust Vision-Language Models
MMT-ARD: 多模态多教师对抗蒸馏用于鲁棒视觉-语言模型
机构 * The City University of New York, CUNY(纽约城市大学) ; Nanyang Technological University(南洋理工大学) ; Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) ; University of Technology Sydney(悉尼技术大学) ; Data61, CSIRO(CSIRO数据61研究所) ; Shenzhen University of Advanced Technology(深圳先进技术大学)
专题命中 幻觉与鲁棒性 :vision-language model(title,abstract);分类 cs.CV
AI总结 MMT-ARD通过多教师对抗蒸馏提升视觉-语言模型的对抗鲁棒性,实验显示鲁棒精度提升4.32%,训练效率提高2.3倍。
Comments 10 pages