RobustVLA: On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations
针对多模态扰动的视觉-语言-动作模型的鲁棒性
专题命中 图文多模态 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV、cs.AI
AI总结 本研究提出RobustVLA,通过多模态鲁棒优化提升视觉-语言-动作模型在多种扰动下的鲁棒性,实验表明其在性能和推理速度上均优于现有方法。
Comments Published as a conference paper at ICLR 2026