RMAdapter: Reconstruction-based Multi-Modal Adapter for Vision-Language Models
RMAdapter: 基于重建的多模态适配器用于视觉-语言模型
专题命中 图文多模态 :multi-modal(title);multimodal(abstract);分类 cs.CV、cs.AI、cs.MM
AI总结 RMAdapter通过双分支架构平衡通用与任务特定知识,提升视觉-语言模型在多模态迁移学习中的性能。
Comments Accepted by AAAI 2026(Oral)