TUNA: Taming Unified Visual Representations for Native Unified Multimodal Models
TUNA: 降低统一视觉表示以适应原生统一多模态模型
机构 * Meta BizAI ; University of Waterloo(滑铁卢大学)
专题命中 视频理解 :video generation(abstract);video understanding(abstract);分类 cs.CV
AI总结 TUNA通过统一视觉表示提升多模态模型的性能,实现端到端理解和生成任务的高效处理。
Comments Project page: https://tuna-ai.org/