2512.02014
2025-12-02
cs.CV
57%
TUNA: Taming Unified Visual Representations for Native Unified Multimodal Models
TUNA: 降低统一视觉表示以适应原生统一多模态模型
Zhiheng Liu, Weiming Ren, Haozhe Liu, Zijian Zhou, Shoufa Chen, Haonan Qiu, Xiaoke Huang, Zhaochong An, Fanny Yang, Aditya Patel, Viktar Atliha, Tony Ng, Xiao Han, Chuyan Zhu, Chenyang Zhang, Ding Liu, Juan-Manuel Perez-Rua, Sen He, Jürgen Schmidhuber, Wenhu Chen, Ping Luo, Wei Liu, Tao Xiang, Jonas Schult, Yuren Cong
机构
*
Meta BizAI
;
University of Waterloo(滑铁卢大学)
专题命中
图像编辑
:image editing(abstract);分类 cs.CV
AI总结
TUNA通过统一视觉表示提升多模态模型的性能,实现端到端理解和生成任务的高效处理。