Hybrid Token Compression for Vision-Language Models
HybridToken-VLM:用于视觉-语言模型的混合令牌压缩
机构 * Sun Yat-sen University(中山大学) ; Princeton University(普林斯顿大学) ; Snap Inc(Snap公司)
AI总结 HybridToken-VLM通过混合令牌压缩技术,在保持性能的同时显著提升视觉-语言模型的效率
Comments Accepted at CVPR 2026. Code available at https://github.com/jushengzhang/HybridToken-VLM