Structured Redundancy Modeling for Efficient Visual Token Pruning in High-Resolution MLLMs
用于高分辨率多模态大语言模型中高效视觉令牌剪枝的结构化冗余建模
机构 * LG Electronics(LG电子) ; Pusan National University(釜山国立大学)
专题命中 效率与部署 :large language model(abstract);language model(abstract)
AI总结 针对高分辨率多模态大语言模型视觉令牌爆炸致延迟瓶颈问题,提出单向前向剪枝器SFPruner,通过语义引导岭杠杆方案和基于排名的方向掩码两个互补机制,在单次前向传递中实现冗余感知重要性选择,有效减少令牌选择时间并保持性能。
Comments Accepted to ECCV 2026