Just Noticeable Difference Modeling for Token Compression in Vision-Language-Action Models
视觉-语言-动作模型中用于令牌压缩的刚可察觉差异建模
机构 * The Hong Kong Polytechnic University(香港理工大学) ; Nanyang Technological University(南洋理工大学) ; Bytedance Inc.(字节跳动公司) ; Shandong University(山东大学) ; CNRS(法国国家科学研究中心) ; CentraleSupelec(中央理工学院) ; Université Paris-Saclay(巴黎萨克雷大学)
AI总结 本文针对视觉-语言-动作模型的令牌压缩问题,提出Action-JND方法,通过动作容忍度准则优化压缩,在LIBERO基准实验中提升了激进压缩下的压缩可靠性。
Comments 15 pages, 5 figures