VLIC: Vision-Language Models As Perceptual Judges for Human-Aligned Image Compression
VLIC: 基于视觉-语言模型的人类对齐图像压缩感知判官
机构 * Stanford University(斯坦福大学) ; Google Research(谷歌研究) ; Google DeepMind(谷歌DeepMind)
AI总结 VLIC利用视觉-语言模型进行图像压缩,通过零样本推理实现人类感知对齐,提升压缩性能。
Comments 14 pages, 8 figures