VIG: Visual Information Gain as a Reward Signal for Multimodal Chain-of-Thought Compression
VIG:作为多模态思维链压缩奖励信号的视觉信息增益
机构 * School of Software Engineering, Huazhong University of Science and Technology(华中科技大学软件学院) ; Tsinghua University(清华大学)
AI总结 该研究提出VIG奖励机制,通过提升视觉信息密度优化多模态CoT的准确率与效率权衡,无需额外资源,在多类基准及不同规模模型上均有效。
Comments Accepted by EMNLP 2026 Findings