Decoupling Perception from Reasoning for Hallucination-Resistant Video Understanding
解耦感知与推理以实现抗幻觉的视频理解
机构 * University of Science and Technology of China(中国科学技术大学)
专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);post-training(abstract)
AI总结 本文提出DPL模型,通过解耦感知与推理以提升视频理解的抗幻觉能力,引入感知奖励和FAE评估器,有效提高训练后性能和数据效率。
Comments 17 pages, 8 figures