CounterVid: Counterfactual Video Generation for Mitigating Action and Temporal Hallucinations in Video-Language Models
CounterVid: 通过生成反事实视频缓解视频-语言模型中动作和时间幻觉
机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) ; University of Pisa(帕尔马大学) ; Amazon Prime Video(亚马逊Prime视频)
专题命中 视频生成 :video generation(title,abstract);video-language(title,abstract);分类 cs.CV、cs.MM
AI总结 CounterVid通过生成反事实视频缓解视频-语言模型中动作和时间幻觉问题,提出反事实视频生成框架和MixDPO方法,提升时间推理和动作识别性能。