MT-Video-Bench: A Holistic Video Understanding Benchmark for Evaluating Multimodal LLMs in Multi-Turn Dialogues
MT-Video-Bench: 一个多轮对话中评估多模态大语言模型的综合视频理解基准
机构 * Fudan University(复旦大学) ; NJU-LINK Team, Nanjing University(南京大学NJU-LINK团队) ; University of Science and Technology of China(中国科学技术大学) ; Kuaishou Technology(快手科技)
专题命中 视频数据与评测 :video understanding(title,abstract);分类 cs.CV
AI总结 MT-Video-Bench通过评估多轮对话中多模态大语言模型的6项核心能力,揭示其在处理多轮视频对话任务中的性能差异和局限性。
Comments Project Website: https://github.com/NJU-LINK/MT-Video-Bench