Benchmarking the Trustworthiness in Multimodal LLMs for Video Understanding
对多模态大语言模型在视频理解中的可信度进行基准测试
机构 * Hefei University of Technology(合肥工业大学) ; Tsinghua University(清华大学) ; Institute of Science Tokyo(东京科学研究所)
专题命中 视频多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
AI总结 本研究提出Trust-videoLLMs基准,评估23种视频LLMs在真实性、鲁棒性、安全性和隐私等方面的表现,揭示其在动态场景理解及现实风险缓解中的局限性。