CAMP-VQA: Caption-Embedded Multimodal Perception for No-Reference Quality Assessment of Compressed Video
机构 * School of Computer Science, University of Bristol(布里斯托大学计算机科学学院)
专题命中 视觉问答 :vision-language model(abstract);分类 cs.CV
Comments 14 pages, 6 figures