Video CLIP Model for Multi-View Echocardiography Interpretation
机构 * The University of Tokyo Hospital(东京大学医院)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.AI
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
机构 * The University of Tokyo Hospital(东京大学医院)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.AI
机构 * MODULABS
专题命中 其他VLM :multimodal large language model(abstract);分类 cs.AI
Comments Accepted at the 1st Workshop on Generative and Protective AI for Content Creation (NeurIPS 2025)
机构 * UCLA(加州大学洛杉矶分校)
专题命中 其他VLM :vision language model(abstract);分类 cs.AI