Reasoning Text-to-Video Retrieval via Digital Twin Video Representations and Large Language Models
机构 * Department of Computer Science, Johns Hopkins University(计算机科学系,约翰霍普金斯大学)
专题命中 视频生成 :text-to-video(title,abstract);分类 cs.CV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * Department of Computer Science, Johns Hopkins University(计算机科学系,约翰霍普金斯大学)
专题命中 视频生成 :text-to-video(title,abstract);分类 cs.CV
专题命中 视频生成 :video generation(abstract)
Comments Accepted to AAAI-26 (Oral). Project website: https://grim-tog.github.io
专题命中 视频生成 :video generation(abstract)