RISE-T2V: Rephrasing and Injecting Semantics with LLM for Expansive Text-to-Video Generation
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV
Comments 17 pages, 16 figures
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV
Comments 17 pages, 16 figures
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV
机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) ; National University of Singapore(新加坡国立大学)
专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV
专题命中 视频生成 :video generation(abstract);分类 cs.CV