RISE-T2V: Rephrasing and Injecting Semantics with LLM for Expansive Text-to-Video Generation
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV
Comments 17 pages, 16 figures
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV
Comments 17 pages, 16 figures
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV
机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) ; National University of Singapore(新加坡国立大学)
专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) ; Zhiyuan College, Shanghai Jiao Tong University(上海交通大学紫阳学院) ; China Mobile Research Institute(中国移动研究院) ; Westlake University(西湖大学) ; Huawei Consumer Business Group(华为消费者业务集团)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Accepted to NeurIPS 2025. Code is available at: https://github.com/zhengchen1999/DOVE
机构 * New York University(纽约大学) ; Stanford University(斯坦福大学)
专题命中 长视频与时序推理 :long video(abstract);分类 cs.CV
Comments Website: https://cambrian-mllm.github.io/
机构 * College of Computing and Data Science(计算与数据科学学院) ; Nanyang Technological University(南洋理工大学)
专题命中 视频数据与评测 :video understanding(abstract);video-language(abstract);long video(abstract);分类 cs.CV
Comments Accepted to NeurIPS 2025 D&B Track