Frame Context Packing and Drift Prevention in Next-Frame-Prediction Video Diffusion Models
机构 * Stanford University(斯坦福大学) ; MIT(麻省理工学院)
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * Stanford University(斯坦福大学) ; MIT(麻省理工学院)
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV
机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学) ; Tencent(腾讯) ; Yes Lab, Fudan University(复旦大学Yes实验室)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Project Page: https://imlixinyang.github.io/FlashWorld-Project-Page/