LAViG-FLOW: Latent Autoregressive Video Generation for Fluid Flow Simulations
LAViG-FLOW:用于流体流动模拟的潜在自回归视频生成
专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract)
AI总结 LAViG-FLOW通过潜在自回归视频生成框架高效模拟流体流动,实现比传统方法快百倍的饱和度和压力场生成。
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
LAViG-FLOW:用于流体流动模拟的潜在自回归视频生成
专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract)
AI总结 LAViG-FLOW通过潜在自回归视频生成框架高效模拟流体流动,实现比传统方法快百倍的饱和度和压力场生成。
AnchorWeave: 通过检索的局部空间记忆实现世界一致的视频生成
机构 * Department of Computer Science, University of North Carolina, Chapel Hill(北卡罗来纳大学教堂山分校计算机科学系) ; Nanyang Technological University, Singapore(新加坡南洋理工大学)
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV
AI总结 AnchorWeave通过检索局部空间记忆提升视频生成的长期场景一致性与视觉质量。
Comments Project website: https://zunwang1.github.io/AnchorWeave
DCDM:分而治之扩散模型用于保持一致性视频生成
机构 * Fudan University(复旦大学) ; Tencent(腾讯)
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV
AI总结 DCDM通过分而治之的扩散模型,解决视频生成中的语义、几何和身份一致性问题,提升视频生成的连贯性和可控性。
Comments 7 pages, 2 figures
面向视图自适应的人体视频生成的3D感知隐式运动控制
机构 * Kling Team, Kuaishou Technology(快手科技 Kling 团队) ; Tsinghua University(清华大学) ; CASIA
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV
AI总结 3DiMo通过隐式运动表示和视图丰富监督,提升视频生成中的人体运动保真度和视觉质量。
Comments Project Page: https://hjrphoebus.github.io/3DiMo/
通过嵌入学习与大语言模型揭示通用多模态检索的关键因素:U-MARVEL
机构 * Tencent PCG(腾讯PCG) ; Nanjing University(南京大学) ; ByteDance(字节跳动)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
AI总结 U-MARVEL通过嵌入学习与大语言模型揭示通用多模态检索的关键因素,实现超越现有方法的性能。
Comments Accepted to ICLR 2026
Journal ref International Conference on Learning Representations (ICLR), 2026