arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-12-09 至 2025-12-09 共收录 3 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 3 篇

2512.07350 2025-12-09 cs.DC 82%

Communication-Efficient Serving for Video Diffusion Models with Latent Parallelism

面向视频扩散模型的通信高效服务与潜在并行性

Zhiyuan Wu, Shuai Wang, Li Chen, Kaihui Gao, Dan Li, Yanyu Ren, Qiming Zhang, Yong Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract)

AI总结 本文提出潜在并行性策略,通过动态旋转潜在空间维度,显著降低视频扩散模型服务的通信开销,同时保持生成质量。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05952 2025-12-09 cs.CV 57%

Coefficients-Preserving Sampling for Reinforcement Learning with Flow Matching

为流匹配强化学习中的系数保持采样

Feng Wang, Zihao Yu

机构 * CreateAI

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

AI总结 通过系数保持采样方法,减少流匹配强化学习中的噪声伪影,提升奖励建模精度和优化器收敛稳定性。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10963 2025-12-09 cs.CV 57%

EVCtrl: Efficient Control Adapter for Visual Generation

EVCtrl: 用于视觉生成的高效控制适配器

Zixiang Yang, Yue Ma, Yinhan Zhang, Shanhui Mo, Dongrui Liu, Linfeng Zhang

机构 * UESTC(电子科技大学) HKUST(香港科技大学) SJTU(上海交通大学)

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

AI总结 EVCtrl通过轻量级控制适配器提升视觉生成效率,实现高效可控生成,无需重新训练模型。

详情

展开后加载摘要…

URL PDF HTML 收藏