arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-08-31 至 2026-08-31 共收录 5 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 5 篇

2608.27922 2026-08-31 cs.CV 新提交 88%

DensityKV: Density-Guided KV Cache Compression for Long Video Generation

DensityKV:面向长视频生成的密度引导式KV缓存压缩

Wenqu Zhao, Xuemin Chi, Xin Zhang, Guoqing Ma, Baorun Li, Jianjie Fang, Peizhi Tang, Chen Gao, Wei Wu

机构 * Manifold AI(流形人工智能) Tsinghua University(清华大学)

专题命中 视频生成 :video generation(title,abstract);long video(title);video diffusion(abstract);分类 cs.CV

AI总结 DensityKV是一种无需训练的历史KV库管理策略,通过密度引导压缩KV缓存,提升长视频生成的时序一致性与稳定性,且存储不随推演长度增长。

Comments 17 pages, 9 figures, 2 tables. Code: this https URL (https://github.com/ZhaoWQQ/DensityKV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21366 2026-08-31 cs.CV 版本更新 88%

Relax Forcing: Relaxed KV-Memory for Consistent Long Video Generation

放松强制:用于一致长视频生成的放松KV内存

Zengqun Zhao, Yanzuo Lu, Ziquan Liu, Jifei Song, Jiankang Deng, Ioannis Patras

机构 * Queen Mary University of London(伦敦玛丽女王大学) Imperial College London(伦敦帝国学院)

专题命中 视频生成 :video generation(title,abstract);long video(title);video diffusion(abstract);分类 cs.CV

AI总结 本文提出Relax Forcing机制,通过结构化时间内存提升长视频生成的运动动态和时间一致性,减少注意力开销。

Comments Accepted at BMVC 2026. Project page: see this https URL (https://zengqunzhao.github.io/Relax-Forcing)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28460 2026-08-31 cs.CV 新提交 83%

LayerRecall: A State-Conditioned Memory Router for Long-Horizon Consistency in Video Generation

LayerRecall:用于视频生成中长时序一致性的状态条件化记忆路由

Yixuan Ding, Jiahao Kong, Wei Huang, Ruijie Quan, Yi Yang

机构 * Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

AI总结 提出LayerRecall记忆路由与CHPM训练方法,在不牺牲局部连续性的前提下提升视频生成长程一致性,在MemoBench、MovieBench等数据集上取得最优结果,且具备跨主干可移植性与低推理开销。

Comments 15 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26971 2026-08-31 cs.CV cs.MM 版本更新 81%

TempJail: Temporal Jailbreak Attacks against Image-to-Video Generation Models

TempJail:针对图像到视频生成模型的时序越狱攻击

Qi Lu, Zehui Guo, David Yuanda Gan, Zijing Li, Hengda Zhang, Weijun Xu, Qiankun Zhang

机构 * School of Cyber Science and Engineering, Huazhong University of Science and Technology(华中科技大学网络空间科学与工程学院) School of Mathematical Sciences, Peking University(北京大学数学科学学院) School of Software and engineering, Huazhong University of Science and Technology(华中科技大学软件学院) School of Computer Science, Nanjing University(南京大学计算机学院)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV、cs.MM

AI总结 本文提出TempJail时序越狱框架,针对图像到视频生成模型的时序漏洞,通过分解恶意提示、受控潜在扰动等方式提升攻击成功率,在Kling等模型上获显著效果。

Comments Accepted by ACM Multimedia 2026 (ACM MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27345 2026-08-31 cs.CV cs.AI 版本更新 57%

PAWBench: How Far Are We from Probabilistically Aligned World Modeling?

PAWBench:我们离概率对齐的世界建模还有多远?

Yuandong Pu, Le Zhuo, Sayak Paul, Gabriel Jorge Menezes, Avram Đorđević, Shiyang Li, Yifan Zhou, Bin Fu, Wenlong Zhang, Junjun He, Yu Qiao, Yihao Liu, Jinbo Xing, Xi Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Krea AI Huggingface Shanghai Innovation Institute(上海创新研究院) Tongyi Lab(通义实验室) The University of Hong Kong(香港大学)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

AI总结 本研究针对当前视频生成器未满足概率对齐世界建模要求的问题,提出PAWBench基准与PAWEval协议,经50种场景和11个系统测试发现无模型达要求,为相关研究奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏