arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-08-27 至 2026-08-27 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 2 篇

2601.16296 2026-08-27 cs.CV cs.AI cs.LG 版本更新 83%

Memory-V2V: Memory-Augmented Video-to-Video Diffusion for Consistent Multi-Turn Editing

Memory-V2V: 通过记忆增强的视频到视频扩散模型实现一致的多轮编辑

Dohun Lee, Chun-Hao Paul Huang, Xuelin Chen, Jong Chul Ye, Duygu Ceylan, Hyeonho Jeong

机构 * Adobe Research(Adobe研究实验室) KAIST AI(韩国科学技术院人工智能研究所) Adobe Internship(Adobe实习) Project Lead(项目负责人)

专题命中 视频扩散模型 :video diffusion(title,abstract);long video(abstract);分类 cs.CV

AI总结 Memory-V2V通过引入外部记忆模块,解决多轮视频编辑中的跨轮一致性问题,提升编辑连贯性并保持视觉质量,优于现有基线模型。

Comments 38 pages, 22 figures, ECCV 2026, Project page: this https URL (https://dohunlee1.github.io/MemoryV2V)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25380 2026-08-27 cs.AR 新提交 50%

APT: Accelerating Diffusion Transformers via Attention Probability-Guided Pruning and Quantization

APT:基于注意力概率引导剪枝与量化的扩散Transformer加速方案

Sungyeob Yoo, Seeyeon Kim, Joonyong Park, Seunghee Han, Joo-Young Kim

专题命中 视频扩散模型 :video generation(abstract)

AI总结 本文提出软硬件协同设计的APT加速器,通过APDT与TAFA优化DiTs的自注意力计算,在多款SOTA DiT模型上实现显著加速与能效提升。

Comments 9 pages, 17 figures, 3 tables. Accepted to the IEEE/ACM International Conference on Computer-Aided Design (ICCAD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏