arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-02-19 至 2026-02-19 共收录 1 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1 篇

2602.16132 2026-02-19 cs.CV cs.LG 70%

CHAI: CacHe Attention Inference for text2video

CHAI: 文本到视频的缓存注意力推理

Joel Mathew Cherian, Ashutosh Muralidhara Bharadwaj, Vima Gupta, Anand Padmanabha Iyer

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 视频扩散模型 :video diffusion(abstract);text-to-video(abstract);分类 cs.CV

AI总结 CHAI通过引入缓存注意力机制,以减少延迟并保持视频质量,实现比OpenSora 1.2快1.65至3.35倍的推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏