arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-12-17 至 2025-12-17 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2 篇

2509.24979 2025-12-17 cs.CV 74%

Video Generation with Stable Transparency via Shiftable RGB-A Distribution Learner

通过可移动的RGB-A分布学习实现稳定的透明度视频生成

Haotian Dong, Wenjing Wang, Chen Li, Jing Lyu, Di Lin

机构 * Tianjin University(天津大学)

专题命中 视频生成 :video generation(title);分类 cs.CV

AI总结 本文提出了一种通过可移动RGB-A分布学习实现稳定透明度视频生成的方法,提升了视频质量和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13392 2025-12-17 cs.CV 57%

Beyond the Visible: Disocclusion-Aware Editing via Proxy Dynamic Graphs

超越可见范围:通过代理动态图实现的遮挡感知编辑

Anran Qi, Changjian Li, Adrien Bousseau, Niloy J. Mitra

机构 * Inria - Université Côte d’Azur(法国国家信息与自动化技术研究院-埃克塞特大学) University of Edinburgh(爱丁堡大学) Adobe Research(Adobe研究部) UCL(伦敦大学学院)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

AI总结 通过代理动态图实现遮挡感知编辑,结合运动规范与外观合成,实现可控的图像到视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏