arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-12-16 至 2025-12-16 共收录 3 信号源:cs.CV, eess.IV, cs.MM

1. 动作与事件理解 3 篇

2512.12534 2025-12-16 cs.CV cs.GR cs.LG 70%

Animus3D: Text-driven 3D Animation via Motion Score Distillation

Animus3D: 通过运动分数蒸馏实现文本驱动的3D动画

Qi Sun, Can Wang, Jiaxiang Shang, Wensen Feng, Jing Liao

机构 * City University of Hong Kong(香港城市大学) Central Media Technology Institute, Huawei(华为中央媒体技术研究院)

专题命中 动作与事件理解 :video diffusion(abstract);text-to-video(abstract);分类 cs.CV

AI总结 Animus3D通过运动分数蒸馏技术实现文本驱动的3D动画生成,提升运动细节与视觉完整性。

Comments SIGGRAPH Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12060 2025-12-16 cs.CV cs.LG cs.MM 62%

CreativeVR: Diffusion-Prior-Guided Approach for Structure and Motion Restoration in Generative and Real Videos

CreativeVR: 一种基于扩散先验的结构与运动修复方法用于生成视频和真实视频

Tejas Panambur, Ishan Rajendrakumar Dave, Chongjian Ge, Ersin Yumer, Xue Bai

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Adobe(Adobe公司)

专题命中 动作与事件理解 :text-to-video(abstract);分类 cs.CV、cs.MM

AI总结 CreativeVR通过扩散先验引导方法,有效修复AI生成和真实视频中的结构与运动伪影,实现高质量视频修复。

Comments The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16020 2025-12-16 cs.CV cs.AI 57%

Physically Realistic Sequence-Level Adversarial Clothing for Robust Human-Detection Evasion

物理真实序列级对抗性服装用于鲁棒的人体检测规避

Dingkun Zhou, Patrick P. K. Chan, Hengxu Wu, Shikang Zheng, Ruiqi Huang, Yuanjie Zhao

机构 * School of Future Technology, South China University of Technology(未来技术学院,华南理工大学) Institute for Interdisciplinary Information Sciences, Tsinghua University(交叉信息研究院,清华大学)

专题命中 动作与事件理解 :long video(abstract);分类 cs.CV

AI总结 本研究提出序列级优化框架,生成可打印的对抗性服装纹理,以实现在数字和物理环境中对人类检测的鲁棒规避。

详情

展开后加载摘要…

URL PDF HTML 收藏