Error Analyses of Auto-Regressive Video Diffusion Models: A Unified Framework
自回归视频扩散模型的误差分析:一个统一的框架
Jing Wang, Fengzhuo Zhang, Xiaoli Li, Vincent Y. F. Tan, Tianyu Pang, Chao Du, Aixin Sun, Zhuoran Yang
机构
*
Nanyang Technological University(南洋理工大学)
;
National University of Singapore(国立新加坡大学)
;
Singapore University of Technology and Design(新加坡科技设计大学)
;
Sea AI Lab(海思人工智能实验室)
;
Yale University(耶鲁大学)
Diffusion Knows Transparency: Repurposing Video Diffusion for Transparent Object Depth and Normal Estimation
扩散知道透明:将视频扩散用于透明物体深度和法线估计
Shaocong Xu, Songlin Wei, Qizhe Wei, Zheng Geng, Hong Li, Licheng Shen, Qianpu Sun, Shu Han, Bin Ma, Bohan Li, Chongjie Ye, Yuhang Zheng, Nan Wang, Saining Zhang, Hao Zhao
机构
*
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
University of Southern California(南加州大学)
;
Tsinghua University(清华大学)
;
Beihang University(北航)
;
Wuhan University(武汉大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
European Institute of Innovation and Technology Ningbo(创新与技术欧洲研究所宁波)
;
FNii, The Chinese University of Hong Kong, Shenzhen(FNii,香港中文大学(深圳))
;
National University of Singapore(新加坡国立大学)
Video Event Reasoning and Prediction by Fusing World Knowledge from LLMs with Vision Foundation Models
通过融合来自LLM的世界知识与视觉基础模型进行视频事件推理与预测
L'ea Dubois, Klaus Schmidt, Chengyu Wang, Ji-Hoon Park, Lin Wang, Santiago Munoz
机构
*
INRIA(法国国家信息与自动化研究所)
;
Max Planck Institute for Intelligent Systems(人工智能研究所)
;
San Francisco State University(旧金山州立大学)
;
Seoul AI Institute (SAII)(首尔人工智能研究所)
;
Vision & Robotics Center, Tsinghua University(清华大学视觉与机器人中心)
;
Polytechnic University of Madrid(马德里理工大学)