LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
LinVideo: 一种面向高效视频生成的O(n)注意力后训练框架
Yushi Huang, Xingtong Ge, Ruihao Gong, Chengtao Lv, Jun Zhang
机构
*
Hong Kong University of Science and Technology(香港科技大学)
;
Beihang University(北航)
;
Sensetime Research(商汤科技研究院)
;
Nanyang Technological University(南洋理工大学)
JavisDiT++: Unified Modeling and Optimization for Joint Audio-Video Generation
JavisDiT++:联合音频视频生成的统一建模与优化
Kai Liu, Yanhao Zheng, Kai Wang, Shengqiong Wu, Rongjunchen Zhang, Jiebo Luo, Dimitrios Hatzinakos, Ziwei Liu, Hao Fei, Tat-Seng Chua
机构
*
Zhejiang University(浙江大学)
;
National University of Singapore(新加坡国立大学)
;
University of Toronto(多伦多大学)
;
HiThink Research(HiThink研究)
;
University of Rochester(罗切斯特大学)
;
Nanyang Technological University(南洋理工大学)
Narrating For You: Prompt-guided Audio-visual Narrating Face Generation Employing Multi-entangled Latent Space
为你叙述:基于多纠缠潜在空间的提示引导音频视觉叙述面部生成
Aashish Chandra, Aashutosh A, Abhijit Das
机构
*
Machine Intelligence Group, Department of CS&IS, BITS Pilani, Hyderabad Campus, India(机器智能组,计算机科学与信息学系,比斯汉学院海得拉巴校区,印度)
;
Georgia Institute of Technology, USA(佐治亚理工学院,美国)