JavisDiT++: Unified Modeling and Optimization for Joint Audio-Video Generation
JavisDiT++:联合音频视频生成的统一建模与优化
Kai Liu, Yanhao Zheng, Kai Wang, Shengqiong Wu, Rongjunchen Zhang, Jiebo Luo, Dimitrios Hatzinakos, Ziwei Liu, Hao Fei, Tat-Seng Chua
机构
*
Zhejiang University(浙江大学)
;
National University of Singapore(新加坡国立大学)
;
University of Toronto(多伦多大学)
;
HiThink Research(HiThink研究)
;
University of Rochester(罗切斯特大学)
;
Nanyang Technological University(南洋理工大学)
Unified Text-Image Generation with Weakness-Targeted Post-Training
通过弱项针对性后训练实现统一的文本图像生成
Jiahui Chen, Philippe Hansen-Estruch, Xiaochuang Han, Yushi Hu, Emily Dinan, Amita Kamath, Michal Drozdzal, Reyhane Askari-Hemmat, Luke Zettlemoyer, Marjan Ghazvininejad
机构
*
FAIR at Meta(Meta旗下的FAIR)
;
University of Texas, Austin(德克萨斯大学奥斯汀分校)
;
University of Washington(华盛顿大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
Abn-BLIP: Abnormality-aligned Bootstrapping Language-Image Pre-training for Pulmonary Embolism Diagnosis and Report Generation from CTPA
Zhusi Zhong, Yuli Wang, Lulu Bi, Zhuoqi Ma, Sun Ho Ahn, Christopher J. Mullin, Colin F. Greineder, Michael K. Atalay, Scott Collins, Grayson L. Baird, Cheng Ting Lin, Webster Stayman, Todd M. Kolb, Ihab Kamel, Harrison X. Bai, Zhicheng Jiao
机构
*
Department of Diagnostic Imaging, Brown University Health(布朗大学健康中心诊断影像科)
;
Warren Alpert Medical School of Brown University(布朗大学沃伦·阿尔珀特医学院)
;
Department of Biomedical Engineering, Johns Hopkins University School of Medicine(约翰霍普金斯大学医学院生物医学工程系)
;
Department of Radiology and Radiological Sciences, Johns Hopkins University School of Medicine(约翰霍普金斯大学医学院放射科)
;
Johns Hopkins University Division of Pulmonary and Critical Care Medicine(约翰霍普金斯大学肺科与重症医学科)
;
Department of Radiology, University of Colorado School of Medicine(科罗拉多大学医学院放射科)
机构
*
New Laboratory of Pattern Recognition, CASIA(模式识别新实验室,中国科学院自动化研究所)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Nanjing university(南京大学)
;
Academy of Broadcasting Science, NRTA(广播科学研究院,国家广播电视总局)