X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models
Zeyi Sun, Ziyang Chu, Pan Zhang, Tong Wu, Xiaoyi Dong, Yuhang Zang, Yuanjun Xiong, Dahua Lin, Jiaqi Wang
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
CPII under InnoHK(创新香港科技促进会)
;
MThreads AI
专题命中
VLM训练与架构
:vision-language model(abstract);vision language model(abstract);分类 cs.CV、cs.AI、cs.LG