Category-level Text-to-Image Retrieval Improved: Bridging the Domain Gap with Diffusion Models and Vision Encoders
机构 * King Abdullah University of Science and Technology(国王阿卜杜勒-阿齐兹大学科学与技术大学) ; Visual Recognition Group(视觉识别组) ; Faculty of Electrical Engineering(电气工程学院) ; Czech Technical University in Prague(布拉格捷克技术大学)
专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV
Comments BMVC 2025