G2D: Generative-to-Discriminative Collaborative Inference for Zero-Shot Image Classification
G2D:用于零样本图像分类的生成式到判别式协同推理框架
机构 * Xidian University(西安电子科技大学)
专题命中 效率与蒸馏 :generative vision(abstract);分类 cs.CV
AI总结 G2D是一种无需训练的零样本图像分类框架,通过生成式VLM验证CLIP检索的候选,在8个基准上平均准确率达68.85%,优于CLIP及独立生成式模型,还可迁移至其他模型。
Comments Accepted at ACM MM 2026. 10 pages, 5 figures