Semi-Supervised Adaptation of Vision-Language Models for Image Classification
面向图像分类的视觉-语言模型半监督适配
机构 * Fondazione Bruno Kessler(布鲁诺·凯塞勒基金会) ; King Saud University(沙特国王大学) ; Tarim University(塔里木大学) ; Wuhan University(武汉大学)
专题命中 其他VLM :vision-language model(title,abstract);分类 cs.CV
AI总结 本研究针对视觉-语言模型适配遥感卫星图像时标注样本匮乏的问题,提出SE-CLIP半监督框架,通过双阶段流程与类平衡选择策略提升性能,在UCM、NWPU基准上优于现有方法。