A Little More Like This: Text-to-Image Retrieval with Vision-Language Models Using Relevance Feedback
略多一些像这个:利用视觉语言模型进行文本到图像检索的相关反馈
机构 * Maastricht University(马斯特里赫特大学)
AI总结 本文提出基于相关反馈机制提升视觉语言模型文本到图像检索性能的方法,通过四种反馈策略在Flickr30k和COCO数据集上验证,提升了检索效果并增强了多轮检索的鲁棒性。
Comments Accepted to WACV'26