MVT: Mask-Grounded Vision-Language Models for Taxonomy-Aligned Land-Cover Tagging
MVT:基于分类对齐的土地覆盖标签的掩码导向视觉-语言模型
机构 * HKUST(香港科技大学) ; JHU(约翰·霍普金斯大学) ; CUHKSZ(香港中文大学) ; NUS(新加坡国立大学) ; MUST(穆斯林大学)
AI总结 MVT通过三阶段框架结合类无关掩码证据与基于分类的场景解释,提升遥感土地覆盖标签的准确性和信息性。
Comments The project is available at https://charlescsyyy.github.io/MVT