Co-Training Vision Language Models for Remote Sensing Multi-task Learning
联合训练遥感多任务学习的视觉语言模型
机构 * Harbin Institute of Technology(哈尔滨工业大学) ; Shanghai Jiao Tong University(上海交通大学) ; Xidian University(西安电子科技大学) ; East China Normal University(东华大学) ; Wuhan University(武汉大学) ; Southeast University(东南大学) ; National University of Defense Technology(国防科技大学) ; Chinese University of Hong Kong(香港中文大学)
专题命中 视觉定位与Grounding :vision language model(title,abstract);VLM(abstract);grounding(abstract);分类 cs.CV
AI总结 RSCoVLM通过联合训练视觉语言模型,提升遥感多任务学习的性能和灵活性。
Comments 14 pages, 6 figures