Dual-Domain Perspective on Degradation-Aware Fusion: A VLM-Guided Robust Infrared and Visible Image Fusion Framework
专题命中 VLM训练与架构 :VLM(title);vision-language model(abstract);分类 cs.CV
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 VLM训练与架构 :VLM(title);vision-language model(abstract);分类 cs.CV
机构 * Beihang University(北航大学) ; National University of Singapore(国立新加坡大学) ; King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学)
专题命中 VLM训练与架构 :visual question answering(abstract);multimodal large language model(abstract);分类 cs.CV
Comments Accepted by ICCV 2025
机构 * University of Science and Technology of China(中国科学技术大学) ; Peking University(北京大学) ; Kuaishou Technology(快手科技)
专题命中 VLM训练与架构 :multimodal large language model(abstract);分类 cs.CV