Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation
机构 * organization= School of Information Science \& Engineering, Lanzhou University , addressline= , city= Lanzhou , postcode= 730000 , country= China
专题命中 音视频/视觉语言融合 :multimodal fusion(abstract);分类 cs.CV
Comments 29 pages and 8 figures