MedCLM: Learning to Localize and Reason via a CoT-Curriculum in Medical Vision-Language Models
机构 * A.I.MATICS Inc(A.I.MATICS公司) ; Boston University(波士顿大学) ; University of Southern California(南加州大学) ; Heuron(Heuron公司) ; MODULABS, Open Neural Networks Research Lab(MODULABS,开放神经网络研究实验室)
专题命中 视觉定位与Grounding :vision-language model(title,abstract);visual question answering(abstract);grounding(abstract);分类 cs.CV、cs.AI、cs.LG