LLaVA-RadZ: Can Multimodal Large Language Models Effectively Tackle Zero-shot Radiology Recognition?
机构 * East China Normal University(华东师范大学) ; The Chinese University of Hong Kong(香港中文大学) ; Northwest A&F University(西北农林科技大学) ; Tencent Youtu Lab(腾讯优图实验室) ; Xiamen University(厦门大学)
专题命中 VLM训练与架构 :LLaVA(title,abstract);multimodal large language model(title,abstract);visual question answering(abstract);MLLM(abstract)