S-Chain: Structured Visual Chain-of-Thought For Medicine
专题命中 视觉问答 :vision-language model(abstract);LLaVA(abstract);visual question answering(abstract);grounding(abstract)
Comments First version
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 视觉问答 :vision-language model(abstract);LLaVA(abstract);visual question answering(abstract);grounding(abstract)
Comments First version
机构 * Faculty Of Information Technology VNU University of Engineering(信息科技学院越南工程大学) ; IT-BT Convergence Technology Division Vietnam-Korea Institute of Science(IT-BT融合技术部门越南-韩国科学技术院) ; TADI Global Lab TADI Global Company Limited(TADI全球实验室TADI全球有限公司) ; Faculty of Finance Banking Academy of Vietnam(金融学院越南银行学院)
专题命中 视觉问答 :visual question answering(title,abstract);分类 cs.CV
Comments 10 pages, 4 figures, IEEE conference format
机构 * KAIST(韩国国立科学技术院) ; Seoul National University Hospital(首尔国立大学医院) ; Seoul Medical Center(首尔医疗中心)
专题命中 视觉问答 :vision-language model(abstract);visual question answering(abstract);grounding(abstract);分类 cs.CV、cs.AI
Comments Accepted at NeurIPS 2025 Datasets and Benchmarks Track
机构 * University of Bristol(布里斯托大学)
专题命中 视觉问答 :vision language model(abstract);VLM(abstract);分类 cs.CV
机构 * ZJU-Angelalign R&D Center for Intelligence Healthcare(浙江大学智能医疗研发中心) ; Zhejiang University(浙江大学) ; Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室) ; Guangdong Institute of Intelligence Science and Technology(广东省智能科学与技术研究院)
专题命中 视觉问答 :vision-language model(abstract);visual question answering(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2025
机构 * The Pennsylvania State University(宾夕法尼亚州立大学) ; Intel(英特尔)
专题命中 视觉问答 :multimodal large language model(abstract);分类 cs.CV
Comments Accepted at NeurIPS 2025 UniReps Workshop