CommentsAn earlier version of this work appeared at the NeurIPS 2025 Workshop on Symmetry and Geometry in Neural Representations (NeurReps). Workshop version: https://openreview.net/forum?id=jOmZsvXoK5
Toward a Vision-Language Foundation Model for Medical Data: Multimodal Dataset and Benchmarks for Vietnamese PET/CT Report Generation
迈向医学数据的视觉-语言基础模型:越南语PET/CT报告生成的多模态数据集和基准
Huu Tien Nguyen, Dac Thai Nguyen, The Minh Duc Nguyen, Trung Thanh Nguyen, Thao Nguyen Truong, Huy Hieu Pham, Johan Barthelemy, Minh Quan Tran, Thanh Tam Nguyen, Quoc Viet Hung Nguyen, Quynh Anh Chau, Hong Son Mai, Thanh Trung Nguyen, Phi Le Nguyen
机构
*
AI4LIFE, Hanoi University of Science and Technology, Vietnam(AI4LIFE,河内科学技术大学,越南)
;
Nagoya University, Japan(名古屋大学,日本)
;
AIST, Japan(日本国家先进工业技术研究院)
;
VinUniversity, Vietnam(文园大学,越南)
;
NVIDIA, USA(NVIDIA,美国)
;
Griffith University, Australia(格里菲斯大学,澳大利亚)
;
Hanoi Medical University, Vietnam(河内医学院,越南)
;
Military Central Hospital, Vietnam(越南108中央军医院)