SpeechCT-CLIP: Distilling Text-Image Knowledge to Speech for Voice-Native Multimodal CT Analysis
Lukas Buess, Jan Geier, David Bani-Harouni, Chantal Pellegrini, Matthias Keicher, Paula Andrea Perez-Toro, Nassir Navab, Andreas Maier, Tomas Arias-Vergara
机构
*
Computer Aided Medical Procedures, Technical University of Munich(慕尼黑技术大学计算机辅助医学程序)
Med-K2N: Flexible K-to-N Modality Translation for Medical Image Synthesis
Feng Yuan, Yifan Gao, Yuehua Ye, Haoyue Li, Xin Gao
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Suzhou Institute of Biomedical Engineering and Technology(苏州生物医学工程与技术研究所)
;
Chinese Academy of Sciences(中国科学院)
;
The Third Affiliated Hospital of Sun Yat-sen University(中山大学第三附属医院)
Swap-Net: A Memory-Efficient 2.5D Network for Sparse-View 3D Cone Beam CT Reconstruction
Xiaojian Xu, Marc Klasky, Michael T. McCann, Jason Hu, Jeffrey A. Fessler
机构
*
Department of Electrical Engineering & Computer Science, University of Michigan(电气工程与计算机科学系,密歇根大学)
;
Theoretical Division, Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室理论部)
专题命中
医学影像
:CT(title,abstract);分类 cs.CV、eess.IV
Journal refIEEE Transactions on Computational Imaging, vol. 11, pp. 872-887, 2025
机构
*
Hospital Universitario Virgen Macarena Seville, Spain(塞维利亚大学医院维珍玛卡伦娜医院)
;
Dpt. Teoría de la Señal y Comunicaciones Escuela Técnica Superior de Ingeniería Universidad de Sevilla, Seville, Spain(塞维利亚大学电信与通信系)
;
Hospitales Quironsalud Infanta Luisa y Sagrado Corazón Seville, Spain(quironsalud医院)
Glaucoma Detection and Structured OCT Report Generation via a Fine-tuned Multimodal Large Language Model
Jalil Jalili, Yashraj Gavhane, Evan Walker, Anna Heinke, Christopher Bowd, Akram Belghith, Massimo A. Fazio, Christopher A. Girkin, C. Gustavo De Moraes, Jeffrey M. Liebmann, Sally L. Baxter, Robert N. Weinreb, Linda M. Zangwill, Mark Christopher