Concept-Enhanced Multimodal RAG: Towards Interpretable and Accurate Radiology Report Generation
概念增强的多模态RAG:迈向可解释且准确的放射科报告生成
Marco Salmè, Federico Siciliano, Fabrizio Silvestri, Paolo Soda, Rosa Sicilia, Valerio Guarrasi
机构
*
Department of Engineering(工程系)
;
Research Unit of Artificial Intelligence and Computer Systems(人工智能与计算机系统研究单位)
;
Università Campus Bio-Medico of Roma(罗马大学生物医学校园)
;
Department of Computer, Control and Management Engineering(计算机、控制与管理工程系)
;
Sapienza University of Rome(罗马萨皮恩扎大学)
;
Department of Diagnostics and Intervention, Radiation Physics, Biomedical Engineering(诊断与介入、辐射物理、生物医学工程系)
;
Umeå University(乌梅拉大学)
;
UniCamillus-Saint Camillus International University of Health Sciences(UniCamillus-圣卡米卢斯国际健康科学大学)
AudioRAG+: Feedback-driven Retrieval-augmented Audio Generation with Large Audio Language Models
AudioRAG+: 基于反馈的检索增强音频生成与大音频语言模型
Junqi Zhao, Chenxing Li, Jinzheng Zhao, Rilin Chen, Dong Yu, Mark D. Plumbley, Wenwu Wang
机构
*
Centre for Vision, Speech and Signal Processing (CVSSP), University of Surrey, UK(视觉、语音和信号处理中心(CVSSP),英国萨里大学)
;
Tencent AI Lab, Beijing, China(腾讯人工智能实验室,中国北京)
;
Tencent AI Lab, Seattle, USA(腾讯人工智能实验室,美国西雅图)