机构
*
Peking University(北京大学)
;
Nanyang Technological University(南洋理工大学)
;
National University of Singapore(新加坡国立大学)
;
Sun Yat-Sen University(中山大学)
;
Pingan Technology(平安科技)
专题命中
视觉推理
:multimodal large language model(title,abstract);LLaVA(abstract,abstract_cn);分类 cs.CV、cs.LG
Volumetric Radiology AI in the Era of Multimodal Large Language Models
多模态大语言模型时代的容积放射学人工智能
Zanting Ye, Shengyuan Liu, Xin Liu, Chenhui Wang, Zhisong Wang, Jiashuai Liu, Zipei Wang, Cheng Wang, Wentao Pan, Mengjie Fang, Di Dong, Mohammad Salmanpour, Arman Rahmim, Yu Gu, Yong Xia, Hongming Shan, Yixuan Yuan, Yefeng Zheng, Lijun Lu
机构
*
Fudan University(复旦大学)
;
Northwestern Polytechnical University(西北工业大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Southern Medical University(南方医科大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
University of British Columbia(不列颠哥伦比亚大学)
;
Microsoft Research(微软研究院)
;
Westlake University(西湖大学)
专题命中
视觉推理
:multimodal large language model(title,abstract);分类 cs.AI
Re$^3$Cap: Retrieval-Guided Refinement for Image Captioning Enhancement via Reinforcement Learning
Re³Cap:基于强化学习的图像字幕增强的检索引导优化
Haonan Jia, Shichao Dong, Zenghui Sun, Jiawen Zheng, Ziqi Miao, Gege Shi, Qiuyu Zhao, Jinsong Lan, Xiaoyong Zhu, Bo Zheng
机构
*
Taobao & Tmall Group of Alibaba(阿里巴巴淘宝和天猫集团)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)