MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports
Sunggu Kyung, Hyungbin Park, Jinyoung Seo, Jimin Sung, Jihyun Kim, Dongyeong Kim, Wooyoung Jo, Yoojin Nam, Sangah Park, Taehee Kwon, Sang Min Lee, Namkug Kim
机构
*
Department of Biomedical Engineering, University of Ulsan College of Medicine(生物医学工程系,釜山大学医学院)
专题命中
视觉问答
:visual question answering(title,abstract);multimodal large language model(abstract);分类 cs.CV、cs.AI
Comments14 pages, 5 figures, submitted to CVPR 2025
Hierarchical Question-Answering for Driving Scene Understanding Using Vision-Language Models
Safaa Abdullahi Moallim Mohamud, Minjin Baek, Dong Seog Han
机构
*
Center for ICT and Automotive Convergence, Kyungpook National University(信息与汽车融合研究中心,庆北国立大学)
;
School of Electronic and Electrical Engineering, Kyungpook National University(电子电气工程学院,庆北国立大学)
机构
*
Dept. of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong, China(计算机科学与工程系,香港中文大学,香港,中国)
;
Institute of Medical Intelligence and XR, The Chinese University of Hong Kong, Hong Kong, China(医学智能与XR研究所,香港中文大学,香港,中国)
专题命中
视觉问答
:vision language model(title);vision-language model(abstract);LLaVA(abstract);分类 cs.CV、cs.AI
Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models
Wenhui Zhu, Xuanzhao Dong, Xin Li, Peijie Qiu, Xiwen Chen, Abolfazl Razi, Aris Sotiras, Yi Su, Yalin Wang
机构
*
Arizona State University(亚利桑那州立大学)
;
Clemson University(克莱姆森大学)
;
Washington University in St.Louis(华盛顿大学圣路易斯分校)
;
Banner Alzheimer’s Institute(Banner阿尔茨海默病研究所)
专题命中
视觉问答
:vision-language model(title);visual question answering(abstract);multimodal large language model(abstract);分类 cs.CV、cs.AI
WorldCuisines: A Massive-Scale Benchmark for Multilingual and Multicultural Visual Question Answering on Global Cuisines
Genta Indra Winata, Frederikus Hudi, Patrick Amadeus Irawan, David Anugraha, Rifki Afina Putri, Yutong Wang, Adam Nohejl, Ubaidillah Ariq Prathama, Nedjma Ousidhoum, Afifa Amriani, Anar Rzayev, Anirban Das, Ashmari Pramodya, Aulia Adila, Bryan Wilie, Candy Olivia Mawalim, Ching Lam Cheng, Daud Abolade, Emmanuele Chersoni, Enrico Santus, Fariz Ikhwantri, Garry Kuwanto, Hanyang Zhao, Haryo Akbarianto Wibowo, Holy Lovenia, Jan Christian Blaise Cruz, Jan Wira Gotama Putra, Junho Myung, Lucky Susanto, Maria Angelica Riera Machin, Marina Zhukova, Michael Anugraha, Muhammad Farid Adilazuarda, Natasha Santosa, Peerat Limkonchotiwat, Raj Dabre, Rio Alexander Audino, Samuel Cahyawijaya, Shi-Xiong Zhang, Stephanie Yulia Salim, Yi Zhou, Yinxuan Gui, David Ifeoluwa Adelani, En-Shiun Annie Lee, Shogo Okada, Ayu Purwarianti, Alham Fikri Aji, Taro Watanabe, Derry Tanti Wijaya, Alice Oh, Chong-Wah Ngo
机构
*
Capital One
;
SEACrowd
;
NAIST
;
ITB
;
UofT
;
KAIST
;
JAIST
;
Cardiff University
;
Independent
;
HKUST
;
SMU
;
Masakhane
;
University of Lagos
;
HK PolyU
;
Boston University
;
Columbia University
;
MBZUAI
;
Monash University
;
UCSB
;
Tokyo Tech
;
AI Singapore
;
NICT
;
Cohere
;
McGill
;
MILA
;
Canada CIFAR AI Chair
;
Ontario Tech
专题命中
视觉问答
:visual question answering(title,abstract);vision language model(abstract);分类 cs.CV、cs.AI