I Came, I Saw, I Explained: Benchmarking Multimodal LLMs on Figurative Meaning in Memes
我来了,我看到了,我解释了:在表情包中评估多模态大语言模型的隐喻意义
Shijia Zhou, Saif M. Mohammad, Barbara Plank, Diego Frassinelli
机构
*
MaiNLP, Center for Information and Language Processing, LMU Munich(MaiNLP,信息与语言处理中心,慕尼黑大学)
;
Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)
;
National Research Council Canada(加拿大国家研究委员会)
ENC-Bench: A Benchmark for Evaluating Multimodal Large Language Models in Electronic Navigational Chart Understanding
ENC-Bench:用于评估多模态大语言模型在电子航海图理解中的基准
Ao Cheng, Xingming Li, Xuanyu Ji, Xixiang He, Qiyao Sun, Chunping Qiu, Runke Huang, Qingyong Hu
机构
*
National University of Defense Technology(国防科技大学)
;
Intelligent Game and Decision Lab(智能游戏与决策实验室)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
CornOrb: A Multimodal Dataset of Orbscan Corneal Topography and Clinical Annotations for Keratoconus Detection
CornOrb:用于角膜变性检测的多模态数据集
Mohammed El Amine Lazouni, Leila Ryma Lazouni, Zineb Aziza Elaouaber, Mohammed Ammar, Sofiane Zehar, Mohammed Youcef Bouayad Agha, Ahmed Lazouni, Amel Feroui, Ali H. Al-Timemy, Siamak Yousefi, Mostafa El Habib Daho
机构
*
Biomedical Engineering Laboratory(生物医学工程实验室)
;
Abou Bakr Belkaid University(阿布·巴克·贝卡伊大学)
;
LIST Laboratory(LIST实验室)
;
M’Hamed Bougara Boumerdes University(穆哈梅德·布加拉 Boumerdes 大学)
;
Lazouni Clinic(拉祖尼诊所)
;
University of Western Brittany LaTIM UMR1101(西 Brittany 大学 LaTIM UMR1101)
;
Inserm Brest(里尔 Brest 研究所)
Cross-modal Fuzzy Alignment Network for Text-Aerial Person Retrieval and A Large-scale Benchmark
跨模态模糊对齐网络用于文本-空中人检索及一个大规模基准
Yifei Deng, Chenglong Li, Yuyang Zhang, Guyue Hu, Jin Tang
机构
*
State Key Laboratory of Opto-Electronic Information Acquisition and Protection Technology(光电信息采集与防护技术国家重点实验室)
;
School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院)
;
School of Artificial Intelligence, Anhui University(安徽大学人工智能学院)
;
The University of Hong Kong(香港大学)
Comments5 tables, 6 figures, Submitted to International Conference on Power, Electronics, Communications, Computing, and Intelligent Infrastructure 2026
LMOD+: A Comprehensive Multimodal Dataset and Benchmark for Developing and Evaluating Multimodal Large Language Models in Ophthalmology
LMOD+: 一个全面的多模态数据集和基准,用于开发和评估眼科中的多模态大语言模型
Zhenyue Qin, Yang Liu, Yu Yin, Jinyu Ding, Haoran Zhang, Anran Li, Dylan Campbell, Xuansheng Wu, Ke Zou, Tiarnan D. L. Keenan, Emily Y. Chew, Zhiyong Lu, Yih Chung Tham, Ninghao Liu, Xiuzhen Zhang, Qingyu Chen
机构
*
School of Medicine, Yale University(耶鲁大学医学院)
;
School of Computing, Australian National University(澳大利亚国立大学计算机学院)
;
School of Engineering, Imperial College London(伦敦帝国理工学院工程学院)
;
School of Computing, University of Georgia(佐治亚大学计算机学院)
;
Yong Loo Lin School of Medicine, National University of Singapore(新加坡国立大学杨秀隆医学学院)
;
National Eye Institute, National Institutes of Health(美国国立卫生研究院眼科研究所)
;
National Library of Medicine, National Institutes of Health(美国国立卫生研究院国家医学图书馆)
;
School of Computing Technologies, RMIT University(皇家墨尔本理工大学计算机技术学院)
A WDLoRA-Based Multimodal Generative Framework for Clinically Guided Corneal Confocal Microscopy Image Synthesis in Diabetic Neuropathy
基于WDLoRA的多模态生成框架用于临床指导的糖尿病性周围神经病变角膜共聚焦显微镜图像合成
Xin Zhang, Liangxiu Han, Tam Sobeih, Yue Shi, Yalin Zheng, Uazman Alam, Maryam Ferdousi, Rayaz Malik
机构
*
Department of Computing and Mathematics, Manchester Metropolitan University(曼彻斯特 Metropolitan 大学计算与数学系)
;
Department of Eye and Vision Sciences, University of Liverpool(利物浦大学眼科学与视觉科学系)
;
Faculty of Biology, Medicine and Health, University of Manchester(曼彻斯特大学生物、医学与健康学院)
;
Department of Medicine, Weill Cornell Medicine-Qatar(韦尔·柯尔曼医学中心-卡塔尔医学系)
Localizing Before Answering: A Hallucination Evaluation Benchmark for Grounded Medical Multimodal LLMs
先定位后回答:一种用于基于地面的医学多模态大语言模型的幻觉评估基准
Dung Nguyen, Minh Khoi Ho, Huy Ta, Thanh Tam Nguyen, Qi Chen, Kumar Rav, Quy Duong Dang, Satwik Ramchandre, Son Lam Phung, Zhibin Liao, Minh-Son To, Johan Verjans, Phi Le Nguyen, Vu Minh Hieu Phan
机构
*
School of Instrument Science and Opto-Electronics Engineering, Beijing Information Science and Technology University(北京信息科技大学仪器科学与光电工程学院)
;
Department of Precision Instrument, Tsinghua University(清华大学精密仪器系)