机构
*
College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(人工智能学院,南京航空航天大学)
;
Department of Orthopedics, Qilu Hospital, Shandong University(骨科部,齐鲁医院,山东大学)
;
Key Laboratory of Qingdao in Medicine and Engineering(医学与工程青岛重点实验室)
Seeing Sarcasm Through Different Eyes: Analyzing Multimodal Sarcasm Perception in Large Vision-Language Models
Junjie Chen, Xuyang Liu, Subin Huang, Linfeng Zhang, Hang Yu
机构
*
Anhui Polytechnic University (AHPU)(安徽工程大学)
;
Shanghai University (SHU)(上海大学)
;
Shanghai Jiao Tong University (SJTU)(上海交通大学)
;
Sichuan University (SCU)(四川大学)
机构
*
Brown University(布朗大学)
;
University of Bristol(布里斯托大学)
;
Columbia University(哥伦比亚大学)
;
University of Rochester(罗切斯特大学)
;
Rutgers University(罗格斯大学)
Connecting Giants: Synergistic Knowledge Transfer of Large Multimodal Models for Few-Shot Learning
Hao Tang, Shengfeng He, Jing Qin
机构
*
Centre for Smart Health, The Hong Kong Polytechnic University(香港理工大学智能健康中心)
;
School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算机与信息系统学院)
DentVLM: A Multimodal Vision-Language Model for Comprehensive Dental Diagnosis and Enhanced Clinical Practice
Zijie Meng, Jin Hao, Xiwei Dai, Yang Feng, Jiaxiang Liu, Bin Feng, Huikai Wu, Xiaotang Gai, Hengchuan Zhu, Tianxiang Hu, Yangyang Wu, Hongxia Xu, Jin Li, Jun Xiao, Xiaoqiang Liu, Joey Tianyi Zhou, Fudong Zhu, Zhihe Zhao, Lunguo Xia, Bing Fang, Jimeng Sun, Jian Wu, Zuozhu Liu
机构
*
Stomatology Hospital, School of Stomatology, Zhejiang University School of Medicine, Zhejiang University, Hangzhou(牙科医院,口腔医学院,浙江大学医学院,浙江大学,杭州)
;
College of Computer Science and Technology, Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University, Hangzhou(计算机科学与技术学院,浙江大学-伊利诺伊大学 Urbana-Champaign 院,浙江大学,杭州)
;
Department of Orthodontics, Shanghai Ninth People’s Hospital, College of Stomatology, Shanghai Jiao Tong University School of Medicine(正畸科,上海第九人民医院,口腔医学院,上海交通大学医学院)
;
Angelalign Technology Inc.(Angelalign 技术公司)
机构
*
State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)
;
Chongqing University of Posts and Telecommunications(重庆邮电大学)
True Multimodal In-Context Learning Needs Attention to the Visual Context
Shuo Chen, Jianzhe Liu, Zhen Han, Yan Xia, Daniel Cremers, Philip Torr, Volker Tresp, Jindong Gu
机构
*
LMU Munich(慕尼黑大学)
;
Technical University of Munich(慕尼黑技术大学)
;
Siemens AG(西门子股份公司)
;
University of Science and Technology of China(中国科学技术大学)
;
Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)
;
Konrad Zuse School of Excellence in Reliable AI (relAI)(Konrad Zuse可靠性人工智能卓越学院)
;
University of Oxford(牛津大学)