The In-Car Sign Language Corpus (ICSL): A Multi-Modal Resource for Constrained-Space Sign Language Recognition
车内手语语料库(ICSL):用于受限空间手语识别的多模态资源
Raviteja Boddu, Guilherme Vieira Leite, Joed Lopes da Silva, Ângelo Benetti, Isabela Barbieri, Natália de Melo Afonso, Thyago Santos, Helio Pedrini, Felipe Venâncio Barbosa, José Mario De Martino, Munir Georges, Alessandro Zimmer
机构
*
Technische Hochschule Ingolstadt (THI)(因戈尔施塔特技术大学)
;
Universidade Estadual de Campinas (UNICAMP)(坎皮纳斯州立大学)
;
Universidade de São Paulo (USP)(圣保罗大学)
A Quantitative Analysis of Multimodal Biomarkers in Alzheimer's Disease
阿尔茨海默病多模态生物标志物的定量分析
Antonio Scardace, Daniele Ravì
机构
*
Department of Mathematics and Computer Science(数学与计算机科学系)
;
University of Catania(卡塔尼亚大学)
;
Department MIFT(MIFT部门)
;
University of Messina(梅西纳大学)
Qi Ming, Zihan Yang, Shaoguang Huang, Si Sun, Hanqing Zhang, Nanqing Liu, Jiahui Lv, Juan Fang, Aleksandra Pizurica
机构
*
Beijing University of Technology(北京工业大学)
;
Southwest University(西南大学)
;
China University of Geosciences Wuhan(中国地质大学(武汉))
;
Tsinghua University(清华大学)
;
Beijing Institute of Technology(北京理工大学)
;
Yunnan Normal University(云南师范大学)
;
Beijing Forestry University(北京林业大学)
;
Ghent University(根特大学)
Comments6 figures and 5 tables. Hong Jiang, Junnan Zhu, and Jingwang Huang contributed equally. Jiang Zhong and Kaiwen Wei are corresponding authors. Code and data are available at https://github.com/hongshi4/M3R-Bench
机构
*
Shandong Second Medical University(山东第二医科大学)
;
Shandong University(山东大学)
;
Bairong Inc.(百融云创科技股份有限公司)
;
Ke Holdings Inc.(贝壳控股有限公司)
;
School of Computer Science and Technology, Shandong University(山东大学计算机科学与技术学院)
;
Shandong Provincial Key Laboratory of Computing-Network Integration, Shandong University(山东大学计算网络融合技术山东省重点实验室)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Xiaomi Corporation(小米公司)
;
State Key Laboratory of Communication Content Cognition, People’s Daily Online(人民日报社传播内容认知国家重点实验室)
GReFEM: Multimodal LLMs as Zero-Shot Semantic Assistants for Physics-Guided 3D Mesh Refinement
GReFEM:多模态大语言模型作为用于物理引导的3D网格细化的零样本语义助手
Kartik Bali, Mahish K. Guru, Christian J Cyron, Roland Aydin
机构
*
Institute of Material Systems Modeling(材料系统建模研究所)
;
Helmholtz Zentrum Hereon(海德堡研究中心Hereon)
;
Institute of Material and Process Design(材料与加工设计研究所)
;
German Research Center for Artificial Intelligence(德国人工智能研究中心)
机构
*
School of Automation, Northwestern Polytechnical University(自动化学院,西北工业大学)
;
College of Missile Engineering, Rocket Force University of Engineering(导弹工程学院,火箭兵工程大学)
;
School of Artificial Intelligence, Chongqing University of Posts and Telecommunications(人工智能学院,重庆邮电大学)
机构
*
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Zhejiang University(浙江大学)
;
The Chinese University of Hong Kong(香港中文大学)
专题命中
多模态评测
:multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV
机构
*
Institute of Automation, Chinese Academy of Sciences (CAS)(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
CASI Vision Technology Co., Ltd.(中科慧远视觉技术有限公司)
;
Shandong Laboratory of Aluminum Advanced Manufacturing in Binzhou (SLAAMB), Binzhou Institute of Technology, Weiqiao-UCAS Science and Technology Park(山东省滨州市铝先进制造实验室(SLAAMB),滨州技术学院,魏桥国科科技园)
;
Space Information Research Institute, Hangzhou Dianzi University(杭州电子科技大学空间信息研究院)
;
School of Software, Tsinghua University(清华大学软件学院)
机构
*
Department of Computer Science and Engineering, Rajshahi University of Engineering & Technology(拉贾沙希工程与技术大学计算机科学与工程系)
;
Department of Electrical Engineering, Qatar University(卡塔尔大学电气工程系)
;
Department of Civil and Environmental Engineering, Qatar University(卡塔尔大学土木与环境工程系)
;
SenseNet Inc.(SenseNet公司)
PanDent: Toward Comprehensive Tooth-Level Structure-Language Consistency in Dental Radiology
PanDent:面向牙科放射学中全面的牙级结构-语言一致性
Xiaohan Li, Xinyu Liu, Chang Liu, Sum Wing Au Yeung, Jun Liu, Yixuan Yuan, Hui Chen
机构
*
Faculty of Dentistry, The University of Hong Kong(香港大学牙医学院)
;
Imperial College London(帝国理工学院)
;
University of Science and Technology of China(中国科学技术大学)
;
Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系)
;
Department of Electronic Engineering, The Chinese University of Hong Kong(香港中文大学电子工程系)
Evolution of Accuracy and Visual-Cognitive Errors in a Decade of Vision-Language AI Models
十年视觉语言人工智能模型中准确性和视觉认知错误的演变
Shravan Murlidaran, Miguel P. Eckstein
机构
*
Psychological & Brain Sciences, University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校心理与脑科学系)
;
Department of Computer Science, University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校计算机科学系)
;
Department of Electrical and Computer Engineering, University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校电气与计算机工程系)
机构
*
ARC Training Centre for Automated Vehicles in Rural and Remote Regions (AVR3)(澳大利亚农村及偏远地区自动驾驶车辆ARC培训中心)
;
Université Gustave Eiffel(Gustave Eiffel大学)
;
Queensland University of Technology (QUT)(昆士兰科技大学)