MMED: A Multimodal Micro-Expression Dataset based on Audio-Visual Fusion
机构 * College of Communication Engineering, Jilin University(吉林大学通信工程学院)
专题命中 音频语音多模态 :multimodal(title,abstract);audio-visual(title);分类 cs.MM
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * College of Communication Engineering, Jilin University(吉林大学通信工程学院)
专题命中 音频语音多模态 :multimodal(title,abstract);audio-visual(title);分类 cs.MM
机构 * TMCC, College of Computer Science, Nankai University, Tianjin, China(TMCC,计算机科学学院,南开大学,天津,中国) ; Tencent Ethereal Audio Lab, Tencent Corporation, Shenzhen, China(腾讯虚实音频实验室,腾讯公司,深圳,中国)
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL、cs.AI
机构 * Artificial Intelligence Graduate School(人工智能研究生院)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Comments Published in Interspeech 2025
机构 * Johannes Kepler University Linz(约翰内斯·开普勒大学林茨) ; Human-centered AI Group, AI Lab, Linz Institute of Technology(以人为本的人工智能小组、人工智能实验室、林茨技术研究所)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.MM
Comments 7 pages, 6 tables, IEEE International Conference on Content-Based Multimedia Indexing (IEEE CBMI)
机构 * Faculty of Engineering, Bar-Ilan University(巴伊兰大学工程学院) ; OriginAI
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
机构 * Electrical and Computer Engineering(电气与计算机工程) ; North South University(北南大学) ; Computer Engineering North South University Dhaka, Bangladesh(北南大学计算机工程系)
专题命中 音频语音多模态 :multimodal(title);分类 cs.CV、cs.AI
Comments 8 pages, 9 figures
机构 * Institute of Acoustics, Chinese Academy of Sciences, China(中国科学院声学研究所) ; MiLM Plus, Xiaomi Inc., China(小米公司) ; Xi’an Jiaotong Liverpool University, China(西安交通大学利物浦大学) ; University of Chinese Academy of Sciences, China(中国科学院大学)
专题命中 音频语音多模态 :multi-modal(abstract);cross-modal(abstract);分类 eess.AS
Comments 5 pages, 2 figures
机构 * TMCC, College of Computer Science, Nankai University, Tianjin, China(TMCC,计算机科学学院,南开大学,天津,中国) ; MiLM Plus, Xiaomi Inc.(MiLM Plus,小米公司)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI、eess.AS
Comments 5 pages, 1 figure, 2 tables submitted to icassp, under prereview