Intelligent Carrier Allocation: A Cross-Modal Reasoning Framework for Adaptive Multimodal Steganography
专题命中 音频语音多模态 :multimodal(title,abstract);cross-modal(title,abstract);分类 cs.MM
Comments 8 pages, 10 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multimodal(title,abstract);cross-modal(title,abstract);分类 cs.MM
Comments 8 pages, 10 figures
机构 * School of Electrical Engineering and Computer Science (EECS), KTH Royal Institute of Technology(电气工程与计算机科学学院(EECS),皇家理工学院) ; Department of Computer and Network Engineering, The University of Electro-Communications(计算机与网络工程系,东京电讯大学)
专题命中 音频语音多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.MM
机构 * University at Buffalo, SUNY(布法罗大学,SUNY) ; Dolby Laboratories Inc.(杜比实验室公司)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.MM
机构 * College of Computer Science, Inner Mongolia University, China(内蒙古大学计算机科学学院) ; Lenovo, China(联想公司)
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract)
机构 * MERaLiON Team Institute for Infocomm Research (I 2 R), A*STAR, Singapore(MERaLiON团队信息与通信研究所(I 2 R),A*STAR,新加坡)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
机构 * Nanyang Technological University (NTU)(南洋理工大学) ; MiroMind(米罗Mind) ; Institute for Infocomm Research (I 2 R)(信息与通信研究院) ; A*STAR(科技研究局)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments Link: https://github.com/AudioLLMs/AudioBench/tree/main/IFEval-Audio