Audio-Visual Separation with Hierarchical Fusion and Representation Alignment
专题命中 多模态训练与对齐 :audio-visual(title,abstract);multimodal(abstract);分类 cs.MM
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态训练与对齐 :audio-visual(title,abstract);multimodal(abstract);分类 cs.MM
机构 * University of Maryland, College Park(马里兰大学学院 park)
专题命中 多模态训练与对齐 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
机构 * The Ohio State University(俄亥俄州立大学) ; Bosch Research North America(博世北美研究)
专题命中 多模态训练与对齐 :multimodal(title,abstract);分类 cs.CV、cs.AI
机构 * University of California, Los Angeles(加州大学洛杉矶分校) ; The Hong Kong University of Science and Technology(香港科技大学) ; Columbia University(哥伦比亚大学) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);分类 cs.CL
机构 * University of Southern California(美国南加州大学) ; Emory University(埃默里大学)
专题命中 多模态训练与对齐 :multimodal(abstract);MLLM(abstract);分类 cs.CV
机构 * Beijing Institute of Technology(北京理工大学) ; Basic Algorithm Center, PCG, Tencent(腾讯基本算法中心)
专题命中 多模态训练与对齐 :multimodal(abstract);MLLM(abstract);分类 cs.CV
机构 * ALTA Institute(ALTA研究院) ; Department of Computer Science & Technology, University of Cambridge(计算机科学与技术系,剑桥大学)
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CL、cs.AI
Comments Accepted to the EMNLP 2025 BabyLM Workshop
机构 * Handong Global University(Handong Global大学)
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Medical Image Computing and Computer-Assisted Intervention (MICCAI) Predictive Intelligence in Medicine Workshop (MICCAI PRIME) 2025; 13 pages
机构 * University of Southern California(美国南加州大学)
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV