Multi-Agent Game Generation and Evaluation via Audio-Visual Recordings
机构 * Samsung SAIL Montréal(三星SAIL蒙特利尔)
专题命中 音频语音多模态 :audio-visual(title,abstract);omni-modal(abstract);分类 cs.AI、cs.MM
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Samsung SAIL Montréal(三星SAIL蒙特利尔)
专题命中 音频语音多模态 :audio-visual(title,abstract);omni-modal(abstract);分类 cs.AI、cs.MM
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
机构 * Ben Gurion University of the Negev(本· Gurion 内盖夫大学)
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.AI
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; Tencent AI Lab(腾讯AI实验室)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV、eess.AS
Comments 9 pages
机构 * Creative Computing Institute, University of the Arts London(创意计算研究所,伦敦艺术大学)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI、eess.AS
Comments In Proceedings of Explainable AI for the Arts Workshop 2025 (XAIxArts 2025) arXiv:2406.14485
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
Comments 10 pages, 4 figures