Implicit Counterfactual Learning for Audio-Visual Segmentation
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by ICCV 2025
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by ICCV 2025
机构 * Medical AI Research Center (MedARC)(医学人工智能研究中心(MedARC)) ; Psychological and Brain Sciences, Dartmouth College(心理学与脑科学系,达特茅斯学院) ; Core for Advanced Magnetic Resonance Imaging (CAMRI), Baylor College of Medicine(先进磁共振成像核心(CAMRI),贝勒医学院) ; Sophont ; Princeton Neuroscience Institute(普林斯顿神经科学研究所)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments Code available at https://github.com/MedARC-AI/algonauts2025
机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi'an Jiaotong University, Ant Group(人机混合增强智能国家级实验室,西安交通大学,蚂蚁集团) ; National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi'an Jiaotong University(人机混合增强智能国家级实验室,西安交通大学) ; University at Buffalo(布法罗大学)
专题命中 音频语音多模态 :multimodal(title);multi-modal(abstract);分类 cs.CV、cs.AI
Comments Accepted by ACM MM2025
机构 * Monash University(墨尔本大学) ; Curtin University(Curtin大学) ; American University of Sharjah(沙迦美国大学)
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
机构 * National University of Singapore(新加坡国立大学) ; Renmin University of China(中国人民大学) ; Zhejiang University(浙江大学)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV、cs.AI、eess.AS
Comments 6 figures, 4 tables