Inferring trust in recommendation systems from brain, behavioural, and physiological data
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
机构 * Alibaba Group(阿里巴巴集团)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments Accepted by NeurIPS 2025 (Spotlight). 43 pages, 16 figures, 4 tables
机构 * Dept. of Computer Engineering(计算机工程系) ; Vishwakarma Institute of Technology(维斯瓦卡arma技术学院)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
机构 * Northwestern Polytechnical University(西北工业大学) ; Nanjing University(南京大学) ; Shanghai Jiao Tong University(上海交通大学) ; GuaSemi Speech A Team(GuaSemi语音团队) ; WeNet Community(WeNet社区)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
机构 * ALMAnaCH, INRIA Paris(ALMAnaCH,INRIA巴黎) ; Télécom Paris, SES, Institut Polytechnique de Paris, I3-CNRS(Télécom巴黎,SES,巴黎高等理工学院,I3-CNRS) ; Télécom Paris, LTCI, Institut Polytechnique de Paris(Télécom巴黎,LTCI,巴黎高等理工学院) ; CNRS, ISIR, Sorbonne University(CNRS,ISIR,索邦大学) ; ISIR, Sorbonne University(ISIR,索邦大学)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments 9 pages
机构 * University of Western Brittany(西部布列塔尼大学) ; Psychiatry Department, CHU Brest(布列塔尼大学精神科部门)
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Preprint version of a manuscript submitted to the Journal of Affective Disorders
机构 * Stability AI
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CV
Comments Project Page: https://stability-ai.github.io/foleycontrol.github.io/
机构 * ADAPT Centre, School of Engineering, Trinity College Dublin(ADAPT中心、工程学院、都柏林信任学院)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments Accepted to ACL 2025, Findings of the Association for Computational Linguistics
Journal ref In Findings of the Association for Computational Linguistics: ACL 2025, pages 209--221, Vienna, Austria. Association for Computational Linguistics, 10.18653/v1/2025.findings-acl.12
机构 * Dept. of Computer Science and Technology(计算机科学与技术系) ; University of Alicante(阿尔瓦登特大学) ; Unit of Clinical Nursing Research(临床护理研究单位) ; Faculty of Health Sciences(健康科学学院)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Journal ref Applied Soft Computing, Vol. 184, 2025, Article 113787
机构 * Amazon(亚马逊) ; Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(计算机与数据科学学院,伊利诺伊大学厄巴纳-香槟分校)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments 49 pages
机构 * University of Electronic Science and Technology of China(电子科技大学) ; Southern Methodist University(南方 Methodist 大学) ; The City University of Hong Kong(香港城市大学) ; The Hong Kong Polytechnic University(香港理工大学) ; The Chinese University of Hong Kong(香港中文大学) ; University of Connecticut(康涅狄格大学) ; Tsinghua University(清华大学) ; University of Texas at Arlington(德克萨斯大学阿灵顿分校) ; University of Chinese Academy of Sciences(中国科学院大学) ; Tibet University(西藏大学)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
机构 * Social Cognitive Systems Group, Bielefeld University(比勒菲尔德大学社会认知系统小组)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
机构 * CYENS - Centre of Excellence(CYENS 卓越中心) ; Algolysis Ltd(Algolysis 公司) ; Department of Computer Science(计算机科学系)
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
机构 * DP Technology(DP技术公司) ; Shanghai Jiao Tong University(上海交通大学) ; East China Normal University(华东师范大学)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
机构 * Stanford University(斯坦福大学) ; Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments ASRU 2025
机构 * Beijing Key Lab of Traffic Data Analysis and Mining(北京交通数据挖掘重点实验室) ; Beijing Jiaotong University(北京交通大学) ; Unisound AI Technology Co., Ltd.(Unisound人工智能技术有限公司) ; Peng Cheng Lab(鹏城实验室)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
Comments Accepted to ACL 2025 Findings
Journal ref Findings of the Association for Computational Linguistics: ACL 2025
机构 * Department of Computer Science and Technology, Harbin Institute of Technology(计算机科学与技术系,哈尔滨工业大学) ; Shenzhen Loop Area Institute(深圳河套学院)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
机构 * Key Laboratory of Aerospace Information Security and Trusted Computing, Ministry of Education, School of Cyber Science and Engineering, Wuhan University(航空航天信息安全部分和可信计算重点实验室、教育部、网络安全科学与工程学院、武汉大学) ; School of Cyber Science and Engineering, Wuhan University(网络安全科学与工程学院、武汉大学) ; School of Police Information, Shandong Police College(警务信息学院、山东警察学院)
专题命中 音频语音多模态 :audio-visual(abstract);分类 cs.CV
机构 * National Taiwan University(国立台湾大学) ; ASUS Open Cloud Infrastructure Software Center(ASUS开放云基础设施软件中心)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
Comments 9pages
机构 * Charles University(查尔斯大学) ; Faculty of Mathematics and Physics(数学与物理系) ; Institute of Formal and Applied Linguistics(形式与应用语言学研究所)
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.CL
机构 * Ritsumeikan University(立命馆大学)
专题命中 音频语音多模态 :multi-modal(abstract);分类 eess.AS
Comments Author copy. This paper is in press for presentation at ADADA 2025. Please cite as: Haimes, P. (in press). Chord Colourizer: A near real-time system for visualizing musical key. In Proceedings of the 23rd International Conference of Asia Digital Art and Design Association (ADADA)
机构 * Shanghai Jiao Tong University(上海交通大学) ; Ant Group(蚂蚁集团)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments submitted to ICASSP 2026
机构 * Bar Ilan University(巴伊兰大学)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
机构 * McGill University(麦吉尔大学) ; CRBLM ; Mila Quebec AI Institute(魁北克人工智能研究所) ; Université de Montréal(蒙特利尔大学) ; Nouvelle Voix(新声音) ; Montreal Neurological Institute(蒙特利尔神经科学研究所) ; Concordia University(Concordia大学)
专题命中 音频语音多模态 :multimodal(abstract);分类 eess.AS
Comments Accepted to SMASH 2025
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CL
Comments 11 pages, 4 figures, 3 tables
机构 * Singapore University of Technology and Design(新加坡科技设计大学) ; Hochschule für Musik Detmold(音乐学院Detmold)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.AI
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
Comments ICCV 2025. Project page: https://clink-chop-thud.github.io/
专题命中 音频语音多模态 :audio-visual(abstract);分类 eess.AS
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Bytedance Inc.(字节跳动公司) ; Squirrel AI, USA(squirrel AI 美国分公司) ; The University of Virginia(弗吉尼亚大学) ; Cornell University(康奈尔大学)
专题命中 音频语音多模态 :multimodal(abstract);分类 cs.CV
Comments Github Repo: https://github.com/AdityaLab/MM4TSA Updated to include papers accepted by IJCAI25, KDD25, ICML25, NeurIPS25 4 figures or tables, 19 pages, 251 references