GesPrompt: Leveraging Co-Speech Gestures to Augment LLM-Based Interaction in Virtual Reality
专题命中 音频语音多模态 :multimodal(abstract)
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multimodal(abstract)
专题命中 音频语音多模态 :multimodal(abstract)
Comments This thesis was conducted under the guidance of Mohsen Amini Salehi. Special thanks to Minseo Kim and Jacob Bradshaw for their valuable contributions and support throughout the research process. 60 pages, 13 Figures, 2 Tables
专题命中 音频语音多模态 :multi-modal(abstract)
专题命中 音频语音多模态 :multimodal(abstract)
专题命中 音频语音多模态 :audio-visual(abstract)
机构 * Czech Technical University in Prague(布拉格捷克技术大学) ; Czech Institute of Informatics, Robotics, and Cybernetics(捷克信息学、机器人学与控制论研究所)
专题命中 音频语音多模态 :multimodal(abstract)
Comments 8 pages, 7 figures
专题命中 音频语音多模态 :multimodal(abstract)
Comments Extended Abstracts of the CHI Conference on Human Factors in Computing Systems, April 26-May 1, 2025, Yokohama, Japan
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Aeronautics Institute of Technology(航空技术学院)
专题命中 音频语音多模态 :multi-modal(abstract)
Comments 8 pages, 6 figures, 2 tables
Journal ref Scientific Data volume 12, Article number: 468 (2025)
专题命中 音频语音多模态 :multimodal(abstract)
Comments Accepted for publication at the ACM Conference on Human Factors in Computing Systems (CHI) Late Breaking Work 2025
专题命中 音频语音多模态 :multi-modal(abstract)
专题命中 音频语音多模态 :multimodal(abstract)
专题命中 音频语音多模态 :multimodal(abstract)
Comments Accepted to CHI 2025
专题命中 音频语音多模态 :multi-modal(abstract)
机构 * University of Melbourne(墨尔本大学)
专题命中 音频语音多模态 :multimodal(abstract)
Comments Accepted to HRI 2025
机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院(KAIST))
专题命中 音频语音多模态 :cross-modal(abstract)
Comments 25 pages, Accepted at European Conference on Computer Vision (ECCV)
专题命中 音频语音多模态 :multi-modal(abstract)
Comments Presented as an Oral at International Conference on Acoustics, Speech and Signal Processing 2019, United Kingdom
专题命中 音频语音多模态 :multimodal(abstract)
Comments 11 pages (excluding references), 3 figures
专题命中 音频语音多模态 :multi-modal(abstract)
专题命中 音频语音多模态 :multimodal(abstract)
Comments 12pages,7 figures
专题命中 音频语音多模态 :multimodal(abstract)
Comments 6 pages, 1 figure, 21 references
Journal ref Proceedings of CHIRP 2024: Transforming HCI Research in the Philippines Workshop
专题命中 音频语音多模态 :audio-visual(abstract)
专题命中 音频语音多模态 :multimodal(abstract)
Comments 36 pages, 17 figures; Accepted at NeurIPS Dataset and Benchmarks 2024
专题命中 音频语音多模态 :multimodal(abstract)
Journal ref IEEE Open Journal of the Communications Society, vol. 5, pp. 4207-4240, 2024
专题命中 音频语音多模态 :audio-visual(abstract)
Comments Part of proceedings of 6th International Conference AsiaHaptics 2024
专题命中 音频语音多模态 :multimodal(abstract)
专题命中 音频语音多模态 :multimodal(abstract)
Comments Internoise 2024, Aug 2024, Nantes (France), France
专题命中 音频语音多模态 :cross-modal(abstract)
Comments UIST 2024
专题命中 音频语音多模态 :multimodal(abstract)
Comments arXiv admin note: text overlap with arXiv:2302.12244
专题命中 音频语音多模态 :multimodal(abstract)
Comments 15 pages
专题命中 音频语音多模态 :multimodal(abstract)
Comments 8 pages, 10, figures, 1 table, conference: IROS