How Good is Automatic Segmentation as a Multimodal Discourse Annotation Aid?
专题命中 音频语音多模态 :multimodal(title);分类 cs.CL
Comments 7 pages, 1 figure, 2 tables, Proceedings of 19th Joint ISO-ACL Workshop on Interoperable Semantic Annotation (ISA 2023)
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multimodal(title);分类 cs.CL
Comments 7 pages, 1 figure, 2 tables, Proceedings of 19th Joint ISO-ACL Workshop on Interoperable Semantic Annotation (ISA 2023)
专题命中 音频语音多模态 :cross-modal(title);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV
专题命中 音频语音多模态 :cross-modal(title);分类 cs.MM
Comments 5pages,3figures
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV
Comments 17 pages, 14 figures, 14 tables, Accepted to WACV 2023. Project page: https://cvit.iiit.ac.in/research/projects/cvit-projects/avlectures
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV
Comments Accepted at IEEE International Conference on Automatic Face and Gesture Recognition (FG 2023), publication and presentation at refereed IEEE workshop
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV
Comments Winter Conference on Applications of Computer Vision (WACV), 2023
专题命中 音频语音多模态 :multimodal(title);分类 eess.AS
Comments 5 pages, accepted by INTERSPEECH 2020
Journal ref Proc. Interspeech 2020, 2717-2721
专题命中 音频语音多模态 :multimodal(title);分类 eess.AS
Comments To appear at Interspeech 2022
专题命中 音频语音多模态 :audio-visual(title);分类 eess.AS
Journal ref Robotics Science and Systems (RSS) 2022
专题命中 音频语音多模态 :cross-modal(title);分类 cs.CV
Comments Accepted by IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2022. Camera-Ready Version, 19 Pages
专题命中 音频语音多模态 :multimodal(title);分类 eess.AS
Comments 5 pages, 3 figures, IEEE ICASSP 2022
专题命中 音频语音多模态 :multimodal(title);分类 cs.MM
Comments Accepted at the International Conference on Autonomous Agents and Multiagent Systems (AAMAS) 2022
专题命中 音频语音多模态 :audio-visual(title);分类 eess.AS
Comments arXiv admin note: text overlap with arXiv:2102.06454
Journal ref 2021 IEEE Workshop on Applications of Signal Processing to Audio and Acoustics (WASPAA)
专题命中 音频语音多模态 :cross-modal(title);分类 cs.CV
Comments Accepted at WACV 2022
专题命中 音频语音多模态 :multimodal(title);分类 cs.CV
Journal ref IEEE Transactions on Multimedia (2021)
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV
专题命中 音频语音多模态 :cross-modal(title);分类 eess.AS
Journal ref ICASSP 2021
专题命中 音频语音多模态 :cross-modal(title);分类 cs.CL
Comments Accepted at InterSpeech2021
专题命中 音频语音多模态 :multi-modal(title);分类 eess.AS
Comments Accepted for publication in the Proceedings of the 29th European Signal Processing Conference (EUSIPCO), Dublin, Ireland, 2021
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV
专题命中 音频语音多模态 :multi-modal(title);分类 cs.CV
Comments Accepted to NeurIPS 2020. Project page: https://www.robots.ox.ac.uk/~vgg/research/selavi, code: https://github.com/facebookresearch/selavi
专题命中 音频语音多模态 :multimodal(title);分类 eess.AS
Comments Results on test dataset and acknowledgements were added
专题命中 音频语音多模态 :cross-modal(title);分类 eess.AS
Comments 5 pages, 1 figure
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV
Comments Accepted to ACMMM-2020
专题命中 音频语音多模态 :audio-visual(title);分类 eess.AS
专题命中 音频语音多模态 :multimodal(title);分类 eess.AS
Comments The 45th International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2020)
专题命中 音频语音多模态 :multimodal(title);分类 eess.AS
Comments submitted to ICASSP 2020
专题命中 音频语音多模态 :multi-modal(title);分类 cs.CL
Journal ref Proceedings of the 30th ACM Conference on Hypertext and Social Media - HT 2019, 49-53. Hof, Germany: ACM Press