AlanaVLM: A Multimodal Embodied AI Foundation Model for Egocentric Video Understanding
专题命中 视频多模态 :multimodal(title);分类 cs.CV、cs.CL、cs.AI
Comments Code available https://github.com/alanaai/EVUD
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :multimodal(title);分类 cs.CV、cs.CL、cs.AI
Comments Code available https://github.com/alanaai/EVUD
专题命中 视频多模态 :multimodal(title,abstract)
专题命中 视频多模态 :multimodal(title);分类 cs.CV、cs.AI、cs.MM
专题命中 视频多模态 :multi-modal(title);multimodal(abstract)
Comments Accepted by International Conference on Neural Computing for Advanced Applications, 2024
专题命中 视频多模态 :multimodal(title,abstract)
Comments ICLR 2024 Workshop on Learning From Time Series for Health. 10 pages, 3 figures
专题命中 视频多模态 :multimodal(title,abstract)
专题命中 视频多模态 :multimodal(title,abstract)
专题命中 视频多模态 :multi-modal(title,abstract)
专题命中 视频多模态 :multi-modal(title,abstract)
Comments 12 pages, 9 figures, accepted by T-MECH
Journal ref IEEE/ASME Transactions on Mechatronics. 2023:1-12
专题命中 视频多模态 :multimodal(title);multi-modal(abstract)
Comments This paper has been accepted for publication at the HRI2024 conference
专题命中 视频多模态 :multimodal(title,abstract)
Comments 19 pages, 5 figures
专题命中 视频多模态 :multimodal(title,abstract)
Comments 36 pages, 19 figures
专题命中 视频多模态 :multi-modal(title,abstract)
Comments 3rd International Conference on Natural Language Processing for Digital Humanities (NLP4DH)
专题命中 视频多模态 :multi-modal(title,abstract)
专题命中 视频多模态 :multimodal(title,abstract)
Journal ref Commun Med 3, 115 (2023)
专题命中 视频多模态 :multimodal(title,abstract)
Comments 4 pages
专题命中 视频多模态 :multimodal(title);multi-modal(abstract)
专题命中 视频多模态 :multi-modal(title,abstract)
专题命中 视频多模态 :multimodal(title,abstract)
专题命中 视频多模态 :multi-modal(title,abstract)
Comments This paper have been accepted by ASE 2023
专题命中 视频多模态 :multi-modal(title);multimodal(abstract)
Comments In Proceedings of the 31st ACM International Conference on Multimedia (ACM MM 2023)
专题命中 视频多模态 :multi-modal(title,abstract)
Comments To appear in the 5th Multidisciplinary International Symposium on Disinformation in Open Online Media (MISDOOM 2023)
专题命中 视频多模态 :multimodal(title,abstract)
专题命中 视频多模态 :multimodal(title,abstract)
Comments Interspeech 2023
专题命中 视频多模态 :multimodal(title,abstract)
专题命中 视频多模态 :multimodal(title,abstract)
专题命中 视频多模态 :multi-modal(title,abstract)
Comments 6 pages, 12 figures, Submitted to ITSC2023
专题命中 视频多模态 :multi-modal(title,abstract)
专题命中 视频多模态 :multimodal(title,abstract)
Comments arXiv admin note: text overlap with arXiv:2011.05817
专题命中 视频多模态 :multimodal(title,abstract)