KMM: Key Frame Mask Mamba for Extended Motion Generation
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments ICLR 2025
Journal ref ICLR 2025
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments CVPR 2025
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Journal ref The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025
专题命中 多模态生成 :multi-modal(abstract);分类 eess.AS
Comments 10 pages, 5 figures
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Early work, technical report
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Accepted at WACV 2025
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Submitted to ICDAR 2025
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments 24 pages, 13 figures
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
Comments 9 pages (+2 pages of references), 2 figures
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Accepted at IEEE ISBI 2025
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
专题命中 多模态生成 :audio-visual(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Project page: https://havent-invented.github.io/DiTaiListener
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments CVPR 2025
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments Project page: https://bytedance.github.io/UNO Code and model: https://github.com/bytedance/UNO
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Computer Vision and Pattern Recognition
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments arXiv admin note: substantial text overlap with arXiv:2405.17814
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments Submitted to Dialogue & Discourse 2023
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments Project Page: https://haonan16.github.io/coord_bimanual_page/. 12 pages, 12 figures, Accepted at ICRA 2025
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments Accepted to CVPR 2025