VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments Codes and models are available at https://github.com/fenfenfenfan/VMix
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments Codes and models are available at https://github.com/fenfenfenfan/VMix
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2024
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Project Page: $\href{https://elements2design.github.io/}{\text{elements2design}}$
专题命中 多模态生成 :cross-modal(abstract);分类 eess.AS
Comments Accepted by IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Accepted by International Journal of Computer Vision
Journal ref International Journal of Computer Vision, 2025
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments 2025 AAAI
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments 15 figures, 5 tables
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
Comments NeurIPS2024 Accepted
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments 22 figures, 21 pages
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Accepted by AAAI2025
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CL
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments NeurIPS 2024. Project page: https://dco-t2i.github.io/
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments This work was accepted to the 2024 IEEE FG Conference. The final version is available at 10.1109/FG59268.2024.10581934
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Project Page: https://memoavatar.github.io
专题命中 多模态生成 :MLLM(abstract);分类 cs.CV
Comments Project website: https://karine-h.github.io/GenMAC/
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
专题命中 多模态生成 :any-to-any(abstract);分类 cs.CL
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Published in Proceedings of ECCV, Workshop on Assistive Computer Vision and Robotics, 2024
专题命中 多模态生成 :audio-visual(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments 18 pages, 16 figures, 5 tables
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI