Can MLLMs Perform Text-to-Image In-Context Learning?
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
Comments Accepted at COLM 2024
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
Comments Accepted at COLM 2024
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Accepted by ECCV 2024, code and dataset available in https://github.com/open-mmlab/AnyControl
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments Accepted by ECCV2024
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Accepted at European Conference on Computer Vision (ECCV 2024)
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments ECCV2024
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments ECCV 2024; project page: https://yhzhai.github.io/idol/
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Camera-ready version
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Accepted at the 21st International Conference on Content-Based Multimedia Indexing (CBMI 2024)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments MICCAI 2024, Early Accept
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments 24 pages, 8 figures, 6 tables. Accepted by IEEE Reviews in Biomedical Engineering
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
Comments 29 pages, 11 figures, 17 tables
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Accepted at CVPR 2024 Workshop: SyntaGen-Harnessing Generative Models for Synthetic Visual Datasets. Project page at https://synbenchmark.github.io/SynCloneBenchmark Comments: Fix typo in Fig. 1
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CL
Comments Accepted to ACL2024 (main, long)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments Technical Report; Code at: https://github.com/Alpha-VLLM/Lumina-T2X
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments Project-page: https://font-studio.github.io/
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments 13 pages, 11 figures
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments Accepted by IEEE Transactions on Image Processing