CookingDiffusion: Cooking Procedural Image Generation with Stable Diffusion
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments Accepted in ECCV 2024, 20 pages with 7 figures
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
Comments 20 pages, 12 figures
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
Comments Submitted to RAL
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments 53 pages, 18 figures
专题命中 多模态生成 :MLLM(abstract);分类 cs.CV
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments 10 pages, 3 figures, IEEE J-BHI Special Issue on Foundation Models in Medical Imaging
专题命中 多模态生成 :cross-modal(abstract);分类 eess.AS
Comments Accepted at ICASSP 2025
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Accepted at AAAI 2025
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments Main content 4 pages
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Accepted to TPAMI, an extended version of a paper published in ECCV2020. arXiv admin note: substantial text overlap with arXiv:2007.09278
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
Comments Accepted by Neurips 2024. Code: https://github.com/mulplue/MGF
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments NeurIPS 2024; code: https://github.com/GFNOrg/diffusion-finetuning
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
Comments 9 pages, 2 tables, 4 figures
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
Comments To appear in 2025 IEEE International Symposium on High-Performance Computer Architecture (HPCA 2025)
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments ECCV 2024
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI
Comments Accepted at Conference on Robot Learning (CoRL) 2024
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments 6 pages, 5 figures, 4 tables, The first two authors contributed equally
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CL
专题命中 多模态生成 :multimodal(abstract);分类 cs.CL