MM-R1: Unleashing the Power of Unified Multimodal Large Language Models for Personalized Image Generation
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; NAVER WEBTOON AI ; Sookmyung Women’s University(成均馆女子大学) ; Inha University(釜山大学)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments Expert Systems with Applications 2025
机构 * Department of Computer Science, School of Mathematics, Statistics and Computer Science, College of Science, University of Tehran, Tehran, Iran(塔里斯坦大学科学学院计算机科学系)
专题命中 多模态生成 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
机构 * Bytedance Waver Team(字节跳动Waver团队)
专题命中 多模态生成 :MLLM(abstract);分类 cs.CV
机构 * Zhejiang Wanli University(浙江万里大学) ; University of Washington(华盛顿大学) ; Huazhong University of Science and Technology(华中科技大学) ; Allen Institute for AI(人工智能研究院)
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
Comments Accepted to ACM MM 2025 Datasets
机构 * ENS Paris-Saclay, Centre Borelli(巴黎-萨克雷大学ENS分校,Borelli中心) ; Université Paris-Saclay, CNRS, ENS Paris-Saclay, Centre Borelli(巴黎-萨克雷大学,法国国家科学研究中心,巴黎-萨克雷大学ENS分校,Borelli中心) ; ENSIIE(Évry法国的ENSIEE)
专题命中 多模态生成 :multimodal(abstract)