CoherenDream: Boosting Holistic Text Coherence in 3D Generation via Multimodal Large Language Models Feedback
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);cross-modal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);cross-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Sun Yat-sen University(中山大学) ; CUHK MMLab(香港中文大学多模态实验室) ; Peking University(北京大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments 19 pages, 8 figures
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; HKUST (GZ)(香港科技大学) ; University of Macau(澳门大学) ; Institute of Automation Chinese Academy of Sciences(中国科学院自动化研究所) ; Soochow University(苏州大学) ; KTH Royal Institute of Technology(皇家理工学院) ; Peking University(北京大学) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments Survey, 82 pages, GitHub: https://github.com/weigao266/Awesome-Efficient-Arch
机构 * Michigan State University(密歇根州立大学) ; Seoul National University(首尔国立大学) ; Rutgers University(罗格斯大学) ; Brookhaven National Laboratory(布鲁赫斯国家实验室)
专题命中 多模态生成 :audio-visual(abstract);分类 cs.AI、eess.AS
Comments Accepted at the ACM MM 2025 - The 1st CogMAEC Workshop (Oral)
机构 * Boston University(波士顿大学) ; Georgetown University(乔治城大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Research Institute, National Cancer Center Korea(韩国国家癌症中心研究所) ; Department of Radiology, National Cancer Center Korea(韩国国家癌症中心放射科)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
机构 * UC San Diego(UC圣地亚哥大学)
专题命中 多模态生成 :multi-modal(abstract)
Comments Project website: https://rnr-dp.github.io