A Unified Multi-Agent Framework for Universal Multimodal Understanding and Generation
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);any-to-any(abstract);分类 cs.AI
Comments 8 pages, 5 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);any-to-any(abstract);分类 cs.AI
Comments 8 pages, 5 figures
机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; Peking University(北京大学) ; Carnegie Mellon University(卡内基梅隆大学) ; Alibaba Group(阿里巴巴集团) ; National University of Defense Technology(国防科技大学) ; Meta
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV
Comments 10 pages, 12 figures
机构 * Basic Algorithm Center, PCG, Tencent(腾讯基础算法中心、PCG、腾讯)
专题命中 多模态生成 :multimodal(abstract);MLLM(abstract);分类 cs.CV
机构 * Paris-Saclay University(巴黎-萨克雷大学) ; ONERA - The French Aerospace Lab(法国航空航天实验室)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
Comments Project Page: https://haroldchen19.github.io/PhysHPO-Page/
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV
机构 * Linqing Chen, Hanmeng Zhong, Wentao Wu, Weilei Wang(作者)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CL
机构 * Beihang University(北航) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; Taishan University(泰山大学) ; Nanyang Technological University(南洋理工大学) ; Henan University of Science and Technology(河南科技大学)
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
机构 * Intelligent Autonomous Systems Lab, Computer Science Department, Technical University of Darmstadt, Germany(德意志图林根技术大学计算机科学系智能自主系统实验室) ; Poznan University of Technology, Poland(波兰波兹南技术大学) ; IDEAS, Warsaw, Poland(波兰华沙IDEAS) ; Centre for Cognitive Science, Technical University of Darmstadt, Germany(德意志图林根技术大学认知科学中心) ; German Research Center for AI (DFKI), Research Department: SAIROL, Darmstadt, Germany(德国人工智能研究中心(DFKI)研究部:SAIROL,德意志图林根,德国) ; Hessian.AI, Darmstadt, Germany(黑森AI,德意志图林根,德国)
专题命中 多模态生成 :multimodal(abstract)