Vision-Language Models as Differentiable Semantic and Spatial Rewards for Text-to-3D Generation
机构 * Peking University(北京大学) ; Xiaohongshu Inc(小红书公司)
专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
机构 * Peking University(北京大学) ; Xiaohongshu Inc(小红书公司)
专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV
专题命中 可控生成 :image generation(abstract);分类 cs.CV、cs.MM
Comments 30 pages, 14 figures
机构 * Southern University of Science and Technology(南方科技大学) ; Shanghai Innovation Institute(上海创新研究院) ; University of Warwick(沃林顿大学)
专题命中 可控生成 :diffusion(abstract);分类 cs.CV
专题命中 可控生成 :diffusion(abstract)
Comments 12 pages, 1 figure
专题命中 可控生成 :diffusion(abstract)
机构 * Center on Frontiers of Computing Studies, School of Computer Science, Peking University(前沿计算研究中心,计算机科学学院,北京大学) ; PKU-AgiBot Lab(北京大学AGIBot实验室) ; School of Ocean and Civil Engineering, Shanghai Jiao Tong University(海洋与ivil工程学院,上海交通大学) ; Xense Robotics(Xense机器人)
专题命中 可控生成 :diffusion(abstract)