Compositional Scene Understanding through Inverse Generative Modeling
机构 * Harvard University(哈佛大学)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments ICML 2025, Webpage: https://energy-based-model.github.io/compositional-inference
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
机构 * Harvard University(哈佛大学)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments ICML 2025, Webpage: https://energy-based-model.github.io/compositional-inference
机构 * School of Computing Science, University of Glasgow(计算科学学院,格拉斯哥大学)
专题命中 文生图 :image synthesis(abstract);分类 cs.CV
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments CVPR 2025
机构 * Advanced Micro Devices Inc.(先进微器件公司) ; Dalian University of Technology(大连理工大学) ; Tsinghua University(清华大学)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments Code: https://github.com/AMD-AIG-AIMA/ReNeg
机构 * Shanghai Jiao Tong University(上海交通大学) ; Meituan(美团)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments CVPR 2025 Oral
机构 * Imperial College London(伦敦帝国理工学院) ; Kheiron Medical Technologies(Kheiron医疗技术公司)
专题命中 文生图 :image synthesis(abstract);分类 cs.CV
Comments Code available at https://github.com/biomedia-mira/counterfactual-contrastive/
Journal ref Medical Image Analysis, Volume 105, October 2025
机构 * University of Cagliari(卡利里大学) ; Ruhr University Bochum(波恩鲁尔大学) ; University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) ; University of Pisa(比萨大学) ; Sapienza University of Rome(罗马萨皮恩扎大学) ; CINI(CINI研究所)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
机构 * Dept. of Pathology, University Medical Center Utrecht(病理学系,乌得勒支大学医学中心) ; Dept. of Biomedical Engineering, Eindhoven University of Technology(生物医学工程系,埃因霍温理工大学) ; Dept. of Mathematics and Computer Science, Eindhoven University of Technology(数学与计算机科学系,埃因霍温理工大学)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments 11 pages, 1 figure
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments In Proceedings of the 42st International Conference on Machine Learning (ICML 2025), Project page at https://ml-research.github.io/human-centered-genai/projects/llavaguard/index.html
机构 * University of Oxford(牛津大学) ; MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) ; Stability AI
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
机构 * Graduate School of Engineering, The University of Osaka(大阪大学工学研究科) ; Graduate School of BASE, Tokyo University of Agriculture and Technology(东京大学农业技术大学院大学)
专题命中 文生图 :image synthesis(abstract);分类 cs.CV
机构 * Tsinghua University(清华大学) ; Peking University(北京大学) ; ShengShu(盛舒)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments Project page: https://github.com/JAMESYJL/ShapeLLM-Omni
机构 * University of Michigan(密歇根大学)
专题命中 文生图 :image synthesis(abstract);分类 cs.CV
机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) ; Sensetime Research(商汤科技研究院) ; Tongji University(同济大学) ; Beijing Institute of Technology(北京理工大学) ; Shanghai AI Lab(上海人工智能实验室)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments Project Page: https://github.com/MCG-NJU/SORCE
专题命中 文生图 :image synthesis(abstract);分类 cs.CV
Comments Project page at https://visualsphinx.github.io/
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments code: https://github.com/wangyuchi369/RICO
机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校) ; Saint Louis University(圣路易斯大学) ; The George Washington University(乔治华盛顿大学)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments 13 pages, 4 figures, 4 tables
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院) ; School of Information Science and Technology, University of Science and Technology of China, Hefei, China(中国科学技术大学信息科学与技术学院) ; Sun Yat-sen University Shenzhen Campus, School of Cyber Science and Technology, Shenzhen, China(中山大学深圳校区计算机科学与技术学院)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院) ; Department of Computer Science, University of California, Los Angeles, USA(加州大学洛杉矶分校计算机科学系) ; Sun Yat-sen University Shenzhen Campus, School of Cyber Science and Technology, Shenzhen, China(中山大学深圳校区信息科学与技术学院)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
机构 * ShanghaiTech University(上海科技大学) ; MIT(麻省理工学院) ; Northeastern University(东北大学)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
机构 * Beijing University of Posts and Telecommunications(北京邮电大学) ; SenseTime(商汤科技) ; Beijing Key Laboratory of Network System and Network Culture(北京网络系统与网络文化重点实验室) ; Key Laboratory of Intereactive Technology and Experience System, Ministry of Culture and Tourism(文化和旅游部交互技术与体验系统重点实验室)
专题命中 文生图 :image synthesis(abstract);分类 cs.CV
机构 * Microsoft Research Redmond(微软研究院红mond分部) ; Microsoft Cambridge(微软剑桥分部)
专题命中 文生图 :image synthesis(abstract);分类 cs.CV
Comments Published in: (1) ICLR 2025 Workshop on Data Problems, (2) ICLR 2025 Workshop on Synthetic Data
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments Published at CVPR Workshops 2025
机构 * Tencent(腾讯)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
机构 * TU Berlin(柏林技术大学) ; BIFOLD(BIFOLD机构) ; EPFL(苏黎世联邦理工学院)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments Accepted at IEEE International Geoscience and Remote Sensing Symposium (IGARSS) 2025. Our code is available at https://git.tu-berlin.de/rsim/redundacy-aware-rs-vlm
机构 * North Carolina State University(北卡罗来纳州立大学) ; Middle Tennessee State University(中田纳西州立大学)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments 4 pages, 2 figures
机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments Project page here: https://hierarchical-chain-of-generation.github.io/
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments Accepted to CVPR25. Project page: https://davidetalon.github.io/fashionact-page/
机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(科学与工程学院,香港中文大学(深圳)) ; Future Network of Intelligence Institute, CUHK-Shenzhen(智能网络研究院,CUHK-深圳)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
Comments project page: https://kevinlee09.github.io/research/MVHumanNet++/. arXiv admin note: substantial text overlap with arXiv:2312.02963