机构
*
The Hong Kong University of Science(香港科学与技术大学)
;
Guangxi Key Laboratory of Digital Infrastructure, Guangxi Zhuang Autonomous Region Information Center(广西数字基础设施重点实验室,广西壮族自治区信息中心)
;
Shanghai Jiao Tong University(上海交通大学)
Synergistic Dual Spatial-aware Generation of Image-to-Text and Text-to-Image
Yu Zhao, Hao Fei, Xiangtai Li, Libo Qin, Jiayi Ji, Hongyuan Zhu, Meishan Zhang, Min Zhang, Jianguo Wei
机构
*
Tianjin University(天津大学)
;
National University of Singapore(新加坡国立大学)
;
Nanyang Technological University(南洋理工大学)
;
Central South University(中南大学)
;
I 2 R & CFAR, A*STAR(I 2 R与CFAR,A*STAR)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
CytoDiff: AI-Driven Cytomorphology Image Synthesis for Medical Diagnostics
Jan Carreras Boada, Rao Muhammad Umer, Carsten Marr
机构
*
Institute of AI for Health, Helmholtz Zentrum München - German Research Center for Environmental Health(人工智能与健康研究所,慕尼黑德国环境健康研究中心)
;
Department of Medicine III, Ludwig-Maximilian-University Hospital(第三医学部,路德维希-马克西米利安大学医院)
;
DKTK, German Cancer Consortium(德国癌症联盟,DKTK)
;
Escola Superior de Comerç Internacional, Universitat Pompeu Fabra (ESCI-UPF)(国际商业学校,庞培法布拉大学(ESCI-UPF))
SATURN: Autoregressive Image Generation Guided by Scene Graphs
Thanh-Nhan Vo, Trong-Thuan Nguyen, Tam V. Nguyen, Minh-Triet Tran
机构
*
University of Science, VNU-HCM(越南国家大学科学大学)
;
Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学河内市)
;
University of Dayton(Dayton 大学)
;
Ohio, USA(俄亥俄州,美国)
Trade-offs in Image Generation: How Do Different Dimensions Interact?
Sicheng Zhang, Binzhu Xie, Zhonghao Yan, Yuli Zhang, Donghao Zhou, Xiaofei Chen, Shi Qiu, Jiaqi Liu, Guoyang Xie, Zhichao Lu
机构
*
Khalifa University(卡利法大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Queen Mary University of London(伦敦大学玛丽女王学院)
;
Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学)
;
City University of Hong Kong(香港城市大学)
CommentsEqual contribution by both authors, Published at CVPR 2025 Workshop on Experimental Model Auditing via Controllable Synthesis (EMACS) and Workshop on Demographic Diversity in Computer Vision (DemoDiv)
Multimodal Pragmatic Jailbreak on Text-to-image Models
Tong Liu, Zhixin Lai, Jiawen Wang, Gengyuan Zhang, Shuo Chen, Philip Torr, Vera Demberg, Volker Tresp, Jindong Gu
机构
*
LMU Munich, Germany(慕尼黑大学)
;
Munich Center for Machine Learning, Germany(慕尼黑机器学习中心)
;
Saarland University, Germany(萨尔兰大学)
;
Max Planck Institute for Informatics, Germany(马克斯·普朗克信息研究所)
;
Cornell University, USA(康奈尔大学)
;
University of Oxford, UK(牛津大学)