arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86585 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70051 篇

2402.19043 2024-10-15 eess.IV cs.CV 89%

WDM: 3D Wavelet Diffusion Models for High-Resolution Medical Image Synthesis

Paul Friedrich, Julia Wolleb, Florentin Bieder, Alicia Durrer, Philippe C. Cattin

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at DGM4MICCAI 2024. Project page: https://pfriedri.github.io/wdm-3d-io Code: https://github.com/pfriedri/wdm-3d

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00307 2024-10-02 cs.CV 89%

RadGazeGen: Radiomics and Gaze-guided Medical Image Generation using Diffusion Models

Moinak Bhattacharya, Gagandeep Singh, Shubham Jain, Prateek Prasanna

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04109 2024-10-02 cs.CV 89%

From Text to Mask: Localizing Entities Using the Attention of Text-to-Image Diffusion Models

Changming Xiao, Qi Yang, Feng Zhou, Changshui Zhang

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments A revised version of this paper will be published in Neurocomputing, see https://doi.org/10.1016/j.neucom.2024.128437

Journal ref Neurocomputing, Volume 610, 2024, 128437

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11895 2024-08-14 cs.CV 89%

FreeDiff: Progressive Frequency Truncation for Image Editing with Diffusion Models

Wei Wu, Qingnan Fan, Shuai Qin, Hong Gu, Ruoyu Zhao, Antoni B. Chan

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by ECCV-2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16982 2024-07-25 cs.CV cs.AI 89%

Diffree: Text-Guided Shape Free Object Inpainting with Diffusion Model

Lirui Zhao, Tianshuo Yang, Wenqi Shao, Yuxin Zhang, Yu Qiao, Ping Luo, Kaipeng Zhang, Rongrong Ji

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15270 2024-07-23 eess.IV cs.CV 89%

MedEdit: Counterfactual Diffusion-based Image Editing on Brain MRI

Malek Ben Alaya, Daniel M. Lang, Benedikt Wiestler, Julia A. Schnabel, Cosmin I. Bercea

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted at MICCAI24 Simulation and Synthesis in Medical Imaging (SASHIMI) workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00752 2024-07-02 cs.CV cs.AI 89%

Chest-Diffusion: A Light-Weight Text-to-Image Model for Report-to-CXR Generation

Peng Huang, Xue Gao, Lihong Huang, Jing Jiao, Xiaokang Li, Yuanyuan Wang, Yi Guo

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16333 2024-06-25 cs.CV cs.AI 89%

Prompt-Consistency Image Generation (PCIG): A Unified Framework Integrating LLMs, Knowledge Graphs, and Controllable Diffusion Models

Yichen Sun, Zhixuan Chu, Zhan Qin, Kui Ren

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03626 2024-06-25 cs.CV 89%

TokenCompose: Text-to-Image Diffusion with Token-level Supervision

Zirui Wang, Zhizhou Sha, Zheng Ding, Yilin Wang, Zhuowen Tu

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments CVPR 2024, 21 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13388 2024-06-07 cs.CV 89%

UNIMO-G: Unified Image Generation through Multimodal Conditional Diffusion

Wei Li, Xue Xu, Jiachen Liu, Xinyan Xiao

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by ACL 2024, Main Conference, Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12531 2024-05-22 cs.CV cs.LG 89%

CustomText: Customized Textual Image Generation using Diffusion Models

Shubham Paliwal, Arushi Jain, Monika Sharma, Vikram Jamwal, Lovekesh Vig

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by AI for Content Creation (AI4CC) workshop at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13127 2024-04-30 cs.CV cs.AI cs.CR 89%

MetaCloak: Preventing Unauthorized Subject-driven Text-to-image Diffusion-based Synthesis via Meta-learning

Yixin Liu, Chenrui Fan, Yutong Dai, Xun Chen, Pan Zhou, Lichao Sun

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);personalized generation(abstract);分类 cs.CV

Comments Accepted to CVPR 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18608 2024-04-02 cs.CV cs.AI cs.LG 89%

Contrastive Denoising Score for Text-guided Latent Diffusion Image Editing

Hyelin Nam, Gihyun Kwon, Geon Yeong Park, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract);分类 cs.CV

Comments CVPR 2024 (poster); Project page: https://hyelinnam.github.io/CDS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05239 2024-03-11 cs.CV cs.AI cs.LG 89%

Towards Effective Usage of Human-Centric Priors in Diffusion Models for Text-based Human Image Generation

Junyan Wang, Zhenhong Sun, Zhiyu Tan, Xuanbai Chen, Weihua Chen, Hao Li, Cheng Zhang, Yang Song

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01212 2024-03-05 cs.CV 89%

TCIG: Two-Stage Controlled Image Generation with Quality Enhancement through Diffusion

Salaheldin Mohamed

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.01799 2024-03-01 cs.CV cs.LG 89%

Global Context with Discrete Diffusion in Vector Quantised Modelling for Image Generation

Minghui Hu, Yujie Wang, Tat-Jen Cham, Jianfei Yang, P. N. Suganthan

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.09869 2024-02-22 cs.CV cs.LG 89%

RenderDiffusion: Image Diffusion for 3D Reconstruction, Inpainting and Generation

Titas Anciukevičius, Zexiang Xu, Matthew Fisher, Paul Henderson, Hakan Bilen, Niloy J. Mitra, Paul Guerrero

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at CVPR 2023. Project page: https://github.com/Anciukevicius/RenderDiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14153 2024-01-17 cs.CV 89%

DomainStudio: Fine-Tuning Diffusion Models for Domain-Driven Image Generation using Limited Data

Jingyuan Zhu, Huimin Ma, Jiansheng Chen, Jian Yuan

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments extended from DDPM-PA (arXiv:2211.03264), 33 pages, 34 figures. arXiv admin note: substantial text overlap with arXiv:2211.03264

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15707 2024-01-05 cs.CV 89%

High-Fidelity Diffusion-based Image Editing

Chen Hou, Guoqiang Wei, Zhibo Chen

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03540 2023-12-07 cs.CV 89%

FoodFusion: A Latent Diffusion Model for Realistic Food Image Generation

Olivia Markham, Yuhao Chen, Chi-en Amy Tai, Alexander Wong

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19066 2023-10-31 cs.CV 89%

Nested Diffusion Processes for Anytime Image Generation

Noam Elata, Bahjat Kawar, Tomer Michaeli, Michael Elad

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00224 2023-10-03 cs.CV cs.AI cs.LG 89%

Steered Diffusion: A Generalized Framework for Plug-and-Play Conditional Image Synthesis

Nithin Gopalakrishnan Nair, Anoop Cherian, Suhas Lohit, Ye Wang, Toshiaki Koike-Akino, Vishal M. Patel, Tim K. Marks

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);image generation(abstract);inpainting(abstract)

Comments Accepted at ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09614 2023-09-19 cs.CV cs.AI cs.LG 89%

Gradpaint: Gradient-Guided Inpainting with Diffusion Models

Asya Grechka, Guillaume Couairon, Matthieu Cord

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.09781 2023-07-20 cs.CV cs.AI cs.LG 89%

Text2Layer: Layered Image Generation using Latent Diffusion Model

Xinyang Zhang, Wentian Zhao, Xin Lu, Jeff Chien

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments Preprint. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01952 2023-07-06 cs.CV cs.AI 89%

SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis

Dustin Podell, Zion English, Kyle Lacey, Andreas Blattmann, Tim Dockhorn, Jonas Müller, Joe Penna, Robin Rombach

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11984 2023-06-22 eess.IV cs.AI cs.CV 89%

TauPETGen: Text-Conditional Tau PET Image Synthesis Based on Latent Diffusion Models

Se-In Jang, Cristina Lois, Emma Thibault, J. Alex Becker, Yafei Dong, Marc D. Normandin, Julie C. Price, Keith A. Johnson, Georges El Fakhri, Kuang Gong

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10804 2023-06-21 cs.CV 89%

Conditional Text Image Generation with Diffusion Models

Yuanzhi Zhu, Zhaohai Li, Tianwei Wang, Mengchao He, Cong Yao

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13050 2023-05-23 cs.SD cs.CV cs.LG eess.AS 89%

AudioToken: Adaptation of Text-Conditioned Diffusion Models for Audio-to-Image Generation

Guy Yariv, Itai Gat, Lior Wolf, Yossi Adi, Idan Schwartz

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to INTERSPEECH 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.15257 2023-03-29 cs.CV cs.AI 89%

ERNIE-ViLG 2.0: Improving Text-to-Image Diffusion Model with Knowledge-Enhanced Mixture-of-Denoising-Experts

Zhida Feng, Zhenyu Zhang, Xintong Yu, Yewei Fang, Lanxin Li, Xuyi Chen, Yuxiang Lu, Jiaxiang Liu, Weichong Yin, Shikun Feng, Yu Sun, Li Chen, Hao Tian, Hua Wu, Haifeng Wang

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to CVPR 2023, highlight. Project page: https://wenxin.baidu.com/ernie-vilg

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.09319 2023-03-17 cs.CV 89%

Unified Multi-Modal Latent Diffusion for Joint Subject and Text Conditional Image Generation

Yiyang Ma, Huan Yang, Wenjing Wang, Jianlong Fu, Jiaying Liu

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏