arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86623 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70082 篇

2307.10373 2023-11-21 cs.CV 85%

TokenFlow: Consistent Diffusion Features for Consistent Video Editing

Michal Geyer, Omer Bar-Tal, Shai Bagon, Tali Dekel

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09221 2023-11-16 cs.CV 85%

Single-Image 3D Human Digitization with Shape-Guided Diffusion

Badour AlBahar, Shunsuke Saito, Hung-Yu Tseng, Changil Kim, Johannes Kopf, Jia-Bin Huang

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments SIGGRAPH Asia 2023. Project website: https://human-sgd.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.05556 2023-11-10 cs.CV cs.LG 85%

LCM-LoRA: A Universal Stable-Diffusion Acceleration Module

Simian Luo, Yiqin Tan, Suraj Patil, Daniel Gu, Patrick von Platen, Apolinário Passos, Longbo Huang, Jian Li, Hang Zhao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18729 2023-11-08 cs.CV 85%

Real-World Image Variation by Aligning Diffusion Inversion Chain

Yuechen Zhang, Jinbo Xing, Eric Lo, Jiaya Jia

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments NuerIPS 2023 Spotlight. 21 pages; Code: https://github.com/dvlab-research/RIVAL/ Project page: https://rival-diff.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00056 2023-11-02 cs.CV cs.AI cs.LG 85%

Diversity and Diffusion: Observations on Synthetic Image Distributions with Stable Diffusion

David Marwood, Shumeet Baluja, Yair Alon

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00219 2023-10-31 cs.CV cs.AI cs.CL cs.LG 85%

Diffusion Brush: A Latent Diffusion Model-based Editing Tool for AI-generated Images

Peyman Gholami, Robert Xiao

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10765 2023-10-24 cs.CV cs.AI cs.CL 85%

BiomedJourney: Counterfactual Biomedical Image Generation by Instruction-Learning from Multimodal Patient Journeys

Yu Gu, Jianwei Yang, Naoto Usuyama, Chunyuan Li, Sheng Zhang, Matthew P. Lungren, Jianfeng Gao, Hoifung Poon

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Project page & demo: https://aka.ms/biomedjourney

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01506 2023-10-20 cs.CV 85%

Direct Inversion: Boosting Diffusion-based Editing with 3 Lines of Code

Xuan Ju, Ailing Zeng, Yuxuan Bian, Shaoteng Liu, Qiang Xu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07702 2023-10-12 cs.CV 85%

ScaleCrafter: Tuning-free Higher-Resolution Visual Generation with Diffusion Models

Yingqing He, Shaoshu Yang, Haoxin Chen, Xiaodong Cun, Menghan Xia, Yong Zhang, Xintao Wang, Ran He, Qifeng Chen, Ying Shan

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments Project page: https://yingqinghe.github.io/scalecrafter/ Github: https://github.com/YingqingHe/ScaleCrafter

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06160 2023-10-11 cs.CV 85%

DatasetDM: Synthesizing Data with Perception Annotations Using Diffusion Models

Weijia Wu, Yuzhong Zhao, Hao Chen, Yuchao Gu, Rui Zhao, Yefei He, Hong Zhou, Mike Zheng Shou, Chunhua Shen

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);image synthesis(abstract);分类 cs.CV

Journal ref Proc. Advances In Neural Information Processing Systems (NeurIPS 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01110 2023-10-03 cs.LG cs.AI cs.CV stat.ML 85%

Prompt-tuning latent diffusion models for inverse problems

Hyungjin Chung, Jong Chul Ye, Peyman Milanfar, Mauricio Delbracio

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments 22 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11281 2023-09-25 cs.CV cs.LG 85%

SlotDiffusion: Object-Centric Generative Modeling with Diffusion Models

Ziyi Wu, Jingyu Hu, Wuyue Lu, Igor Gilitschenski, Animesh Garg

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments NeurIPS 2023 Spotlight. Project page: https://slotdiffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16582 2023-09-12 cs.CV 85%

Any-Size-Diffusion: Toward Efficient Text-Driven Synthesis for Any-Size HD Images

Qingping Zheng, Yuanfan Guo, Jiankang Deng, Jianhua Han, Ying Li, Songcen Xu, Hang Xu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09306 2023-08-21 cs.CV 85%

DiffDis: Empowering Generative Diffusion Model with Cross-Modal Discrimination Capability

Runhui Huang, Jianhua Han, Guansong Lu, Xiaodan Liang, Yihan Zeng, Wei Zhang, Hang Xu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments ICCV2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06713 2023-08-15 cs.CV 85%

LAW-Diffusion: Complex Scene Generation by Diffusion with Layouts

Binbin Yang, Yi Luo, Ziliang Chen, Guangrun Wang, Xiaodan Liang, Liang Lin

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06101 2023-08-14 cs.CV 85%

Taming the Power of Diffusion Models for High-Quality Virtual Try-On with Appearance Flow

Junhong Gou, Siyu Sun, Jianfu Zhang, Jianlou Si, Chen Qian, Liqing Zhang

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08702 2023-07-18 cs.CV 85%

Diffusion Models Beat GANs on Image Classification

Soumik Mukhopadhyay, Matthew Gwilliam, Vatsal Agarwal, Namitha Padmanabhan, Archana Swaminathan, Srinidhi Hegde, Tianyi Zhou, Abhinav Shrivastava

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

Comments 15 pages, 7 figures, 10 tables, submission under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06272 2023-07-13 cs.CV cs.CR cs.LG 85%

Exposing the Fake: Effective Diffusion-Generated Images Detection

Ruipeng Ma, Jinhao Duan, Fei Kong, Xiaoshuang Shi, Kaidi Xu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments AdvML-Frontiers@ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08257 2023-06-16 cs.CV cs.CR 85%

On the Robustness of Latent Diffusion Models

Jianping Zhang, Zhuoer Xu, Shiwen Cui, Changhua Meng, Weibin Wu, Michael R. Lyu

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05182 2023-06-14 cs.CV cs.LG 85%

Interactive Fashion Content Generation Using LLMs and Latent Diffusion Models

Krishna Sri Ipsit Mantri, Nevasini Sasikumar

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Third Workshop on Ethical Considerations in Creative applications of Computer Vision (EC3V) at CVPR 2023. arXiv admin note: substantial text overlap with arXiv:2301.02110, arXiv:2112.10752 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.06013 2023-06-01 cs.CV cs.AI cs.LG 85%

The Stable Artist: Steering Semantics in Diffusion Latent Space

Manuel Brack, Patrick Schramowski, Felix Friedrich, Dominik Hintersdorf, Kristian Kersting

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments This is a report of preliminary results. A full version of the paper is available at: arXiv:2301.12247

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18726 2023-05-31 cs.CV 85%

Diffusion-Stego: Training-free Diffusion Generative Steganography via Message Projection

Daegyu Kim, Chaehun Shin, Jooyoung Choi, Dahuin Jung, Sungroh Yoon

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06555 2023-05-31 cs.LG cs.CV 85%

One Transformer Fits All Distributions in Multi-Modal Diffusion at Scale

Fan Bao, Shen Nie, Kaiwen Xue, Chongxuan Li, Shi Pu, Yaole Wang, Gang Yue, Yue Cao, Hang Su, Jun Zhu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to ICML2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.01316 2023-05-31 cs.CV cs.AI cs.CR cs.LG 85%

Are Diffusion Models Vulnerable to Membership Inference Attacks?

Jinhao Duan, Fei Kong, Shiqi Wang, Xiaoshuang Shi, Kaidi Xu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments To appear in ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11540 2023-05-22 cs.CV cs.CL 85%

Efficient Cross-Lingual Transfer for Chinese Stable Diffusion with Images as Pivots

Jinyi Hu, Xu Han, Xiaoyuan Yi, Yutong Chen, Wenhao Li, Zhiyuan Liu, Maosong Sun

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04651 2023-05-09 cs.CV 85%

ReGeneration Learning of Diffusion Models with Rich Prompts for Zero-Shot Image Translation

Yupei Lin, Sen Zhang, Xiaojun Yang, Xiao Wang, Yukai Shi

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

Comments https://yupeilin2388.github.io/publication/ReDiffuser

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08477 2023-04-19 cs.CV 85%

Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation

Jie An, Songyang Zhang, Harry Yang, Sonal Gupta, Jia-Bin Huang, Jiebo Luo, Xi Yin

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments https://latent-shift.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03298 2023-04-18 cs.CV cs.AI 85%

Diversity is Definitely Needed: Improving Model-Agnostic Zero-shot Classification via Stable Diffusion

Jordan Shipard, Arnold Wiliem, Kien Nguyen Thanh, Wei Xiang, Clinton Fookes

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments (10 pages, 6 figures, 3 tables, preprint)

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.12152 2023-03-28 cs.CV cs.AI cs.LG 85%

All are Worth Words: A ViT Backbone for Diffusion Models

Fan Bao, Shen Nie, Kaiwen Xue, Yue Cao, Chongxuan Li, Hang Su, Jun Zhu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05830 2023-02-14 eess.IV cs.CV cs.LG 85%

NephroNet: A Novel Program for Identifying Renal Cell Carcinoma and Generating Synthetic Training Images with Convolutional Neural Networks and Diffusion Models

Yashvir Sabharwal

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 22 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏