arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86714 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70159 篇

2406.17462 2024-12-12 cs.CV cs.AI 83%

EvolvED: Evolutionary Embeddings to Understand the Generation Process of Diffusion Models

Vidya Prasad, Hans van Gorp, Christina Humer, Ruud J. G. van Sloun, Anna Vilanova, Nicola Pezzotti

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01367 2024-12-11 cs.CV cs.LG 83%

Bigger is not Always Better: Scaling Properties of Latent Diffusion Models

Kangfu Mei, Zhengzhong Tu, Mauricio Delbracio, Hossein Talebi, Vishal M. Patel, Peyman Milanfar

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to TMLR. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16807 2024-12-11 cs.CV 83%

Negative-prompt Inversion: Fast Image Inversion for Editing with Text-guided Diffusion Models

Daiki Miyake, Akihiro Iohara, Yu Saito, Toshiyuki Tanaka

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments 20 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06578 2024-12-10 cs.CV 83%

MoViE: Mobile Diffusion for Video Editing

Adil Karjauv, Noor Fathima, Ioannis Lelekas, Fatih Porikli, Amir Ghodrati, Amirhossein Habibian

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05984 2024-12-10 cs.CV 83%

Nested Diffusion Models Using Hierarchical Latent Priors

Xiao Zhang, Ruoxi Jiang, Rebecca Willett, Michael Maire

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04364 2024-12-10 cs.CV cs.AI cs.LG 83%

VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide

Dohun Lee, Bryan S Kim, Geon Yeong Park, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 26 pages, 19 figures, Project Page: https://dohunlee1.github.io/videoguide.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08850 2024-12-10 cs.CV 83%

COVE: Unleashing the Diffusion Feature Correspondence for Consistent Video Editing

Jiangshan Wang, Yue Ma, Jiayi Guo, Yicheng Xiao, Gao Huang, Xiu Li

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03895 2024-12-06 cs.CV cs.AI cs.LG 83%

A Noise is Worth Diffusion Guidance

Donghoon Ahn, Jiwon Kang, Sanghyun Lee, Jaewon Min, Minjae Kim, Wooseok Jang, Hyoungwon Cho, Sayak Paul, SeonHwa Kim, Eunju Cha, Kyong Hwan Jin, Seungryong Kim

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page: https://cvlab-kaist.github.io/NoiseRefine/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03809 2024-12-06 cs.CV 83%

EditScout: Locating Forged Regions from Diffusion-based Edited Images with Multimodal LLM

Quang Nguyen, Truong Vu, Trong-Tung Nguyen, Yuxin Wen, Preston K Robinette, Taylor T Johnson, Tom Goldstein, Anh Tran, Khoi Nguyen

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09633 2024-12-06 cs.CV 83%

DuoDiff: Accelerating Diffusion Models with a Dual-Backbone Approach

Daniel Gallo Fernández, Răzvan-Andrei Matişan, Alejandro Monroy Muñoz, Ana-Maria Vasilcoiu, Janusz Partyka, Tin Hadži Veljković, Metod Jazbec

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to NeurIPS, see https://openreview.net/forum?id=G7E4tNmmHD

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02432 2024-12-06 cs.CV 83%

Orthogonal Adaptation for Modular Customization of Diffusion Models

Ryan Po, Guandao Yang, Kfir Aberman, Gordon Wetzstein

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Project page: https://ryanpo.com/ortha/ Hugging Face Demo: https://huggingface.co/spaces/ujin-song/ortha

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07360 2024-12-05 cs.CV 83%

Boosting Latent Diffusion with Flow Matching

Johannes Schusterbauer, Ming Gui, Pingchuan Ma, Nick Stracke, Stefan A. Baumann, Vincent Tao Hu, Björn Ommer

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments ECCV 2024 (Oral), Project Page: https://compvis.github.io/fm-boosting/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02962 2024-12-05 cs.CV cs.DC 83%

Partially Conditioned Patch Parallelism for Accelerated Diffusion Model Inference

XiuYu Zhang, Zening Luo, Michelle E. Lu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01756 2024-12-05 cs.CV 83%

ImageFolder: Autoregressive Image Generation with Folded Tokens

Xiang Li, Kai Qiu, Hao Chen, Jason Kuen, Jiuxiang Gu, Bhiksha Raj, Zhe Lin

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Code: https://github.com/lxa9867/ImageFolder

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02631 2024-12-04 cs.CV cs.LG 83%

Sharp-It: A Multi-view to Multi-view Diffusion Model for 3D Synthesis and Manipulation

Yiftach Edelstein, Or Patashnik, Dana Cohen-Bar, Lihi Zelnik-Manor

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Project page at https://yiftachede.github.io/Sharp-It/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01244 2024-12-04 cs.CV 83%

Concept Replacer: Replacing Sensitive Concepts in Diffusion Models via Precision Localization

Lingyun Zhang, Yu Xie, Yanwei Fu, Ping Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01199 2024-12-03 cs.CV cs.AI cs.LG 83%

TinyFusion: Diffusion Transformers Learned Shallow

Gongfan Fang, Kunjun Li, Xinyin Ma, Xinchao Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01118 2024-12-03 cs.CV cs.CR 83%

LoyalDiffusion: A Diffusion Model Guarding Against Data Replication

Chenghao Li, Yuke Zhang, Dake Chen, Jingqi Xu, Peter A. Beerel

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 13 pages, 6 figures, Submission to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00665 2024-12-03 cs.CV 83%

Learning on Less: Constraining Pre-trained Model Learning for Generalizable Diffusion-Generated Image Detection

Yingjian Chen, Lei Zhang, Yakun Niu, Lei Tan, Pei Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00511 2024-12-03 eess.IV cs.AI cs.CV 83%

Energy-Based Prior Latent Space Diffusion model for Reconstruction of Lumbar Vertebrae from Thick Slice MRI

Yanke Wang, Yolanne Y. R. Lee, Aurelio Dolfini, Markus Reischl, Ender Konukoglu, Kyriakos Flouris

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Journal ref MICCAI Workshop on Deep Generative Models, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12044 2024-12-03 cs.CV 83%

ARTIST: Improving the Generation of Text-rich Images with Disentangled Diffusion Models and Large Language Models

Jianyi Zhang, Yufan Zhou, Jiuxiang Gu, Curtis Wigington, Tong Yu, Yiran Chen, Tong Sun, Ruiyi Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to WACV 2025

Journal ref IEEE/CVF Winter Conference on Applications of Computer Vision (WACV 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06090 2024-12-03 cs.CV 83%

What Matters When Repurposing Diffusion Models for General Dense Perception Tasks?

Guangkai Xu, Yongtao Ge, Mingyu Liu, Chengxiang Fan, Kangyang Xie, Zhiyue Zhao, Hao Chen, Chunhua Shen

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Code is at: https://github.com/aim-uofa/GenPercept

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13495 2024-12-03 cs.CV 83%

ReVersion: Diffusion-Based Relation Inversion from Images

Ziqi Huang, Tianxing Wu, Yuming Jiang, Kelvin C. K. Chan, Ziwei Liu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments SIGGRAPH Asia (Conference Track) 2024, Project page: https://ziqihuangg.github.io/projects/reversion.html Code: https://github.com/ziqihuangg/ReVersion

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18824 2024-12-02 cs.CV 83%

FaithDiff: Unleashing Diffusion Priors for Faithful Image Super-resolution

Junyang Chen, Jinshan Pan, Jiangxin Dong

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page: https://jychen9811.github.io/FaithDiff_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18662 2024-12-02 cs.CV 83%

HoliSDiP: Image Super-Resolution via Holistic Semantics and Diffusion Prior

Li-Yuan Tsao, Hao-Wei Chen, Hao-Wei Chung, Deqing Sun, Chun-Yi Lee, Kelvin C. K. Chan, Ming-Hsuan Yang

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Project page: https://liyuantsao.github.io/HoliSDiP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17472 2024-11-28 cs.LG cs.AI cs.CR cs.CV 83%

FreezeAsGuard: Mitigating Illegal Adaptation of Diffusion Models via Selective Tensor Freezing

Kai Huang, Haoming Wang, Wei Gao

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05953 2024-11-28 cs.CV 83%

Frame Interpolation with Consecutive Brownian Bridge Diffusion

Zonglin Lyu, Ming Li, Jianbo Jiao, Chen Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Formatting

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17535 2024-11-27 cs.CV 83%

IMPROVE: Improving Medical Plausibility without Reliance on HumanValidation -- An Enhanced Prototype-Guided Diffusion Framework

Anurag Shandilya, Swapnil Bhat, Akshat Gautam, Subhash Yadav, Siddharth Bhatt, Deval Mehta, Kshitij Jadhav

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16792 2024-11-27 cs.CV 83%

From Diffusion to Resolution: Leveraging 2D Diffusion Models for 3D Super-Resolution Task

Bohao Chen, Yanchao Zhang, Yanan Lv, Hua Han, Xi Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07205 2024-11-27 cs.CV 83%

DLCR: A Generative Data Expansion Framework via Diffusion for Clothes-Changing Person Re-ID

Nyle Siddiqui, Florinel Alin Croitoru, Gaurav Kumar Nayak, Radu Tudor Ionescu, Mubarak Shah

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Published in WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏