arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86623 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70082 篇

2412.05694 2024-12-10 cs.MM cs.GR cs.SD eess.AS 84%

Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation

Leonardo Pina, Yongmin Li

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.GR、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14740 2024-11-25 cs.CV cs.AI cs.GR 84%

TEXGen: a Generative Diffusion Model for Mesh Textures

Xin Yu, Ze Yuan, Yuan-Chen Guo, Ying-Tian Liu, JianHui Liu, Yangguang Li, Yan-Pei Cao, Ding Liang, Xiaojuan Qi

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

Comments Accepted to SIGGRAPH Asia Journal Article (TOG 2024)

Journal ref ACM Transactions on Graphics (TOG) 2024, Volume 43, Issue 6, Article No.: 213, Pages 1-14

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07232 2024-11-13 cs.CV cs.AI cs.GR cs.LG 84%

Add-it: Training-Free Object Insertion in Images With Pretrained Diffusion Models

Yoad Tewel, Rinon Gal, Dvir Samuel, Yuval Atzmon, Lior Wolf, Gal Chechik

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments Project page is at https://research.nvidia.com/labs/par/addit/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19989 2024-10-01 cs.CV cs.GR 84%

RoCoTex: A Robust Method for Consistent Texture Synthesis with Diffusion Models

Jangyeong Kim, Donggoo Kang, Junyoung Choi, Jeonga Wi, Junho Gwon, Jiun Bae, Dumim Yoon, Junghyun Han

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

Comments 11 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08258 2024-09-13 cs.CV cs.MM 84%

Improving Virtual Try-On with Garment-focused Diffusion Models

Siqi Wan, Yehao Li, Jingwen Chen, Yingwei Pan, Ting Yao, Yang Cao, Tao Mei

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.MM

Comments ECCV 2024. Source code is available at https://github.com/siqi0905/GarDiff/tree/master

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07452 2024-09-12 cs.CV cs.MM 84%

Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models

Haibo Yang, Yang Chen, Yingwei Pan, Ting Yao, Zhineng Chen, Chong-Wah Ngo, Tao Mei

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

Comments ACM Multimedia 2024. Source code is available at \url{https://github.com/yanghb22-fdu/Hi3D-Official}

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07447 2024-09-12 cs.CV cs.GR 84%

StereoCrafter: Diffusion-based Generation of Long and High-fidelity Stereoscopic 3D from Monocular Videos

Sijie Zhao, Wenbo Hu, Xiaodong Cun, Yong Zhang, Xiaoyu Li, Zhe Kong, Xiangjun Gao, Muyao Niu, Ying Shan

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

Comments 11 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14826 2024-08-28 cs.CV cs.MM 84%

Alfie: Democratising RGBA Image Generation With No $$$

Fabio Quattrini, Vittorio Pippi, Silvia Cascianelli, Rita Cucchiara

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV、cs.MM

Comments Accepted at ECCV AI for Visual Arts Workshop and Challenges

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09702 2024-08-20 cs.CV cs.AI cs.GR 84%

Photorealistic Object Insertion with Diffusion-Guided Inverse Rendering

Ruofan Liang, Zan Gojcic, Merlin Nimier-David, David Acuna, Nandita Vijaykumar, Sanja Fidler, Zian Wang

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

Comments ECCV 2024, Project page: https://research.nvidia.com/labs/toronto-ai/DiPIR/

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13220 2024-08-12 cs.CV cs.GR cs.LG 84%

TetraDiffusion: Tetrahedral Diffusion Models for 3D Shape Generation

Nikolai Kalischek, Torben Peters, Jan D. Wegner, Konrad Schindler

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

Comments This version introduces further improvements compared to v2. Project page https://tetradiffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03178 2024-08-07 cs.CV cs.GR cs.LG 84%

An Object is Worth 64x64 Pixels: Generating 3D Object via Image Diffusion

Xingguang Yan, Han-Hung Lee, Ziyu Wan, Angel X. Chang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

Comments Project Page: https://omages.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00437 2024-08-07 cs.CV cs.AI cs.GR cs.LG 84%

LoMOE: Localized Multi-Object Editing via Multi-Diffusion

Goirik Chakrabarty, Aditya Chandrasekar, Ramya Hebbalaguppe, Prathosh AP

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03720 2024-06-07 cs.CV cs.MM 84%

JIGMARK: A Black-Box Approach for Enhancing Image Watermarks against Diffusion Model Edits

Minzhou Pan, Yi Zeng, Xue Lin, Ning Yu, Cho-Jui Hsieh, Peter Henderson, Ruoxi Jia

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00672 2024-05-02 cs.GR cs.CV 84%

TexSliders: Diffusion-Based Texture Editing in CLIP Space

Julia Guerrero-Viu, Milos Hasan, Arthur Roullier, Midhun Harikumar, Yiwei Hu, Paul Guerrero, Diego Gutierrez, Belen Masia, Valentin Deschaintre

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments SIGGRAPH 2024 Conference Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00666 2024-05-02 cs.CV cs.GR 84%

RGB$\leftrightarrow$X: Image decomposition and synthesis using material- and lighting-aware diffusion models

Zheng Zeng, Valentin Deschaintre, Iliyan Georgiev, Yannick Hold-Geoffroy, Yiwei Hu, Fujun Luan, Ling-Qi Yan, Miloš Hašan

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR

Journal ref SIGGRAPH Conference Papers '24, July 27-August 1, 2024, Denver, CO, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02238 2024-04-24 cs.CV cs.AI cs.MM 84%

X-Adapter: Adding Universal Compatibility of Plugins for Upgraded Diffusion Model

Lingmin Ran, Xiaodong Cun, Jia-Wei Liu, Rui Zhao, Song Zijie, Xintao Wang, Jussi Keppo, Mike Zheng Shou

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV、cs.MM

Comments Project page: https://showlab.github.io/X-Adapter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05608 2024-03-29 cs.CV cs.MM 84%

Scalable Diffusion Models with State Space Backbone

Zhengcong Fei, Mingyuan Fan, Changqian Yu, Junshi Huang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17870 2024-03-27 cs.CV cs.MM 84%

Boosting Diffusion Models with Moving Average Sampling in Frequency Domain

Yurui Qian, Qi Cai, Yingwei Pan, Yehao Li, Ting Yao, Qibin Sun, Tao Mei

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17782 2024-03-27 cs.CV cs.GR 84%

GenesisTex: Adapting Image Denoising Diffusion to Texture Space

Chenjian Gao, Boyan Jiang, Xinghui Li, Yingpeng Zhang, Qian Yu

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.19330 2024-03-27 cs.CV cs.MM 84%

A Novel Approach to Industrial Defect Generation through Blended Latent Diffusion Model with Online Adaptation

Hanxi Li, Zhengxun Zhang, Hao Chen, Lin Wu, Bo Li, Deyin Liu, Mingwen Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

Comments 13 pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10474 2024-03-27 cs.CV cs.GR cs.LG 84%

Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models

Songwei Ge, Seungjun Nah, Guilin Liu, Tyler Poon, Andrew Tao, Bryan Catanzaro, David Jacobs, Jia-Bin Huang, Ming-Yu Liu, Yogesh Balaji

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

Comments ICCV 2023. Project webpage: https://research.nvidia.com/labs/dir/pyoco

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17004 2024-03-26 cs.CV cs.MM 84%

SD-DiT: Unleashing the Power of Self-supervised Discrimination in Diffusion Transformer

Rui Zhu, Yingwei Pan, Yehao Li, Ting Yao, Zhenglong Sun, Tao Mei, Chang Wen Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12032 2024-03-20 cs.CV cs.GR 84%

Generic 3D Diffusion Adapter Using Controlled Multi-View Editing

Hansheng Chen, Ruoxi Shi, Yulin Liu, Bokui Shen, Jiayuan Gu, Gordon Wetzstein, Hao Su, Leonidas Guibas

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR

Comments V2 note: Fix missing acknowledgements. Project page: https://lakonik.github.io/mvedit

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17664 2024-02-01 cs.CV cs.GR 84%

Image Anything: Towards Reasoning-coherent and Training-free Multi-modal Image Generation

Yuanhuiyi Lyu, Xu Zheng, Lin Wang

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04559 2023-12-08 cs.CV cs.GR 84%

PrimDiffusion: Volumetric Primitives Diffusion for 3D Human Generation

Zhaoxi Chen, Fangzhou Hong, Haiyi Mei, Guangcong Wang, Lei Yang, Ziwei Liu

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

Comments NeurIPS 2023; Project page https://frozenburning.github.io/projects/primdiffusion/ Code available at https://github.com/FrozenBurning/PrimDiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02190 2023-12-08 cs.CV cs.GR 84%

Diffusion Handles: Enabling 3D Edits for Diffusion Models by Lifting Activations to 3D

Karran Pandey, Paul Guerrero, Matheus Gadelha, Yannick Hold-Geoffroy, Karan Singh, Niloy Mitra

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments Project Webpage: https://diffusionhandles.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00971 2023-12-05 cs.CV cs.GR 84%

Consistent Mesh Diffusion

Julian Knodt, Xifeng Gao

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00944 2023-12-05 cs.CV cs.GR 84%

Enhancing Diffusion Models with 3D Perspective Geometry Constraints

Rishi Upadhyay, Howard Zhang, Yunhao Ba, Ethan Yang, Blake Gella, Sicheng Jiang, Alex Wong, Achuta Kadambi

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR

Comments Project Webpage: http://visual.ee.ucla.edu/diffusionperspective.htm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00116 2023-12-04 cs.CV cs.GR cs.LG 84%

S2ST: Image-to-Image Translation in the Seed Space of Latent Diffusion

Or Greenberg, Eran Kishon, Dani Lischinski

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

Comments 17 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07885 2023-11-15 cs.CV cs.AI cs.GR 84%

One-2-3-45++: Fast Single Image to 3D Objects with Consistent Multi-View Generation and 3D Diffusion

Minghua Liu, Ruoxi Shi, Linghao Chen, Zhuoyang Zhang, Chao Xu, Xinyue Wei, Hansheng Chen, Chong Zeng, Jiayuan Gu, Hao Su

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏