arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86714 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70159 篇

2405.20282 2024-11-26 cs.CV 83%

SemFlow: Binding Semantic Segmentation and Image Synthesis via Rectified Flow

Chaoyang Wang, Xiangtai Li, Lu Qi, Henghui Ding, Yunhai Tong, Ming-Hsuan Yang

专题命中 扩散模型 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14863 2024-11-25 cs.CV cs.AI cs.LG 83%

Latent Schrodinger Bridge: Prompting Latent Diffusion for Fast Unpaired Image-to-Image Translation

Jeongsol Kim, Beomsu Kim, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23054 2024-11-25 cs.LG cs.AI cs.CL cs.CV 83%

Controlling Language and Diffusion Models by Transporting Activations

Pau Rodriguez, Arno Blaas, Michal Klein, Luca Zappella, Nicholas Apostoloff, Marco Cuturi, Xavier Suau

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13961 2024-11-22 cs.CV 83%

Zero-Shot Low-Light Image Enhancement via Joint Frequency Domain Priors Guided Diffusion

Jinhong He, Shivakumara Palaiahnakote, Aoxiang Ning, Minglong Xue

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07753 2024-11-22 cs.CV cs.LG 83%

Data Augmentation for Surgical Scene Segmentation with Anatomy-Aware Diffusion Models

Danush Kumar Venkatesh, Dominik Rivoir, Micha Pfeiffer, Fiona Kolbinger, Stefanie Speidel

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Accepted at WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16266 2024-11-22 cs.CV 83%

Inversion Circle Interpolation: Diffusion-based Image Augmentation for Data-scarce Classification

Yanghao Wang, Long Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12811 2024-11-21 cs.CV 83%

Stylecodes: Encoding Stylistic Information For Image Generation

Ciara Rowles

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments code: https://github.com/CiaraStrawberry/stylecodes project page: https://ciarastrawberry.github.io/stylecodes.github.io/. arXiv admin note: substantial text overlap with arXiv:2408.03209

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12773 2024-11-21 cs.CV 83%

Decoupling Training-Free Guided Diffusion by ADMM

Youyuan Zhang, Zehua Liu, Zenan Li, Zhaoyu Li, James J. Clark, Xujie Si

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11475 2024-11-19 cs.CV 83%

MVLight: Relightable Text-to-3D Generation via Light-conditioned Multi-View Diffusion

Dongseok Shim, Yichun Shi, Kejie Li, H. Jin Kim, Peng Wang

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10433 2024-11-18 cs.CV 83%

M-VAR: Decoupled Scale-wise Autoregressive Modeling for High-Quality Image Generation

Sucheng Ren, Yaodong Yu, Nataniel Ruiz, Feng Wang, Alan Yuille, Cihang Xie

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05191 2024-11-18 cs.CV 83%

DiffusionPID: Interpreting Diffusion via Partial Information Decomposition

Rushikesh Zawar, Shaurya Dewan, Prakanshul Saxena, Yingshan Chang, Andrew Luo, Yonatan Bisk

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Journal ref Thirty-Eighth Annual Conference on Neural Information Processing Systems (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21789 2024-11-14 cs.CV 83%

HairDiffusion: Vivid Multi-Colored Hair Editing via Latent Diffusion

Yu Zeng, Yang Zhang, Jiachen Liu, Linlin Shen, Kaijun Deng, Weizhao He, Jinbao Wang

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Journal ref NeurIPS 2024, 38th Annual Conference on Neural Information Processing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07765 2024-11-13 cs.CV 83%

Novel View Synthesis with Pixel-Space Diffusion Models

Noam Elata, Bahjat Kawar, Yaron Ostrovsky-Berman, Miriam Farber, Ron Sokolovsky

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14265 2024-11-13 cs.CV 83%

HYPNOS : Highly Precise Foreground-focused Diffusion Finetuning for Inanimate Objects

Oliverio Theophilus Nathanael, Jonathan Samuel Lumentut, Nicholas Hans Muliawan, Edbert Valencio Angky, Felix Indra Kurniadi, Alfi Yusrotis Zakiyyah, Jeklin Harefa

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 26 pages, 12 figures, to appear on the Rich Media with Generative AI workshop in conjunction with Asian Conference on Computer Vision (ACCV) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02504 2024-11-13 eess.IV cs.CV 83%

Functional Imaging Constrained Diffusion for Brain PET Synthesis from Structural MRI

Minhui Yu, Mengqi Wu, Ling Yue, Andrea Bozoki, Mingxia Liu

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18252 2024-11-13 cs.CV 83%

Improving Training-free Conditional Diffusion Model via Fisher Information

Kaiyu Song, Hanjiang Lai

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08926 2024-11-13 cs.CV 83%

Diffusion Models Meet Remote Sensing: Principles, Methods, and Perspectives

Yidan Liu, Jun Yue, Shaobo Xia, Pedram Ghamisi, Weiying Xie, Leyuan Fang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Journal ref in IEEE Transactions on Geoscience and Remote Sensing, vol. 62, pp. 1-22, 2024, Art no. 4708322

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01698 2024-11-12 eess.IV cs.CV 83%

COSMIC: Compress Satellite Images Efficiently via Diffusion Compensation

Ziyuan Zhang, Han Qiu, Maosen Zhang, Jun Liu, Bin Chen, Tianwei Zhang, Hewu Li

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03053 2024-11-06 cs.CV cs.AI 83%

Gradient-Guided Conditional Diffusion Models for Private Image Reconstruction: Analyzing Adversarial Impacts of Differential Privacy and Denoising

Tao Huang, Jiayang Meng, Hong Chen, Guolong Zheng, Xu Yang, Xun Yi, Hua Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21314 2024-11-06 cs.CL cs.AI cs.CV cs.LG 83%

Decoding Diffusion: A Scalable Framework for Unsupervised Analysis of Latent Space Biases and Representations Using Natural Language Prompts

E. Zhixuan Zeng, Yuhao Chen, Alexander Wong

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21130 2024-11-06 cs.CV 83%

Extrapolating Prospective Glaucoma Fundus Images through Diffusion Model in Irregular Longitudinal Sequences

Zhihao Zhao, Junjie Yang, Shahrooz Faghihroohi, Yinzheng Zhao, Daniel Zapp, Kai Huang, Nassir Navab, M. Ali Nasseri

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at BIBM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14135 2024-11-04 cs.CV 83%

Foodfusion: A Novel Approach for Food Image Composition via Diffusion Models

Chaohua Shi, Xuan Wang, Si Shi, Xule Wang, Mingrui Zhu, Nannan Wang, Xinbo Gao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23788 2024-11-01 cs.CV cs.AI 83%

EDT: An Efficient Diffusion Transformer Framework Inspired by Human-like Sketching

Xinwang Chen, Ning Liu, Yichen Zhu, Feifei Feng, Jian Tang

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Xinwang Chen and Ning Liu are with equal contributions. This paper has been accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19593 2024-11-01 cs.CV 83%

Frame by Familiar Frame: Understanding Replication in Video Diffusion Models

Aimon Rahman, Malsha V. Perera, Vishal M. Patel

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22830 2024-10-31 eess.IV cs.CV 83%

Latent Diffusion, Implicit Amplification: Efficient Continuous-Scale Super-Resolution for Remote Sensing Images

Hanlin Wu, Jiangwei Mo, Xiaohui Sun, Jie Ma

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22732 2024-10-31 eess.IV cs.AI cs.CV 83%

st-DTPM: Spatial-Temporal Guided Diffusion Transformer Probabilistic Model for Delayed Scan PET Image Prediction

Ran Hong, Yuxia Huang, Lei Liu, Zhonghui Wu, Bingxuan Li, Xuemei Wang, Qiegen Liu

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06646 2024-10-31 cs.CV 83%

Hybrid SD: Edge-Cloud Collaborative Inference for Stable Diffusion Models

Chenqian Yan, Songwei Liu, Hongjian Liu, Xurui Peng, Xiaojian Wang, Fangmin Chen, Lean Fu, Xing Mei

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12399 2024-10-31 cs.LG cs.AI cs.CV 83%

Diffusion for World Modeling: Visual Details Matter in Atari

Eloi Alonso, Adam Jelley, Vincent Micheli, Anssi Kanervisto, Amos Storkey, Tim Pearce, François Fleuret

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments NeurIPS 2024 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02730 2024-10-31 cs.CV 83%

U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers

Yuchuan Tian, Zhijun Tu, Hanting Chen, Jie Hu, Chao Xu, Yunhe Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 12 pages, 5 figures

Journal ref NeurIPS 2024 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21721 2024-10-30 cs.CV 83%

DiffSTR: Controlled Diffusion Models for Scene Text Removal

Sanhita Pathak, Vinay Kaushik, Brejesh Lall

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments 11 Pages, 6 Figures, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏