arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2409.17747 2024-09-27 cs.CV 79%

Text Image Generation for Low-Resource Languages with Dual Translation Learning

Chihiro Noguchi, Shun Fukuda, Shoichiro Mihara, Masao Yamanaka

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

Comments 23 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06693 2024-09-27 cs.CV cs.AI cs.CG 79%

DC3DO: Diffusion Classifier for 3D Objects

Nursena Koprucu, Meher Shashwat Nigam, Shicheng Xu, Biruk Abere, Gabriele Dominici, Andrew Rodriguez, Sharvaree Vadgama, Berfin Inal, Alberto Tono

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06911 2024-09-27 cs.CV cs.AI 79%

AsyncDiff: Parallelizing Diffusion Models by Asynchronous Denoising

Zigeng Chen, Xinyin Ma, Gongfan Fang, Zhenxiong Tan, Xinchao Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04769 2024-09-27 eess.IV cs.CV cs.LG 79%

Diffusion-based Generative Image Outpainting for Recovery of FOV-Truncated CT Images

Michelle Espranita Liman, Daniel Rueckert, Florian J. Fintelmann, Philip Müller

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Shared last authorship: Florian J. Fintelmann and Philip Müller

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00230 2024-09-27 cs.CV 79%

Latent Watermark: Inject and Detect Watermarks in Latent Diffusion Space

Zheling Meng, Bo Peng, Jing Dong

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17104 2024-09-26 cs.MM 79%

Language-oriented Semantic Communication for Image Transmission with Fine-Tuned Diffusion Model

Xinfeng Wei, Haonan Tong, Nuocheng Yang, Changchuan Yin

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

Comments 6 pages, 9 figures, accepted by Wireless Communications and Signal Processing (WCSP) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16949 2024-09-26 cs.CV 79%

DALDA: Data Augmentation Leveraging Diffusion Model and LLM with Adaptive Guidance Scaling

Kyuheon Jung, Yongdeuk Seo, Seongwoo Cho, Jaeyoung Kim, Hyun-seok Min, Sungchul Choi

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ECCV Synthetic Data for Computer Vision Workshop (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14028 2024-09-26 cs.CV cs.AI cs.CL cs.LG 79%

SurGen: Text-Guided Diffusion Model for Surgical Video Generation

Joseph Cho, Samuel Schmidgall, Cyril Zakka, Mrudang Mathur, Dhamanpreet Kaur, Rohan Shad, William Hiesinger

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17571 2024-09-26 cs.CV 79%

Diffusion Models For Multi-Modal Generative Modeling

Changyou Chen, Han Ding, Bunyamin Sisman, Yi Xu, Ouye Xie, Benjamin Z. Yao, Son Dinh Tran, Belinda Zeng

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Published as a conference paper at ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13652 2024-09-26 cs.CV 79%

ZoDi: Zero-Shot Domain Adaptation with Diffusion-Based Image Transfer

Hiroki Azuma, Yusuke Matsui, Atsuto Maki

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ECCV2024 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00877 2024-09-26 eess.IV cs.CV 79%

Improving the Stability and Efficiency of Diffusion Models for Content Consistent Super-Resolution

Lingchen Sun, Rongyuan Wu, Jie Liang, Zhengqiang Zhang, Hongwei Yong, Lei Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17921 2024-09-25 cs.CV 79%

Do text-free diffusion models learn discriminative visual representations?

Soumik Mukhopadhyay, Matthew Gwilliam, Yosuke Yamaguchi, Vatsal Agarwal, Namitha Padmanabhan, Archana Swaminathan, Tianyi Zhou, Jun Ohya, Abhinav Shrivastava

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Website: see https://mgwillia.github.io/diffssl/ . Code: see https://github.com/soumik-kanad/diffssl . The first two authors contributed equally. 27 pages, 10 figures, 17 tables. Submission under review. (this article supersedes arXiv:2307.08702)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15812 2024-09-25 cs.LG cs.CV 79%

Aided design of bridge aesthetics based on Stable Diffusion fine-tuning

Leye Zhang, Xiangxiang Tian, Chengli Zhang, Hongjun Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15557 2024-09-25 cs.CV 79%

Mixture of Efficient Diffusion Experts Through Automatic Interval and Sub-Network Selection

Alireza Ganjdanesh, Yan Kang, Yuchen Liu, Richard Zhang, Zhe Lin, Heng Huang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to the 18th European Conference on Computer Vision, ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15525 2024-09-25 eess.IV cs.CV cs.SD eess.AS 79%

Speech2rtMRI: Speech-Guided Diffusion Model for Real-time MRI Video of the Vocal Tract during Speech

Hong Nguyen, Sean Foley, Kevin Huang, Xuan Shi, Tiantian Feng, Shrikanth Narayanan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17405 2024-09-25 cs.CV 79%

Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer

Ruizhi Shao, Youxin Pang, Zerong Zheng, Jingxiang Sun, Yebin Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Our project website is https://human4dit.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04629 2024-09-25 cs.CV 79%

DifFUSER: Diffusion Model for Robust Multi-Sensor Fusion in 3D Object Detection and BEV Segmentation

Duy-Tho Le, Hengcan Shi, Jianfei Cai, Hamid Rezatofighi

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08740 2024-09-24 cs.CV cs.LG 79%

SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers

Nanye Ma, Mark Goldstein, Michael S. Albergo, Nicholas M. Boffi, Eric Vanden-Eijnden, Saining Xie

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ECCV 2024; Code available: https://github.com/willisma/SiT

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14589 2024-09-24 cs.CV 79%

URSimulator: Human-Perception-Driven Prompt Tuning for Enhanced Virtual Urban Renewal via Diffusion Models

Chuanbo Hu, Shan Jia, Xin Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14313 2024-09-24 cs.CV 79%

Anisotropic Diffusion Probabilistic Model for Imbalanced Image Classification

Jingyu Kong, Yuan Guo, Yu Wang, Yuping Duan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14280 2024-09-24 cs.CV cs.AI 79%

How to Blend Concepts in Diffusion Models

Lorenzo Olearo, Giorgio Longari, Simone Melzi, Alessandro Raganato, Rafael Peñaloza

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09831 2024-09-24 cs.CV 79%

Digging into contrastive learning for robust depth estimation with diffusion models

Jiyuan Wang, Chunyu Lin, Lang Nie, Kang Liao, Shuwei Shao, Yao Zhao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accept by ACM MM 2024, Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01994 2024-09-24 cs.CV cs.AI cs.LG eess.IV 79%

Waving Goodbye to Low-Res: A Diffusion-Wavelet Approach for Image Super-Resolution

Brian Moser, Stanislav Frolov, Federico Raue, Sebastian Palacio, Andreas Dengel

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19460 2024-09-23 cs.CV 79%

White Matter Geometry-Guided Score-Based Diffusion Model for Tissue Microstructure Imputation in Tractography Imaging

Yui Lo, Yuqian Chen, Fan Zhang, Dongnan Liu, Leo Zekelman, Suheyla Cetin-Karayumak, Yogesh Rathi, Weidong Cai, Lauren J. O'Donnell

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments This paper has been accepted for presentation at The 31st International Conference on Neural Information Processing (ICONIP 2024). 12 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13171 2024-09-23 eess.IV cs.CV cs.LG 79%

Deep Learning based Optical Image Super-Resolution via Generative Diffusion Models for Layerwise in-situ LPBF Monitoring

Francis Ogoke, Sumesh Kalambettu Suresh, Jesse Adamczyk, Dan Bolintineanu, Anthony Garland, Michael Heiden, Amir Barati Farimani

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13116 2024-09-23 cs.CV 79%

BGDB: Bernoulli-Gaussian Decision Block with Improved Denoising Diffusion Probabilistic Models

Chengkun Sun, Jinqian Pan, Russell Stevens Terry, Jiang Bian, Jie Xu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13037 2024-09-23 cs.CV 79%

DNI: Dilutional Noise Initialization for Diffusion Video Editing

Sunjae Yoon, Gwanhyeong Koo, Ji Woo Hong, Chang D. Yoo

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 17 pages, 11 figures, ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10491 2024-09-23 cs.CV 79%

Make a Cheap Scaling: A Self-Cascade Diffusion Model for Higher-Resolution Adaptation

Lanqing Guo, Yingqing He, Haoxin Chen, Menghan Xia, Xiaodong Cun, Yufei Wang, Siyu Huang, Yong Zhang, Xintao Wang, Qifeng Chen, Ying Shan, Bihan Wen

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ECCV 2024; Project Page: https://guolanqing.github.io/Self-Cascade/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12377 2024-09-20 eess.IV cs.CV 79%

Fundus image enhancement through direct diffusion bridges

Sehui Kim, Hyungjin Chung, Se Hie Park, Eui-Sang Chung, Kayoung Yi, Jong Chul Ye

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Published at IEEE JBHI. 12 pages, 10 figures. Code and Data: https://github.com/heeheee888/FD3

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02615 2024-09-20 cs.CV 79%

LaMamba-Diff: Linear-Time High-Fidelity Diffusion Models Based on Local Attention and Mamba

Yunxiang Fu, Chaoqi Chen, Yizhou Yu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏