arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86714 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70159 篇

2504.10001 2025-04-17 cs.CV 83%

GaussVideoDreamer: 3D Scene Generation with Video Diffusion and Inconsistency-Aware Gaussian Splatting

Junlin Hao, Peiheng Wang, Haoyang Wang, Xinggong Zhang, Zongming Guo

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11457 2025-04-16 cs.CV 83%

Aligning Generative Denoising with Discriminative Objectives Unleashes Diffusion for Visual Perception

Ziqi Pang, Xin Xu, Yu-Xiong Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments ICLR 2025

Journal ref ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11423 2025-04-16 cs.CV cs.AI 83%

ADT: Tuning Diffusion Models with Adversarial Supervision

Dazhong Shen, Guanglu Song, Yi Zhang, Bingqi Ma, Lujundong Li, Dongzhi Jiang, Zhuofan Zong, Yu Liu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09606 2025-04-15 cs.CV 83%

Early-Bird Diffusion: Investigating and Leveraging Timestep-Aware Early-Bird Tickets in Diffusion Models for Efficient Training

Lexington Whalen, Zhenbang Du, Haoran You, Chaojian Li, Sixu Li, Yingyan, Lin

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 10 pages, 5 figures. Accepted to the IEEE/CVF Conference on Computer Vision and Pattern Recognition 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09513 2025-04-15 cs.CV 83%

DiffuMural: Restoring Dunhuang Murals with Multi-scale Diffusion

Puyu Han, Jiaju Kang, Yuhang Pan, Erting Pan, Zeyu Zhang, Qunchao Jin, Juntao Jiang, Zhichen Liu, Luqi Gong

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11423 2025-04-15 cs.CV 83%

Nearly Zero-Cost Protection Against Mimicry by Personalized Diffusion Models

Namhyuk Ahn, KiYoon Yoo, Wonhyuk Ahn, Daesik Kim, Seung-Hun Nam

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08470 2025-04-14 cs.SD cs.AI cs.MM eess.AS 83%

On the Design of Diffusion-based Neural Speech Codecs

Pietro Foti, Andreas Brendel

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07999 2025-04-14 cs.GR 83%

IGG: Image Generation Informed by Geodesic Dynamics in Deformation Spaces

Nian Wu, Nivetha Jayakumar, Jiarui Xing, Miaomiao Zhang

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06432 2025-04-14 cs.CV 83%

D-Feat Occlusions: Diffusion Features for Robustness to Partial Visual Occlusions in Object Recognition

Rupayan Mallick, Sibo Dong, Nataniel Ruiz, Sarah Adel Bargal

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07945 2025-04-11 cs.CV cs.AI 83%

GenEAva: Generating Cartoon Avatars with Fine-Grained Facial Expressions from Realistic Diffusion-based Faces

Hao Yu, Rupayan Mallick, Margrit Betke, Sarah Adel Bargal

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18206 2025-04-11 cs.CV 83%

Balancing Act: Distribution-Guided Debiasing in Diffusion Models

Rishubh Parihar, Abhijnya Bhat, Abhipsa Basu, Saswat Mallick, Jogendra Nath Kundu, R. Venkatesh Babu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments CVPR 2024. Project Page : https://ab-34.github.io/balancing_act/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06264 2025-04-11 cs.LG cs.AI cs.CL cs.CV stat.ML 83%

Think While You Generate: Discrete Diffusion with Planned Denoising

Sulin Liu, Juno Nam, Andrew Campbell, Hannes Stärk, Yilun Xu, Tommi Jaakkola, Rafael Gómez-Bombarelli

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06861 2025-04-10 cs.CV cs.AI 83%

EIDT-V: Exploiting Intersections in Diffusion Trajectories for Model-Agnostic, Zero-Shot, Training-Free Text-to-Video Generation

Diljeet Jagpal, Xi Chen, Vinay P. Namboodiri

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted at IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03821 2025-04-08 cs.CV cs.LG eess.IV 83%

A Hybrid Wavelet-Fourier Method for Next-Generation Conditional Diffusion Models

Andrew Kiruluta, Andreas Lemos

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11408 2025-04-08 cs.CV 83%

Latent Feature and Attention Dual Erasure Attack against Multi-View Diffusion Models for 3D Assets Protection

Jingwei Sun, Xuchong Zhang, Changfeng Sun, Qicheng Bai, Hongbin Sun

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments This paper has been accepted by ICME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02762 2025-04-04 cs.CV 83%

MD-ProjTex: Texturing 3D Shapes with Multi-Diffusion Projection

Ahmet Burak Yildirim, Mustafa Utku Aydogdu, Duygu Ceylan, Aysegul Dundar

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01873 2025-04-03 cs.CV 83%

A Diffusion-Based Framework for Occluded Object Movement

Zheng-Peng Duan, Jiawei Zhang, Siyu Liu, Zheng Lin, Chun-Le Guo, Dongqing Zou, Jimmy Ren, Chongyi Li

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01577 2025-04-03 eess.IV cs.CV 83%

Instance Migration Diffusion for Nuclear Instance Segmentation in Pathology

Lirui Qi, Hongliang He, Tong Wang, Siwei Feng, Guohong Fu

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14279 2025-04-02 cs.CV 83%

ControlSR: Taming Diffusion Models for Consistent Real-World Image Super Resolution

Yuhao Wan, Peng-Tao Jiang, Qibin Hou, Hao Zhang, Jinwei Chen, Ming-Ming Cheng, Bo Li

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23538 2025-04-01 cs.CV 83%

Enhancing Creative Generation on Stable Diffusion-based Models

Jiyeon Han, Dahee Kwon, Gayoung Lee, Junho Kim, Jaesik Choi

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments CVPR 2025 accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06930 2025-04-01 cs.CV 83%

Post-Training Quantization for Diffusion Transformer via Hierarchical Timestep Grouping

Ning Ding, Jing Han, Yuchuan Tian, Chao Xu, Kai Han, Yehui Tang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16778 2025-04-01 cs.CV 83%

RoomPainter: View-Integrated Diffusion for Consistent Indoor Scene Texturing

Zhipeng Huang, Wangbo Yu, Xinhua Cheng, ChengShu Zhao, Yunyang Ge, Mingyi Guo, Li Yuan, Yonghong Tian

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11971 2025-04-01 cs.LG cs.AI cs.CV 83%

DDIL: Diversity Enhancing Diffusion Distillation With Imitation Learning

Risheek Garrepalli, Shweta Mahajan, Munawar Hayat, Fatih Porikli

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22496 2025-03-31 cs.RO cs.CV 83%

Scenario Dreamer: Vectorized Latent Diffusion for Generating Driving Simulation Environments

Luke Rowe, Roger Girgis, Anthony Gosselin, Liam Paull, Christopher Pal, Felix Heide

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03006 2025-03-28 cs.CV 83%

Frequency-Controlled Diffusion Model for Versatile Text-Guided Image-to-Image Translation

Xiang Gao, Zhengbo Xu, Junhan Zhao, Jiaying Liu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Proceedings of the 38th AAAI Conference on Artificial Intelligence (AAAI 2024)

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 2024, 38(3), 1824-1832

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20484 2025-03-27 cs.CV cs.AI 83%

Contrastive Learning Guided Latent Diffusion Model for Image-to-Image Translation

Qi Si, Bo Wang, Zhao Zhang

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 11 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19791 2025-03-26 cs.CV 83%

SITA: Structurally Imperceptible and Transferable Adversarial Attacks for Stylized Image Generation

Jingdan Kang, Haoxin Yang, Yan Cai, Huaidong Zhang, Xuemiao Xu, Yong Du, Shengfeng He

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19731 2025-03-26 cs.CV 83%

PCM : Picard Consistency Model for Fast Parallel Sampling of Diffusion Models

Junhyuk So, Jiwoong Shin, Chaeyeon Jang, Eunhyeok Park

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to the CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19012 2025-03-26 cs.CV 83%

DiffV2IR: Visible-to-Infrared Diffusion Model via Vision-Language Understanding

Lingyan Ran, Lidong Wang, Guangcong Wang, Peng Wang, Yanning Zhang

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Project page: https://diffv2ir.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00759 2025-03-26 cs.CV 83%

DyMO: Training-Free Diffusion Model Alignment with Dynamic Multi-Objective Scheduling

Xin Xie, Dong Gong

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏