arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2412.07984 2024-12-12 cs.CV 79%

Diffusion-Based Attention Warping for Consistent 3D Scene Editing

Eyal Gomel, Lior Wolf

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07590 2024-12-12 eess.IV cs.CV 79%

Motion Artifact Removal in Pixel-Frequency Domain via Alternate Masks and Diffusion Model

Jiahua Xu, Dawei Zhou, Lei Hu, Jianfeng Guo, Feng Yang, Zaiyi Liu, Nannan Wang, Xinbo Gao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 12 pages, 8 figures, AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17825 2024-12-12 cs.CV cs.AI 79%

Diffusion Model Patching via Mixture-of-Prompts

Seokil Ham, Sangmin Woo, Jin-Young Kim, Hyojun Go, Byeongjun Park, Changick Kim

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments AAAI 2025; Project: https://sangminwoo.github.io/DMP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07152 2024-12-11 cs.CV 79%

Hero-SR: One-Step Diffusion for Super-Resolution with Human Perception Priors

Jiangang Wang, Qingnan Fan, Qi Zhang, Haigen Liu, Yuhang Yu, Jinwei Chen, Wenqi Ren

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06859 2024-12-11 cs.LG cs.AI cs.CV 79%

Generating floorplans for various building functionalities via latent diffusion model

Mohamed R. Ibrahim, Josef Musil, Irene Gallou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 17

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06840 2024-12-11 cs.LG cs.CV 79%

MDiFF: Exploiting Multimodal Score-based Diffusion Models for New Fashion Product Performance Forecasting

Andrea Avogaro, Luigi Capogrosso, Franco Fummi, Marco Cristani

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at the FashionAI workshop @ the European Conference on Computer Vision (ECCV) 2024. arXiv admin note: substantial text overlap with arXiv:2412.05566

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04000 2024-12-11 cs.CV 79%

IF-MDM: Implicit Face Motion Diffusion Model for High-Fidelity Realtime Talking Head Generation

Sejong Yang, Seoung Wug Oh, Yang Zhou, Seon Joo Kim

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Underreview

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14078 2024-12-11 cs.CV 79%

Stable-Hair: Real-World Hair Transfer via Diffusion Model

Yuxuan Zhang, Qing Zhang, Yiren Song, Jichao Zhang, Hao Tang, Jiaming Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.21066 2024-12-11 cs.CV 79%

Mixed Diffusion for 3D Indoor Scene Synthesis

Siyi Hu, Diego Martin Arroyo, Stephanie Debats, Fabian Manhardt, Luca Carlone, Federico Tombari

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 16 pages, 10 figures. Under review. Code released at: https://github.com/MIT-SPARK/MiDiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06666 2024-12-10 eess.IV cs.CV physics.med-ph 79%

Diff5T: Benchmarking Human Brain Diffusion MRI with an Extensive 5.0 Tesla K-Space and Spatial Dataset

Shanshan Wang, Shoujun Yu, Jian Cheng, Sen Jia, Changjun Tie, Jiayu Zhu, Haohao Peng, Yijing Dong, Jianzhong He, Fan Zhang, Yaowen Xing, Xiuqin Jia, Qi Yang, Qiyuan Tian, Hua Guo, Guobin Li, Hairong Zheng

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 19 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06614 2024-12-10 cs.CV 79%

MVReward: Better Aligning and Evaluating Multi-View Diffusion Models with Human Preferences

Weitao Wang, Haoran Xu, Yuxiao Yang, Zhifang Liu, Jun Meng, Haoqian Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06487 2024-12-10 eess.IV cs.CV cs.LG 79%

Improving text-conditioned latent diffusion for cancer pathology

Aakash Madhav Rao, Debayan Gupta

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06248 2024-12-10 cs.CV 79%

Rendering-Refined Stable Diffusion for Privacy Compliant Synthetic Data

Kartik Patwari, David Schneider, Xiaoxiao Sun, Chen-Nee Chuah, Lingjuan Lyu, Vivek Sharma

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06243 2024-12-10 cs.CV eess.IV 79%

U-Know-DiffPAN: An Uncertainty-aware Knowledge Distillation Diffusion Framework with Details Enhancement for PAN-Sharpening

Sungpyo Kim, Jeonghyeok Do, Jaehyup Lee, Munchurl Kim

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Please visit our project page at https://kaist-viclab.github.io/U-Know-DiffPAN-site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13263 2024-12-10 cs.CV 79%

FilterPrompt: A Simple yet Efficient Approach to Guide Image Appearance Transfer in Diffusion Models

Xi Wang, Yichen Peng, Heng Fang, Yilin Wang, Haoran Xie, Xi Yang, Chuntao Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project Page: https://meaoxixi.github.io/FilterPrompt/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05899 2024-12-10 cs.CV 79%

Accelerating Video Diffusion Models via Distribution Matching

Yuanzhi Zhu, Hanshu Yan, Huan Yang, Kai Zhang, Junnan Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05628 2024-12-10 cs.CV cs.AI 79%

Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising

Gongfan Fang, Xinyin Ma, Xinchao Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05619 2024-12-10 cs.CV 79%

Do We Need to Design Specific Diffusion Models for Different Tasks? Try ONE-PIC

Ming Tao, Bing-Kun Bao, Yaowei Wang, Changsheng Xu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 11 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05566 2024-12-10 cs.CV cs.LG 79%

Dif4FF: Leveraging Multimodal Diffusion Models and Graph Neural Networks for Accurate New Fashion Product Performance Forecasting

Andrea Avogaro, Luigi Capogrosso, Franco Fummi, Marco Cristani

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at the 27th International Conference on Pattern Recognition (ICPR 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11814 2024-12-10 cs.CV 79%

Contrastive Sequential-Diffusion Learning: Non-linear and Multi-Scene Instructional Video Synthesis

Vasco Ramos, Yonatan Bitton, Michal Yarom, Idan Szpektor, Joao Magalhaes

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02229 2024-12-10 cs.CV 79%

LaMoD: Latent Motion Diffusion Model For Myocardial Strain Generation

Jiarui Xing, Nivetha Jayakumar, Nian Wu, Yu Wang, Frederick H. Epstein, Miaomiao Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16034 2024-12-10 cs.CV 79%

DiffuBox: Refining 3D Object Detection with Point Diffusion

Xiangyu Chen, Zhenzhen Liu, Katie Z Luo, Siddhartha Datta, Adhitya Polavaram, Yan Wang, Yurong You, Boyi Li, Marco Pavone, Wei-Lun Chao, Mark Campbell, Bharath Hariharan, Kilian Q. Weinberger

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05043 2024-12-09 cs.CV cs.LG eess.IV 79%

ReF-LDM: A Latent Diffusion Model for Reference-based Face Image Restoration

Chi-Wei Hsiao, Yu-Lun Liu, Cheng-Kun Yang, Sheng-Po Kuo, Kevin Jou, Chia-Ping Chen

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments NeurIPS 2024, project page https://chiweihsiao.github.io/refldm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04828 2024-12-09 cs.CV 79%

DAug: Diffusion-based Channel Augmentation for Radiology Image Retrieval and Classification

Ying Jin, Zhuoran Zhou, Haoquan Fang, Jenq-Neng Hwang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03629 2024-12-09 eess.IV cs.CV q-bio.QM 79%

DiffuPT: Class Imbalance Mitigation for Glaucoma Detection via Diffusion Based Generation and Model Pretraining

Youssof Nawar, Nouran Soliman, Moustafa Wassel, Mohamed ElHabebe, Noha Adly, Marwan Torki, Ahmed Elmassry, Islam Ahmed

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02030 2024-12-09 cs.CV 79%

NitroFusion: High-Fidelity Single-Step Diffusion through Dynamic Adversarial Training

Dar-Yen Chen, Hmrishav Bandyopadhyay, Kai Zou, Yi-Zhe Song

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14353 2024-12-09 eess.IV cs.CV cs.LG 79%

Enhancing Medical Image Segmentation with Deep Learning and Diffusion Models

Houze Liu, Tong Zhou, Yanlin Xiang, Aoran Shen, Jiacheng Hu, Junliang Du

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments After a peer review process for a journal submission, we have been told the main conclusions presented in this paper have been proven previously by others. I believe the paper should be withdrawn

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04462 2024-12-06 cs.CV 79%

4Real-Video: Learning Generalizable Photo-Realistic 4D Video Diffusion

Chaoyang Wang, Peiye Zhuang, Tuan Duc Ngo, Willi Menapace, Aliaksandr Siarohin, Michael Vasilkovsky, Ivan Skorokhodov, Sergey Tulyakov, Peter Wonka, Hsin-Ying Lee

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://snap-research.github.io/4Real-Video/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04448 2024-12-06 cs.CV 79%

MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation

Longtao Zheng, Yifan Zhang, Hanzhong Guo, Jiachun Pan, Zhenxiong Tan, Jiahao Lu, Chuanxin Tang, Bo An, Shuicheng Yan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project Page: https://memoavatar.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04432 2024-12-06 cs.CV 79%

Divot: Diffusion Powers Video Tokenizer for Comprehension and Generation

Yuying Ge, Yizhuo Li, Yixiao Ge, Ying Shan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project released at: https://github.com/TencentARC/Divot

详情

展开后加载摘要…

URL PDF HTML 收藏