arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2504.04010 2025-04-08 cs.CV cs.LG 79%

DiTaiListener: Controllable High Fidelity Listener Video Generation with Diffusion

Maksim Siniukov, Di Chang, Minh Tran, Hongkun Gong, Ashutosh Chaubey, Mohammad Soleymani

机构 * University of Southern California(南加州大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://havent-invented.github.io/DiTaiListener

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03738 2025-04-08 cs.LG cs.AI cs.CV 79%

Attention in Diffusion Model: A Survey

Litao Hua, Fan Liu, Jie Su, Xingyu Miao, Zizhou Ouyang, Zeyu Wang, Runze Hu, Zhenyu Wen, Bing Zhai, Yang Long, Haoran Duan, Yuan Zhou

机构 * School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院) Tsinghua University(清华大学) Institute of Cyberspace Security and College of Information Engineering, Zhejiang University of Technology(浙江工业大学网络空间安全研究院与信息工程学院) University of Edinburgh(爱丁堡大学) Beijing Institute of Technology(北京理工大学) College of Computer Science and Engineering, Dalian Minzu University(大连民族大学计算机科学与工程学院) Durham University(杜伦大学) Northumbria University(诺森比亚大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02542 2025-04-08 cs.CV 79%

Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation

Fa-Ting Hong, Zunnan Xu, Zixiang Zhou, Jun Zhou, Xiu Li, Qin Lin, Qinglin Lu, Dan Xu

机构 * HKUST(香港科技大学) Tencent(腾讯) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16859 2025-04-08 cs.CV cs.AI 79%

Adversarially Domain-adaptive Latent Diffusion for Unsupervised Semantic Segmentation

Jongmin Yu, Zhongtian Sun, Chen Bene Chi, Jinhong Yang, Shan Luo

机构 * University of Cambridge(剑桥大学) University of Kent(肯特大学) Tsinghua University(清华大学) Inje University(仁济大学) King’s College London(伦敦国王学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted from CVPR 2025 Workshop PVUW

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06016 2025-04-08 cs.CV cs.AI cs.LG 79%

Track4Gen: Teaching Video Diffusion Models to Track Points Improves Video Generation

Hyeonho Jeong, Chun-Hao Paul Huang, Jong Chul Ye, Niloy Mitra, Duygu Ceylan

机构 * Adobe Research(奥多比研究院) KAIST(韩国科学技术院) University College London(伦敦大学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025, Project page: hyeonho99.github.io/track4gen

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09911 2025-04-08 cs.CV 79%

DiffFNO: Diffusion Fourier Neural Operator

Xiaoyi Liu, Hao Tang

机构 * Washington University in St. Louis(圣路易斯华盛顿大学) Peking University(北京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01876 2025-04-08 cs.CV cs.AI 79%

CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention

Gaojie Lin, Jianwen Jiang, Chao Liang, Tianyun Zhong, Jiaqi Yang, Yanbo Zheng

机构 * ByteDance(字节跳动) Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025 (Oral), Homepage: https://cyberhost.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16182 2025-04-08 cs.CV 79%

No Re-Train, More Gain: Upgrading Backbones with Diffusion model for Pixel-Wise and Weakly-Supervised Few-Shot Segmentation

Shuai Chen, Fanman Meng, Chenhao Wu, Haoran Wei, Runtong Zhang, Qingbo Wu, Linfeng Xu, Hongliang Li

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14309 2025-04-08 cs.CV 79%

Towards Understanding the Robustness of Diffusion-Based Purification: A Stochastic Perspective

Yiming Liu, Kezhao Liu, Yao Xiao, Ziyi Dong, Xiaogang Xu, Pengxu Wei, Liang Lin

机构 * Sun Yat-Sen University(中山大学) Chinese University of Hong Kong(香港中文大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03607 2025-04-07 cs.CV 79%

Multimodal Diffusion Bridge with Attention-Based SAR Fusion for Satellite Image Cloud Removal

Yuyang Hu, Suhas Lohit, Ulugbek S. Kamilov, Tim K. Marks

机构 * Washington University in St. Louis(圣路易斯华盛顿大学) Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03490 2025-04-07 cs.CV cs.AI 79%

BUFF: Bayesian Uncertainty Guided Diffusion Probabilistic Model for Single Image Super-Resolution

Zihao He, Shengchuan Zhang, Runze Hu, Yunhang Shen, Yan Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 9 pages, 5 figures, AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03072 2025-04-07 cs.CV cs.LG 79%

How I Warped Your Noise: a Temporally-Correlated Noise Prior for Diffusion Models

Pascal Chang, Jingwei Tang, Markus Gross, Vinicius C. Azevedo

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at ICLR 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03006 2025-04-07 cs.CV 79%

DiSRT-In-Bed: Diffusion-Based Sim-to-Real Transfer Framework for In-Bed Human Mesh Recovery

Jing Gao, Ce Zheng, Laszlo A. Jeni, Zackory Erickson

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 16 pages, 19 figures. Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06978 2025-04-07 cs.CV 79%

Edge-SD-SR: Low Latency and Parameter Efficient On-device Super-Resolution with Stable Diffusion via Bidirectional Conditioning

Mehdi Noroozi, Isma Hadji, Victor Escorcia, Anestis Zaganidis, Brais Martinez, Georgios Tzimiropoulos

机构 * Samsung AI Center, Cambridge(三星人工智能中心(剑桥)) Queen Mary University of London(伦敦大学玛丽皇后学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.20042 2025-04-07 physics.med-ph cs.CV 79%

HAITCH: A Framework for Distortion and Motion Correction in Fetal Multi-Shell Diffusion-Weighted MRI

Haykel Snoussi, Davood Karimi, Onur Afacan, Mustafa Utkur, Ali Gholipour

机构 * Boston Children’s Hospital(波士顿儿童医院) Harvard Medical School(哈佛医学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08870 2025-04-07 cs.CV cs.LG 79%

One-Shot Heterogeneous Federated Learning with Local Model-Guided Diffusion Models

Mingzhao Yang, Shangchao Su, Bin Li, Xiangyang Xue

机构 * Fudan University(复旦大学) School of Computer Science, Fudan University(复旦大学计算机科学学院) Shanghai Key Laboratory of Intelligent Information Processing(上海市智能信息处理重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02764 2025-04-04 cs.CV cs.AI 79%

Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model

Shengjun Zhang, Jinzhao Li, Xin Fei, Hao Liu, Yueqi Duan

机构 * Tsinghua University(清华大学) WeChat Vision, Tecent Inc.(腾讯微信视觉)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01956 2025-04-04 cs.CV 79%

VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step

Hanyang Wang, Fangfu Liu, Jiawei Chi, Yueqi Duan

机构 * Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025; Project Page: https://hanyang-21.github.io/VideoScene

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01358 2025-04-04 math.OC cs.CV cs.NA math.NA 79%

Diffusion at Absolute Zero: Langevin Sampling Using Successive Moreau Envelopes [conference paper]

Andreas Habring, Alexander Falk, Thomas Pock

机构 * Institute of Visual Computing(视觉计算研究所) Graz University of Technology(格拉茨工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02180 2025-04-04 cs.CV 79%

Foreground Focus: Enhancing Coherence and Fidelity in Camouflaged Image Generation

Pei-Chi Chen, Yi Yao, Chan-Feng Hsu, HongXia Xie, Hung-Jen Chen, Hong-Han Shuai, Wen-Huang Cheng

专题命中 扩散模型 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00457 2025-04-04 cs.CV cs.AI 79%

Distilling Multi-view Diffusion Models into 3D Generators

Hao Qin, Luyuan Chen, Ming Kong, Mengxu Lu, Qiang Zhu

机构 * School of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Computer, Beijing Information Science and Technology University(北京信息科技大学计算机学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03862 2025-04-04 cs.CV cs.AI cs.CR 79%

ROBIN: Robust and Invisible Watermarks for Diffusion Models with Adversarial Optimization

Huayang Huang, Yu Wu, Qian Wang

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Cyber Science and Engineering, Wuhan University(武汉大学网络安全学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accept to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16176 2025-04-04 cs.LG cs.AI cs.CV 79%

Mitigating Shortcut Learning with Diffusion Counterfactuals and Diverse Ensembles

Luca Scimeca, Alexander Rubinstein, Damien Teney, Seong Joon Oh, Yoshua Bengio

机构 * Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Eberhard-Karls-Universität Tübingen(埃伯哈德卡尔斯蒂宾根大学) Idiap Research Institute(伊迪亚普研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted as a workshop paper at ICLR 2025. arXiv admin note: substantial text overlap with arXiv:2310.02230

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01960 2025-04-03 cs.CV cs.LG 79%

Diffusion-Guided Gaussian Splatting for Large-Scale Unconstrained 3D Reconstruction and Novel View Synthesis

Niluthpol Chowdhury Mithun, Tuan Pham, Qiao Wang, Ben Southall, Kshitij Minhas, Bogdan Matei, Stephan Mandt, Supun Samarasekera, Rakesh Kumar

机构 * SRI International(SRI国际) University of California, Irvine(加州大学欧文分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments WACV ULTRRA Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01521 2025-04-03 cs.LG cs.AI cs.CV 79%

Domain Guidance: A Simple Transfer Approach for a Pre-trained Diffusion Model

Jincheng Zhong, Xiangcheng Zhang, Jianmin Wang, Mingsheng Long

机构 * BNRist(北京信息科学与技术国家研究中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18583 2025-04-03 cs.CV 79%

Adapting Video Diffusion Models for Time-Lapse Microscopy

Alexander Holmberg, Nils Mechtel, Wei Ouyang

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院) Science for Life Laboratory(生命科学实验室) Department of Applied Physics(应用物理系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14489 2025-04-03 cs.CV 79%

Stable Virtual Camera: Generative View Synthesis with Diffusion Models

Jensen Zhou, Hang Gao, Vikram Voleti, Aaryaman Vasishta, Chun-Han Yao, Mark Boss, Philip Torr, Christian Rupprecht, Varun Jampani

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01845 2025-04-03 cs.CV 79%

Denoising Functional Maps: Diffusion Models for Shape Correspondence

Aleksei Zhuravlev, Zorah Lähner, Vladislav Golyanik

机构 * University of Bonn(波恩大学) Lamarr Institute(拉马尔研究所) MPI for Informatics(马克斯·普朗克信息学研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025; Project page: https://alekseizhuravlev.github.io/denoising-functional-maps/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15273 2025-04-03 cs.CV 79%

MaterialFusion: Enhancing Inverse Rendering with Material Diffusion Priors

Yehonathan Litman, Or Patashnik, Kangle Deng, Aviral Agrawal, Rushikesh Zawar, Fernando De la Torre, Shubham Tulsiani

机构 * Carnegie Mellon University(卡内基梅隆大学) Tel Aviv University(特拉维夫大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 3DV 2025. Project Page, Data, & Code: https://yehonathanlitman.github.io/material_fusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06633 2025-04-03 cs.CV 79%

SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation

Teng Hu, Jiangning Zhang, Ran Yi, Hongrui Huang, Yabiao Wang, Lizhuang Ma

机构 * Shanghai Jiao Tong University(上海交通大学) Youtu Lab, Tencent(腾讯优图实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏