arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70082 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70082 篇

2412.14283 2025-01-31 cs.CV cs.AI cs.GR 81%

PixelMan: Consistent Object Editing with Diffusion Models via Pixel Manipulation and Generation

Liyao Jiang, Negar Hassanpour, Mohammad Salameh, Mohammadreza Samadi, Jiao He, Fengyu Sun, Di Niu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments AAAI 2025; version includes supplementary material; 27 Pages, 15 Figures, 6 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09756 2025-01-17 cs.CV cs.GR 81%

SynthLight: Portrait Relighting with Diffusion Model by Learning to Re-render Synthetic Faces

Sumit Chaturvedi, Mengwei Ren, Yannick Hold-Geoffroy, Jingyuan Liu, Julie Dorsey, Zhixin Shu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments 27 pages, 25 figures, Project Page https://vrroom.github.io/synthlight/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03847 2025-01-10 cs.CV cs.AI cs.GR 81%

Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control

Zekai Gu, Rui Yan, Jiahao Lu, Peng Li, Zhiyang Dou, Chenyang Si, Zhen Dong, Qifeng Liu, Cheng Lin, Ziwei Liu, Wenping Wang, Yuan Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project page: https://igl-hkust.github.io/das/ Codes: https://github.com/IGL-HKUST/DiffusionAsShader

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21042 2024-12-31 cs.CV cs.MM 81%

Visual Style Prompt Learning Using Diffusion Models for Blind Face Restoration

Wanglong Lu, Jikai Wang, Tao Wang, Kaihao Zhang, Xianta Jiang, Hanli Zhao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

Comments Published at Pattern Recognition; 13 pages, 11 figures

Journal ref Pattern Recognition, 2024, 111312, ISSN 0031-3203

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17827 2024-12-24 cs.CV cs.AI cs.GR cs.LG 81%

DiffH2O: Diffusion-Based Synthesis of Hand-Object Interactions from Textual Descriptions

Sammy Christen, Shreyas Hampali, Fadime Sener, Edoardo Remelli, Tomas Hodan, Eric Sauser, Shugao Ma, Bugra Tekin

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project Page: https://diffh2o.github.io/

Journal ref SIGGRAPH Asia Conference Papers, Article 145, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16670 2024-12-24 cs.CV cs.GR 81%

Two-in-One: Unified Multi-Person Interactive Motion Generation by Latent Diffusion Transformer

Boyuan Li, Xihua Wang, Ruihua Song, Wenbing Huang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15200 2024-12-20 cs.CV cs.AI cs.GR 81%

DI-PCG: Diffusion-based Efficient Inverse Procedural Content Generation for High-quality 3D Asset Creation

Wang Zhao, Yan-Pei Cao, Jiale Xu, Yuejiang Dong, Ying Shan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project page: https://thuzhaowang.github.io/projects/DI-PCG/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15156 2024-12-20 cs.CV cs.CL cs.MM 81%

Prompt-A-Video: Prompt Your Video Diffusion Model via Preference-Aligned LLM

Yatai Ji, Jiacheng Zhang, Jie Wu, Shilong Zhang, Shoufa Chen, Chongjian GE, Peize Sun, Weifeng Chen, Wenqi Shao, Xuefeng Xiao, Weilin Huang, Ping Luo

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11279 2024-12-17 cs.CV cs.AI cs.GR 81%

VividFace: A Diffusion-Based Hybrid Framework for High-Fidelity Video Face Swapping

Hao Shao, Shulun Wang, Yang Zhou, Guanglu Song, Dailan He, Shuo Qin, Zhuofan Zong, Bingqi Ma, Yu Liu, Hongsheng Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments project page: https://hao-shao.com/projects/vividface.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10958 2024-12-17 cs.MM cs.CR cs.CV eess.IV 81%

Towards Effective User Attribution for Latent Diffusion Models via Watermark-Informed Blending

Yongyang Pan, Xiaohong Liu, Siqi Luo, Yi Xin, Xiao Guo, Xiaoming Liu, Xiongkuo Min, Guangtao Zhai

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09648 2024-12-16 eess.IV cs.CV cs.GR cs.LG 81%

DSplats: 3D Generation by Denoising Splats-Based Multiview Diffusion Models

Kevin Miao, Harsh Agrawal, Qihang Zhang, Federico Semeraro, Marco Cavallo, Jiatao Gu, Alexander Toshev

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05691 2024-12-10 cs.CV cs.MM 81%

StableMoFusion: Towards Robust and Efficient Diffusion-based Motion Generation Framework

Yiheng Huang, Hui Yang, Chuanchen Luo, Yuxi Wang, Shibiao Xu, Zhaoxiang Zhang, Man Zhang, Junran Peng

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02256 2024-11-26 cs.CV cs.AI cs.GR 81%

EMDM: Efficient Motion Diffusion Model for Fast and High-Quality Motion Generation

Wenyang Zhou, Zhiyang Dou, Zeyu Cao, Zhouyingcheng Liao, Jingbo Wang, Wenjia Wang, Yuan Liu, Taku Komura, Wenping Wang, Lingjie Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments ECCV 2024. Project Page: https://frank-zy-dou.github.io/projects/EMDM/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15138 2024-11-25 cs.CV cs.GR 81%

Material Anything: Generating Materials for Any 3D Object via Diffusion

Xin Huang, Tengfei Wang, Ziwei Liu, Qing Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project page: https://xhuangcv.github.io/MaterialAnything/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09413 2024-11-25 cs.CV cs.GR cs.LG 81%

Interpreting the Weight Space of Customized Diffusion Models

Amil Dravid, Yossi Gandelsman, Kuan-Chieh Wang, Rameen Abdal, Gordon Wetzstein, Alexei A. Efros, Kfir Aberman

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project Page: https://snap-research.github.io/weights2weights

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11408 2024-11-18 cs.CV cs.GR 81%

MatFuse: Controllable Material Generation with Diffusion Models

Giuseppe Vecchio, Renato Sortino, Simone Palazzo, Concetto Spampinato

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20155 2024-11-15 cs.CV cs.GR 81%

MotionDreamer: Exploring Semantic Video Diffusion features for Zero-Shot 3D Mesh Animation

Lukas Uzolas, Elmar Eisemann, Petr Kellnhofer

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07520 2024-11-13 cs.CV cs.AI cs.GR 81%

Neural Gaffer: Relighting Any Object via Diffusion

Haian Jin, Yuan Li, Fujun Luan, Yuanbo Xiangli, Sai Bi, Kai Zhang, Zexiang Xu, Jin Sun, Noah Snavely

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project Website: https://neural-gaffer.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04928 2024-11-08 cs.CV cs.AI cs.GR 81%

DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion

Wenqiang Sun, Shuo Chen, Fangfu Liu, Zilong Chen, Yueqi Duan, Jun Zhang, Yikai Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project Page: https://chenshuo20.github.io/DimensionX/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00736 2024-11-06 cs.CV cs.AI cs.LG cs.MM 81%

Diffusion Models, Image Super-Resolution And Everything: A Survey

Brian B. Moser, Arundhati S. Shanbhag, Federico Raue, Stanislav Frolov, Sebastian Palacio, Andreas Dengel

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01212 2024-11-05 cs.CV cs.AI cs.GR cs.LG 81%

Infinite-Resolution Integral Noise Warping for Diffusion Models

Yitong Deng, Winnie Lin, Lingxiao Li, Dmitriy Smirnov, Ryan Burgert, Ning Yu, Vincent Dedun, Mohammad H. Taghavi

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20359 2024-11-04 cs.SD cs.AI cs.CV cs.GR eess.AS 81%

Conditional GAN for Enhancing Diffusion Models in Efficient and Authentic Global Gesture Generation from Audios

Yongkang Cheng, Mingjiang Liang, Shaoli Huang, Gaoge Han, Jifeng Ning, Wei Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Accepted by WACV 2025 (Round 1)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24203 2024-11-01 cs.CV cs.AI cs.GR cs.RO 81%

DiffPano: Scalable and Consistent Text to Panorama Generation with Spherical Epipolar-Aware Diffusion

Weicai Ye, Chenhao Ji, Zheng Chen, Junyao Gao, Xiaoshui Huang, Song-Hai Zhang, Wanli Ouyang, Tong He, Cairong Zhao, Guofeng Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments NeurIPS2024, Project: https://github.com/zju3dv/DiffPano; Code: https://github.com/zju3dv/DiffPano

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23663 2024-11-01 cs.CV cs.MM 81%

DIP: Diffusion Learning of Inconsistency Pattern for General DeepFake Detection

Fan Nie, Jiangqun Ni, Jian Zhang, Bin Zhang, Weizhe Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

Comments 13 pages, accepted with IEEE Trans. on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04237 2024-10-30 cs.CV cs.GR 81%

GSD: View-Guided Gaussian Splatting Diffusion for 3D Reconstruction

Yuxuan Mu, Xinxin Zuo, Chuan Guo, Yilin Wang, Juwei Lu, Xiaofeng Wu, Songcen Xu, Peng Dai, Youliang Yan, Li Cheng

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14508 2024-10-21 cs.CV cs.AI cs.GR 81%

LEAD: Latent Realignment for Human Motion Diffusion

Nefeli Andreou, Xi Wang, Victoria Fernández Abrevaya, Marie-Paule Cani, Yiorgos Chrysanthou, Vicky Kalogeiton

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13530 2024-10-18 cs.CV cs.GR 81%

L3DG: Latent 3D Gaussian Diffusion

Barbara Roessle, Norman Müller, Lorenzo Porzi, Samuel Rota Bulò, Peter Kontschieder, Angela Dai, Matthias Nießner

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments SIGGRAPH Asia 2024, project page: https://barbararoessle.github.io/l3dg , video: https://youtu.be/UHEEiXCYeLU

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10927 2024-10-16 cs.CV cs.AI cs.GR 81%

Cultural Heritage 3D Reconstruction with Diffusion Networks

Pablo Jaramillo, Ivan Sipiran

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Accepted by the workshop VISART for ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10696 2024-10-15 cs.CV cs.GR 81%

TALK-Act: Enhance Textural-Awareness for 2D Speaking Avatar Reenactment with Diffusion Model

Jiazhi Guan, Quanwei Yang, Kaisiyuan Wang, Hang Zhou, Shengyi He, Zhiliang Xu, Haocheng Feng, Errui Ding, Jingdong Wang, Hongtao Xie, Youjian Zhao, Ziwei Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Accepted to SIGGRAPH Asia 2024 (conference track). Project page: https://guanjz20.github.io/projects/TALK-Act

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08188 2024-10-11 cs.CV cs.AI cs.GR 81%

DifFRelight: Diffusion-Based Facial Performance Relighting

Mingming He, Pascal Clausen, Ahmet Levent Taşel, Li Ma, Oliver Pilarski, Wenqi Xian, Laszlo Rikker, Xueming Yu, Ryan Burgert, Ning Yu, Paul Debevec

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments 18 pages, SIGGRAPH Asia 2024 Conference Papers (SA Conference Papers '24), December 3--6, 2024, Tokyo, Japan. Project page: https://www.eyelinestudios.com/research/diffrelight.html

详情

展开后加载摘要…

URL PDF HTML 收藏