arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70082 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70082 篇

2312.03763 2023-12-22 cs.CV cs.GR cs.LG 81%

Gaussian3Diff: 3D Gaussian Diffusion for 3D Full Head Synthesis and Editing

Yushi Lan, Feitong Tan, Di Qiu, Qiangeng Xu, Kyle Genova, Zeng Huang, Sean Fanello, Rohit Pandey, Thomas Funkhouser, Chen Change Loy, Yinda Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments project webpage: https://nirvanalan.github.io/projects/gaussian3diff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12490 2023-12-21 cs.CV cs.AI cs.LG cs.MM 81%

InstructVideo: Instructing Video Diffusion Models with Human Feedback

Hangjie Yuan, Shiwei Zhang, Xiang Wang, Yujie Wei, Tao Feng, Yining Pan, Yingya Zhang, Ziwei Liu, Samuel Albanie, Dong Ni

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

Comments Project page: https://instructvideo.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.15413 2023-12-21 cs.CV cs.CL cs.GR cs.LG 81%

Debiasing Scores and Prompts of 2D Diffusion for View-consistent Text-to-3D Generation

Susung Hong, Donghoon Ahn, Seungryong Kim

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Accepted to NeurIPS 2023. Project Page: https://susunghong.github.io/Debiased-Score-Distillation-Sampling/

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.10682 2023-12-19 cs.CV cs.GR 81%

DiffStyler: Controllable Dual Diffusion for Text-Driven Image Stylization

Nisha Huang, Yuxin Zhang, Fan Tang, Chongyang Ma, Haibin Huang, Yong Zhang, Weiming Dong, Changsheng Xu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05668 2023-12-11 cs.CV cs.AI cs.GR 81%

RePaint-NeRF: NeRF Editting via Semantic Masks and Diffusion Models

Xingchen Zhou, Ying He, F. Richard Yu, Jianqiang Li, You Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments IJCAI 2023 Accepted (Main Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04145 2023-12-08 cs.CV cs.GR cs.LG 81%

Diffusing Colors: Image Colorization with Text Guided Diffusion

Nir Zabari, Aharon Azulay, Alexey Gorkor, Tavi Halperin, Ohad Fried

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments SIGGRAPH Asia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02984 2023-12-07 cs.LG cs.AI cs.CV cs.MM eess.SP 81%

Diff-GO: Diffusion Goal-Oriented Communications to Achieve Ultra-High Spectrum Efficiency

Achintha Wijesinghe, Songyang Zhang, Suchinthaka Wanninayaka, Weiwei Wang, Zhi Ding

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

Comments Submitted to IEEE International Conference on Communications (ICC) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01305 2023-12-05 cs.CV cs.AI cs.GR 81%

ViVid-1-to-3: Novel View Synthesis with Video Diffusion Models

Jeong-gi Kwak, Erqun Dong, Yuhe Jin, Hanseok Ko, Shweta Mahajan, Kwang Moo Yi

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project page: https://jgkwak95.github.io/ViVid-1-to-3/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00870 2023-12-05 cs.CV cs.AI cs.GR cs.LG 81%

3DiFACE: Diffusion-based Speech-driven 3D Facial Animation and Editing

Balamurugan Thambiraja, Sadegh Aliakbarian, Darren Cosker, Justus Thies

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project page: https://balamuruganthambiraja.github.io/3DiFACE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18837 2023-12-01 cs.CV cs.AI cs.LG cs.MM 81%

VIDiff: Translating Videos via Multi-Modal Instructions with Diffusion Models

Zhen Xing, Qi Dai, Zihao Zhang, Hui Zhang, Han Hu, Zuxuan Wu, Yu-Gang Jiang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16498 2023-11-29 cs.CV cs.GR 81%

MagicAnimate: Temporally Consistent Human Image Animation using Diffusion Model

Zhongcong Xu, Jianfeng Zhang, Jun Hao Liew, Hanshu Yan, Jia-Wei Liu, Chenxu Zhang, Jiashi Feng, Mike Zheng Shou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Project Page at https://showlab.github.io/magicanimate

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11123 2023-11-10 cs.MM cs.CV eess.IV 81%

Hey That's Mine Imperceptible Watermarks are Preserved in Diffusion Generated Outputs

Luke Ditria, Tom Drummond

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15110 2023-10-24 cs.CV cs.GR 81%

Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model

Ruoxi Shi, Hansheng Chen, Zhuoyang Zhang, Minghua Liu, Chao Xu, Xinyue Wei, Linghao Chen, Chong Zeng, Hao Su

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.14613 2023-10-17 cs.CV cs.GR 81%

GestureDiffuCLIP: Gesture Diffusion Model with CLIP Latents

Tenglong Ao, Zeyi Zhang, Libin Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments SIGGRAPH 2023 (Journal Track); Project Page: https://pku-mocca.github.io/GestureDiffuCLIP-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07204 2023-10-16 cs.AI cs.CV cs.GR cs.LG 81%

State of the Art on Diffusion Models for Visual Computing

Ryan Po, Wang Yifan, Vladislav Golyanik, Kfir Aberman, Jonathan T. Barron, Amit H. Bermano, Eric Ryan Chan, Tali Dekel, Aleksander Holynski, Angjoo Kanazawa, C. Karen Liu, Lingjie Liu, Ben Mildenhall, Matthias Nießner, Björn Ommer, Christian Theobalt, Peter Wonka, Gordon Wetzstein

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05934 2023-10-11 cs.CV cs.AI cs.MM eess.IV 81%

DF-3DFace: One-to-Many Speech Synchronized 3D Face Animation with Diffusion

Se Jin Park, Joanna Hong, Minsu Kim, Yong Man Ro

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00362 2023-10-03 cs.CV cs.GR 81%

Diffusion Posterior Illumination for Ambiguity-aware Inverse Rendering

Linjie Lyu, Ayush Tewari, Marc Habermann, Shunsuke Saito, Michael Zollhöfer, Thomas Leimkühler, Christian Theobalt

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments SIGGRAPH Asia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14759 2023-09-27 cs.GR cs.CV 81%

Diffusion-based Holistic Texture Rectification and Synthesis

Guoqing Hao, Satoshi Iizuka, Kensho Hara, Edgar Simo-Serra, Hirokatsu Kataoka, Kazuhiro Fukui

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments SIGGRAPH Asia 2023 Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11306 2023-09-21 cs.CV cs.AI cs.GR 81%

FaceDiffuser: Speech-Driven 3D Facial Animation Synthesis Using Diffusion

Stefan Stan, Kazi Injamamul Haque, Zerrin Yumak

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Pre-print of the paper accepted at ACM SIGGRAPH MIG 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06526 2023-09-15 cs.CV cs.GR 81%

AvatarFusion: Zero-shot Generation of Clothing-Decoupled 3D Avatars Using 2D Diffusion

Shuo Huang, Zongxin Yang, Liangting Li, Yi Yang, Jia Jia

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04509 2023-09-12 cs.SD cs.CV cs.GR eess.AS 81%

The Power of Sound (TPoS): Audio Reactive Video Generation with Stable Diffusion

Yujin Jeong, Wonjeong Ryoo, Seunghyun Lee, Dabin Seo, Wonmin Byeon, Sangpil Kim, Jinkyu Kim

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments ICCV2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16905 2023-09-01 cs.CV cs.AI cs.GR 81%

InterDiff: Generating 3D Human-Object Interactions with Physics-Informed Diffusion

Sirui Xu, Zhengyuan Li, Yu-Xiong Wang, Liang-Yan Gui

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments ICCV 2023; Project Page: https://sirui-xu.github.io/InterDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.01418 2023-08-31 cs.CV cs.GR 81%

Human Motion Diffusion as a Generative Prior

Yonatan Shafir, Guy Tevet, Roy Kapon, Amit H. Bermano

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10490 2023-08-22 cs.CV cs.AI cs.GR 81%

Texture Generation on 3D Meshes with Point-UV Diffusion

Xin Yu, Peng Dai, Wenbo Li, Lan Ma, Zhengzhe Liu, Xiaojuan Qi

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Accepted to ICCV 2023, Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.02500 2023-08-22 cs.CV cs.AI cs.GR cs.LG 81%

PhysDiff: Physics-Guided Human Motion Diffusion Model

Ye Yuan, Jiaming Song, Umar Iqbal, Arash Vahdat, Jan Kautz

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments ICCV 2023 (Oral). Project page: https://nvlabs.github.io/PhysDiff

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02915 2023-08-08 cs.GR cs.CV cs.SD eess.AS 81%

DiffDance: Cascaded Human Motion Diffusion Model for Dance Generation

Qiaosong Qi, Le Zhuo, Aixi Zhang, Yue Liao, Fei Fang, Si Liu, Shuicheng Yan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Accepted at ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13501 2023-08-04 cs.CV cs.AI cs.MM 81%

LaDI-VTON: Latent Diffusion Textual-Inversion Enhanced Virtual Try-On

Davide Morelli, Alberto Baldrati, Giuseppe Cartella, Marcella Cornia, Marco Bertini, Rita Cucchiara

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

Comments ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.14863 2023-07-17 cs.CV cs.AI cs.LG cs.MM 81%

DiffTAD: Temporal Action Detection with Proposal Denoising Diffusion

Sauradip Nag, Xiatian Zhu, Jiankang Deng, Yi-Zhe Song, Tao Xiang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

Comments ICCV 2023; Code available at https://github.com/sauradip/DiffusionTAD

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.12790 2023-06-23 cs.MM cs.CV eess.IV 81%

DiffWA: Diffusion Models for Watermark Attack

Xinyu Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05905 2023-06-14 cs.CV cs.AI cs.GR 81%

Single Motion Diffusion

Sigal Raab, Inbal Leibovitch, Guy Tevet, Moab Arar, Amit H. Bermano, Daniel Cohen-Or

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Video: https://www.youtube.com/watch?v=zuWpVTgb_0U, Project page: https://sinmdm.github.io/SinMDM-page, Code: https://github.com/SinMDM/SinMDM

详情

展开后加载摘要…

URL PDF HTML 收藏