arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4233 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4233 篇

2310.09285 2023-10-16 cs.CV 57%

SAIR: Learning Semantic-aware Implicit Representation

Canyu Zhang, Xiaoguang Li, Qing Guo, Song Wang

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.11932 2023-10-06 cs.CV 57%

RIC: Rotate-Inpaint-Complete for Generalizable Scene Reconstruction

Isaac Kasahara, Shubham Agrawal, Selim Engin, Nikhil Chavan-Dafle, Shuran Song, Volkan Isler

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10503 2023-10-02 cs.CV 57%

OR-NeRF: Object Removing from 3D Scenes Guided by Multiview Segmentation with Neural Radiance Fields

Youtan Yin, Zhoujie Fu, Fan Yang, Guosheng Lin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments project site: https://ornerf.github.io/ (codes available)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18135 2023-09-29 cs.CV 57%

Alignment-free HDR Deghosting with Semantics Consistent Transformer

Steven Tel, Zongwei Wu, Yulun Zhang, Barthélémy Heyrman, Cédric Demonceaux, Radu Timofte, Dominique Ginhac

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted to ICCV 2023. Version 2: Corrections are made to the conference proceedings to address issues with the production of our benchmark input. We have now updated Table 3 and Figure 6 to reflect these changes

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.13563 2023-09-28 cs.CV cs.AI 57%

Noise-aware Learning from Web-crawled Image-Text Data for Image Captioning

Wooyoung Kang, Jonghwan Mun, Sungjun Lee, Byungseok Roh

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.11684 2023-09-27 cs.CV 57%

Scene-aware Egocentric 3D Human Pose Estimation

Jian Wang, Lingjie Liu, Weipeng Xu, Kripasindhu Sarkar, Diogo Luvizon, Christian Theobalt

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11667 2023-09-22 cs.CV 57%

Understanding Pose and Appearance Disentanglement in 3D Human Pose Estimation

Krishna Kanth Nakka, Mathieu Salzmann

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09294 2023-09-19 cs.CV 57%

LivelySpeaker: Towards Semantic-Aware Co-Speech Gesture Generation

Yihao Zhi, Xiaodong Cun, Xuelin Chen, Xi Shen, Wen Guo, Shaoli Huang, Shenghua Gao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06024 2023-09-19 cs.CV cs.AI 57%

Probabilistic Human Mesh Recovery in 3D Scenes from Egocentric Views

Siwei Zhang, Qianli Ma, Yan Zhang, Sadegh Aliakbarian, Darren Cosker, Siyu Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Camera ready version for ICCV 2023, appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06714 2023-09-14 cs.CV 57%

MPI-Flow: Learning Realistic Optical Flow with Multiplane Images

Yingping Liang, Jiaming Liu, Debing Zhang, Ying Fu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to ICCV2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05095 2023-09-12 cs.CV 57%

MaskRenderer: 3D-Infused Multi-Mask Realistic Face Reenactment

Tina Behrouzi, Atefeh Shahroudnejad, Payam Mousavi

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04814 2023-09-12 cs.CV 57%

Speech2Lip: High-fidelity Speech to Lip Generation by Learning from a Short Video

Xiuzhe Wu, Pengfei Hu, Yang Wu, Xiaoyang Lyu, Yan-Pei Cao, Ying Shan, Wenming Yang, Zhongqian Sun, Xiaojuan Qi

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04147 2023-09-11 cs.CV 57%

Robot Localization and Mapping Final Report -- Sequential Adversarial Learning for Self-Supervised Deep Visual Odometry

Akankshya Kar, Sajal Maheshwari, Shamit Lal, Vinay Sameer Raja Kad

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.01381 2023-09-06 cs.CV 57%

LatentSwap3D: Semantic Edits on 3D Image GANs

Enis Simsar, Alessio Tonioni, Evin Pınar Örnek, Federico Tombari

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments The paper has been accepted by ICCV'23 AI3DCC

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16758 2023-09-01 cs.CV 57%

Towards High-Fidelity Text-Guided 3D Face Generation and Manipulation Using only Images

Cuican Yu, Guansong Lu, Yihan Zeng, Jian Sun, Xiaodan Liang, Huibin Li, Zongben Xu, Songcen Xu, Wei Zhang, Hang Xu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments accepted by ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15142 2023-08-30 cs.CV cs.AI q-bio.NC 57%

A Multimodal Visual Encoding Model Aided by Introducing Verbal Semantic Information

Shuxiao Ma, Linyuan Wang, Bin Yan

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14191 2023-08-29 cs.CV 57%

SketchDreamer: Interactive Text-Augmented Creative Sketch Ideation

Zhiyu Qu, Tao Xiang, Yi-Zhe Song

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments BMVC 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13042 2023-08-28 cs.CV cs.HC 57%

Enhancing Perception and Immersion in Pre-Captured Environments through Learning-Based Eye Height Adaptation

Qi Feng, Hubert P. H. Shum, Shigeo Morishima

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments 10 pages, 13 figures, 3 tables, submitted to ISMAR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12965 2023-08-25 cs.CV 57%

POCO: 3D Pose and Shape Estimation with Confidence

Sai Kumar Dwivedi, Cordelia Schmid, Hongwei Yi, Michael J. Black, Dimitrios Tzionas

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10705 2023-08-22 cs.CV cs.AI 57%

Unsupervised 3D Pose Estimation with Non-Rigid Structure-from-Motion Modeling

Haorui Ji, Hui Deng, Yuchao Dai, Hongdong Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10648 2023-08-22 cs.CV cs.AI 57%

EVE: Efficient zero-shot text-based Video Editing with Depth Map Guidance and Temporal Consistency Constraints

Yutao Chen, Xingning Dong, Tian Gan, Chunluan Zhou, Ming Yang, Qingpei Guo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10257 2023-08-22 cs.CV 57%

Make-It-4D: Synthesizing a Consistent Long-Term Dynamic Scene Video from a Single Image

Liao Shen, Xingyi Li, Huiqiang Sun, Juewen Peng, Ke Xian, Zhiguo Cao, Guosheng Lin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments accepted by ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09910 2023-08-22 cs.CV 57%

Physics-Guided Human Motion Capture with Pose Probability Modeling

Jingyi Ju, Buzhen Huang, Chen Zhu, Zhihao Li, Yangang Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments accepted by IJCAI2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09894 2023-08-22 cs.CV 57%

Semantic-Human: Neural Rendering of Humans from Monocular Video with Human Parsing

Jie Zhang, Pengcheng Shi, Zaiwang Gu, Yiyang Zhou, Zhi Wang

专题命中 可控生成 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.17606 2023-08-22 cs.CV 57%

AvatarCraft: Transforming Text into Neural Human Avatars with Parameterized Shape and Pose Control

Ruixiang Jiang, Can Wang, Jingbo Zhang, Menglei Chai, Mingming He, Dongdong Chen, Jing Liao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICCV 2023 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08089 2023-08-17 cs.CV 57%

DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory

Shengming Yin, Chenfei Wu, Jian Liang, Jie Shi, Houqiang Li, Gong Ming, Nan Duan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.13087 2023-08-16 cs.CV 57%

DCL: Differential Contrastive Learning for Geometry-Aware Depth Synthesis

Yuefan Shen, Yanchao Yang, Youyi Zheng, C. Karen Liu, Leonidas Guibas

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments Accepted by International Conference on Robotics and Automation (ICRA) 2022 and RA-L 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03610 2023-08-08 cs.CV 57%

AvatarVerse: High-quality & Stable 3D Avatar Creation from Text and Pose

Huichao Zhang, Bowen Chen, Hao Yang, Liao Qu, Xu Wang, Li Chen, Chao Long, Feida Zhu, Kang Du, Min Zheng

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14748 2023-07-28 cs.CV cs.LG eess.IV 57%

Semantic Image Completion and Enhancement using GANs

Priyansh Saxena, Raahat Gupta, Akshat Maheshwari, Saumil Maheshwari

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments This work is part of 'High-Performance Vision Intelligence'; Part of the Studies in Computational Intelligence book series (SCI, volume 913) and can be accessed at: https://link.springer.com/chapter/10.1007/978-981-15-6844-2_11. arXiv admin note: substantial text overlap with arXiv:1911.02222

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13908 2023-07-27 cs.CV 57%

Points-to-3D: Bridging the Gap between Sparse Points and Shape-Controllable Text-to-3D Generation

Chaohui Yu, Qiang Zhou, Jingliang Li, Zhe Zhang, Zhibin Wang, Fan Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏