arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4236 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4236 篇

2307.14748 2023-07-28 cs.CV cs.LG eess.IV 57%

Semantic Image Completion and Enhancement using GANs

Priyansh Saxena, Raahat Gupta, Akshat Maheshwari, Saumil Maheshwari

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments This work is part of 'High-Performance Vision Intelligence'; Part of the Studies in Computational Intelligence book series (SCI, volume 913) and can be accessed at: https://link.springer.com/chapter/10.1007/978-981-15-6844-2_11. arXiv admin note: substantial text overlap with arXiv:1911.02222

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13908 2023-07-27 cs.CV 57%

Points-to-3D: Bridging the Gap between Sparse Points and Shape-Controllable Text-to-3D Generation

Chaohui Yu, Qiang Zhou, Jingliang Li, Zhe Zhang, Zhibin Wang, Fan Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13240 2023-07-26 cs.CV 57%

Fashion Matrix: Editing Photos by Just Talking

Zheng Chong, Xujie Zhang, Fuwei Zhao, Zhenyu Xie, Xiaodan Liang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 13 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.15932 2023-07-19 cs.CV 57%

Unify, Align and Refine: Multi-Level Semantic Alignment for Radiology Report Generation

Yaowei Li, Bang Yang, Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yuexian Zou

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

Comments 1)Reassessment of author contributions. 2)Try to solve the problem that Google Scholar does not display the all authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09532 2023-07-11 cs.RO cs.GR 57%

Hierarchical Planning and Control for Box Loco-Manipulation

Zhaoming Xie, Jonathan Tseng, Sebastian Starke, Michiel van de Panne, C. Karen Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01944 2023-07-06 cs.LG cs.CV cs.IT math.IT 57%

Text + Sketch: Image Compression at Ultra Low Rates

Eric Lei, Yiğit Berkay Uslu, Hamed Hassani, Shirin Saeedi Bidokhti

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

Comments ICML 2023 Neural Compression Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.04106 2023-07-06 eess.IV cs.CV 57%

MedGen3D: A Deep Generative Framework for Paired 3D Image and Mask Generation

Kun Han, Yifeng Xiong, Chenyu You, Pooya Khosravi, Shanlin Sun, Xiangyi Yan, James Duncan, Xiaohui Xie

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by MICCAI 2023. Project Page: https://krishan999.github.io/MedGen3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10764 2023-06-21 cs.CV 57%

OpenShape: Scaling Up 3D Shape Representation Towards Open-World Understanding

Minghua Liu, Ruoxi Shi, Kaiming Kuang, Yinhao Zhu, Xuanlin Li, Shizhong Han, Hong Cai, Fatih Porikli, Hao Su

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Project Website: https://colin97.github.io/OpenShape/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09864 2023-06-19 cs.CV 57%

AvatarBooth: High-Quality and Customizable 3D Human Avatar Generation

Yifei Zeng, Yuanxun Lu, Xinya Ji, Yao Yao, Hao Zhu, Xun Cao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project website at https://zeng-yifei.github.io/avatarbooth_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09274 2023-06-16 cs.CV eess.IV 57%

Conditional Human Sketch Synthesis with Explicit Abstraction Control

Dar-Yen Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Code is available at https://github.com/ChenDarYen/Conditional-Human-Sketch-Synthesis-with-Explicit-Abstraction-Control

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04619 2023-06-08 cs.CV 57%

ARTIC3D: Learning Robust Articulated 3D Shapes from Noisy Web Image Collections

Chun-Han Yao, Amit Raj, Wei-Chih Hung, Yuanzhen Li, Michael Rubinstein, Ming-Hsuan Yang, Varun Jampani

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: https://chhankyao.github.io/artic3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02018 2023-06-07 cs.CV 57%

VideoComposer: Compositional Video Synthesis with Motion Controllability

Xiang Wang, Hangjie Yuan, Shiwei Zhang, Dayou Chen, Jiuniu Wang, Yingya Zhang, Yujun Shen, Deli Zhao, Jingren Zhou

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments The first four authors contributed equally. Project page: https://videocomposer.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01148 2023-06-05 cs.CV cs.LG 57%

Addressing Discrepancies in Semantic and Visual Alignment in Neural Networks

Natalie Abreu, Nathan Vaska, Victoria Helus

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19962 2023-06-01 cs.CV 57%

GANDiffFace: Controllable Generation of Synthetic Datasets for Face Recognition with Realistic Variations

Pietro Melzi, Christian Rathgeb, Ruben Tolosana, Ruben Vera-Rodriguez, Dominik Lawatsch, Florian Domin, Maxim Schaubert

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18769 2023-05-31 cs.CV cs.LG 57%

DualVAE: Controlling Colours of Generated and Real Images

Keerth Rathakumar, David Liebowitz, Christian Walder, Kristen Moore, Salil S. Kanhere

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13777 2023-05-31 cs.CV 57%

VisorGPT: Learning Visual Prior via Generative Pre-Training

Jinheng Xie, Kai Ye, Yudong Li, Yuexiang Li, Kevin Qinghong Lin, Yefeng Zheng, Linlin Shen, Mike Zheng Shou

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments Project web-page: https://sierkinhane.github.io/visor-gpt/

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11238 2023-05-26 cs.CV 57%

RobustLoc: Robust Camera Pose Regression in Challenging Driving Environments

Sijie Wang, Qiyu Kang, Rui She, Wee Peng Tay, Andreas Hartmannsgruber, Diego Navarro Navarro

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by AAAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03983 2023-05-24 cs.CV 57%

Multi-object Video Generation from Single Frame Layouts

Yang Wu, Zhibin Liu, Hefeng Wu, Liang Lin

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 6 pages limit

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09647 2023-05-17 cs.CV eess.IV 57%

Wavelet-based Unsupervised Label-to-Image Translation

George Eskandar, Mohamed Abdelsamad, Karim Armanious, Shuai Zhang, Bin Yang

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments arXiv admin note: substantial text overlap with arXiv:2109.14715

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.09915 2023-05-17 cs.CV 57%

DCN-T: Dual Context Network with Transformer for Hyperspectral Image Classification

Di Wang, Jing Zhang, Bo Du, Liangpei Zhang, Dacheng Tao

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted by IEEE TIP. The code will be released at https://github.com/DotWang/DCN-T

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09454 2023-05-17 cs.CV cs.LG 57%

Rethinking the editing of generative adversarial networks: a method to estimate editing vectors based on dimension reduction

Yuhan Cao, Haoran Jiang, Zhenghong Yu, Qi Li, Xuyang Li

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments 10 pages, 4 figures. arXiv admin note: substantial text overlap with arXiv:2111.03186 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.12971 2023-05-16 cs.CV cs.AI cs.HC 57%

BrainCLIP: Bridging Brain and Visual-Linguistic Representation Via CLIP for Generic Natural Visual Stimulus Decoding

Yulong Liu, Yongqiang Ma, Wei Zhou, Guibo Zhu, Nanning Zheng

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.03599 2023-05-08 eess.IV cs.CV 57%

GAN-Based Multi-View Video Coding with Spatio-Temporal EPI Reconstruction

Chengdong Lan, Hao Yan, Cheng Luo, Tiesong Zhao

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11595 2023-04-25 cs.CV cs.AI cs.LG 57%

Segment Anything in Non-Euclidean Domains: Challenges and Opportunities

Yongcheng Jing, Xinchao Wang, Dacheng Tao

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06870 2023-04-17 cs.CV 57%

AutoSplice: A Text-prompt Manipulated Image Dataset for Media Forensics

Shan Jia, Mingzhen Huang, Zhou Zhou, Yan Ju, Jialing Cai, Siwei Lyu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.16940 2023-04-11 cs.CV 57%

DiffPose: Toward More Reliable 3D Pose Estimation

Jia Gong, Lin Geng Foo, Zhipeng Fan, Qiuhong Ke, Hossein Rahmani, Jun Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.02760 2023-04-06 cs.CV 57%

Human-Art: A Versatile Human-Centric Dataset Bridging Natural and Artificial Scenes

Xuan Ju, Ailing Zeng, Jianan Wang, Qiang Xu, Lei Zhang

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments CVPR2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.17418 2023-04-04 cs.CV 57%

Semantic Image Translation for Repairing the Texture Defects of Building Models

Qisen Shang, Han Hu, Haojia Yu, Bo Xu, Libin Wang, Qing Zhu

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments 31 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.17123 2023-03-31 cs.CV 57%

Masked and Adaptive Transformer for Exemplar Based Image Translation

Chang Jiang, Fei Gao, Biao Ma, Yuhao Lin, Nannan Wang, Gang Xu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted by CVPR2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.14167 2023-03-29 cs.CV 57%

UrbanGIRAFFE: Representing Urban Scenes as Compositional Generative Neural Feature Fields

Yuanbo Yang, Yifei Yang, Hanlei Guo, Rong Xiong, Yue Wang, Yiyi Liao

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments Project page: https://lv3d.github.io/urbanGIRAFFE

详情

展开后加载摘要…

URL PDF HTML 收藏