arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4233 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4233 篇

2403.02561 2024-04-04 cs.CV 57%

Semantic Human Mesh Reconstruction with Textures

Xiaoyu Zhan, Jianxin Yang, Yuanqi Li, Jie Guo, Yanwen Guo, Wenping Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2024. Project page: https://zhanxy.xyz/projects/shert/

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.03408 2024-04-04 cs.CV cs.LG stat.ML 57%

A Generative Model for Texture Synthesis based on Optimal Transport between Feature Distributions

Antoine Houdard, Arthur Leclaire, Nicolas Papadakis, Julien Rabin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Journal ref Journal of Mathematical Imaging and Vision, Volume 65, pages 4-28, (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02125 2024-04-03 cs.CV 57%

3D Congealing: 3D-Aware Image Alignment in the Wild

Yunzhi Zhang, Zizhang Li, Amit Raj, Andreas Engelhardt, Yuanzhen Li, Tingbo Hou, Jiajun Wu, Varun Jampani

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments Project page: https://ai.stanford.edu/~yzzhang/projects/3d-congealing/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00658 2024-04-03 cs.CV 57%

KTPFormer: Kinematics and Trajectory Prior Knowledge-Enhanced Transformer for 3D Human Pose Estimation

Jihua Peng, Yanghong Zhou, P. Y. Mok

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2024,GitHub code:https://github.com/JihuaPeng/KTPFormer

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00274 2024-04-01 cs.CV cs.SD eess.AS 57%

CustomListener: Text-guided Responsive Interaction for User-friendly Listening Head Generation

Xi Liu, Ying Guo, Cheng Zhen, Tong Li, Yingying Ao, Pengfei Yan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17532 2024-03-28 cs.CV 57%

Weakly-Supervised Emotion Transition Learning for Diverse 3D Co-speech Gesture Generation

Xingqun Qi, Jiahao Pan, Peng Li, Ruibin Yuan, Xiaowei Chi, Mengfei Li, Wenhan Luo, Wei Xue, Shanghang Zhang, Qifeng Liu, Yike Guo

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17664 2024-03-27 cs.CV 57%

DiffFAE: Advancing High-fidelity One-shot Facial Appearance Editing with Space-sensitive Customization and Semantic Preservation

Qilin Wang, Jiangning Zhang, Chengming Xu, Weijian Cao, Ying Tai, Yue Han, Yanhao Ge, Hong Gu, Chengjie Wang, Yanwei Fu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17631 2024-03-27 cs.CV 57%

AniArtAvatar: Animatable 3D Art Avatar from a Single Image

Shaoxu Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03611 2024-03-27 cs.CV cs.AI cs.LG 57%

DreamComposer: Controllable 3D Object Generation via Multi-View Conditions

Yunhan Yang, Yukun Huang, Xiaoyang Wu, Yuan-Chen Guo, Song-Hai Zhang, Hengshuang Zhao, Tong He, Xihui Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://yhyang-myron.github.io/DreamComposer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16194 2024-03-26 cs.CV 57%

Pose-Guided Self-Training with Two-Stage Clustering for Unsupervised Landmark Discovery

Siddharth Tourani, Ahmed Alwheibi, Arif Mahmood, Muhammad Haris Khan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted in CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14003 2024-03-22 cs.CV cs.CL cs.LG 57%

Multi-Modal Hallucination Control by Visual Information Grounding

Alessandro Favero, Luca Zancato, Matthew Trager, Siddharth Choudhary, Pramuditha Perera, Alessandro Achille, Ashwin Swaminathan, Stefano Soatto

专题命中 可控生成 :generative vision(abstract);分类 cs.CV

Journal ref IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04302 2024-03-22 cs.CV cs.CL 57%

Prompt Highlighter: Interactive Control for Multi-Modal LLMs

Yuechen Zhang, Shengju Qian, Bohao Peng, Shu Liu, Jiaya Jia

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments CVPR 2024; Project Page: https://julianjuaner.github.io/projects/PromptHighlighter

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10261 2024-03-21 cs.CV 57%

Learning Spatiotemporal Inconsistency via Thumbnail Layout for Face Deepfake Detection

Yuting Xu, Jian Liang, Lijun Sheng, Xiao-Yu Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09570 2024-03-21 cs.CV 57%

CAGE: Controllable Articulation GEneration

Jiayi Liu, Hou In Ivan Tam, Ali Mahdavi-Amiri, Manolis Savva

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments CVPR 2024. Project page: https://3dlg-hcvc.github.io/cage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12037 2024-03-20 cs.CV 57%

MineDreamer: Learning to Follow Instructions via Chain-of-Imagination for Simulated-World Control

Enshen Zhou, Yiran Qin, Zhenfei Yin, Yuzhou Huang, Ruimao Zhang, Lu Sheng, Yu Qiao, Jing Shao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: https://sites.google.com/view/minedreamer/main

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18152 2024-03-19 eess.IV cs.AI cs.CV 57%

Boosting Neural Representations for Videos with a Conditional Decoder

Xinjie Zhang, Ren Yang, Dailan He, Xingtong Ge, Tongda Xu, Yan Wang, Hongwei Qin, Jun Zhang

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accept by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11784 2024-03-19 cs.CV 57%

Progressive3D: Progressively Local Editing for Text-to-3D Content Creation with Complex Semantic Prompts

Xinhua Cheng, Tianyu Yang, Jianan Wang, Yu Li, Lei Zhang, Jian Zhang, Li Yuan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accept by ICLR2024. Project Page: https://cxh0519.github.io/projects/Progressive3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10166 2024-03-18 cs.CV 57%

SemanticHuman-HD: High-Resolution Semantic Disentangled 3D Human Generation

Peng Zheng, Tao Liu, Zili Yi, Rui Ma

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments 26 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.07033 2024-03-18 cs.CV 57%

SelfPromer: Self-Prompt Dehazing Transformers with Depth-Consistency

Cong Wang, Jinshan Pan, Wanyu Lin, Jiangxin Dong, Xiao-Ming Wu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted by AAAI24. Source codes will be made available at: https://github.com/supersupercong/SelfPromer

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09407 2024-03-15 cs.SD cs.AI cs.LG cs.MM eess.AS 57%

LM2D: Lyrics- and Music-Driven Dance Synthesis

Wenjie Yin, Xuejiao Zhao, Yi Yu, Hang Yin, Danica Kragic, Mårten Björkman

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09093 2024-03-15 cs.CV 57%

Desigen: A Pipeline for Controllable Design Template Generation

Haohan Weng, Danqing Huang, Yu Qiao, Zheng Hu, Chin-Yew Lin, Tong Zhang, C. L. Philip Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments This paper has been accepted for publication in CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07518 2024-03-13 cs.CV 57%

Open-Vocabulary Scene Text Recognition via Pseudo-Image Labeling and Margin Loss

Xuhua Ren, Hengcan Shi, Jin Li

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18287 2024-02-29 cs.CV 57%

Windowed-FourierMixer: Enhancing Clutter-Free Room Modeling with Fourier Transform

Bruno Henriques, Benjamin Allaert, Jean-Philippe Vandeborre

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18092 2024-02-29 cs.CV 57%

Context-aware Talking Face Video Generation

Meidai Xuanyuan, Yuwang Wang, Honglei Guo, Qionghai Dai

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17292 2024-02-28 cs.CV 57%

DivAvatar: Diverse 3D Avatar Generation with a Single Prompt

Weijing Tao, Biwen Lei, Kunhao Liu, Shijian Lu, Miaomiao Cui, Xuansong Xie, Chunyan Miao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16936 2024-02-28 cs.CV cs.LG 57%

Disentangled 3D Scene Generation with Layout Learning

Dave Epstein, Ben Poole, Ben Mildenhall, Alexei A. Efros, Aleksander Holynski

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11141 2024-02-20 cs.CV 57%

Semantically-aware Neural Radiance Fields for Visual Scene Understanding: A Comprehensive Review

Thang-Anh-Quan Nguyen, Amine Bourki, Mátyás Macudzinski, Anthony Brunel, Mohammed Bennamoun

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05728 2024-02-09 cs.CV 57%

CTGAN: Semantic-guided Conditional Texture Generator for 3D Shapes

Yi-Ting Pan, Chai-Rong Lee, Shu-Ho Fan, Jheng-Wei Su, Jia-Bin Huang, Yung-Yu Chuang, Hung-Kuo Chu

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01566 2024-02-05 cs.CV cs.AI 57%

Boximator: Generating Rich and Controllable Motions for Video Synthesis

Jiawei Wang, Yuchen Zhang, Jiaxin Zou, Yan Zeng, Guoqiang Wei, Liping Yuan, Hang Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15977 2024-02-01 cs.CV 57%

Motion-I2V: Consistent and Controllable Image-to-Video Generation with Explicit Motion Modeling

Xiaoyu Shi, Zhaoyang Huang, Fu-Yun Wang, Weikang Bian, Dasong Li, Yi Zhang, Manyuan Zhang, Ka Chun Cheung, Simon See, Hongwei Qin, Jifeng Dai, Hongsheng Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: https://xiaoyushi97.github.io/Motion-I2V/

详情

展开后加载摘要…

URL PDF HTML 收藏