arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4233 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4233 篇

2405.15758 2024-05-27 cs.CV cs.AI 57%

InstructAvatar: Text-Guided Emotion and Motion Control for Avatar Generation

Yuchi Wang, Junliang Guo, Jianhong Bai, Runyi Yu, Tianyu He, Xu Tan, Xu Sun, Jiang Bian

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: https://wangyuchi369.github.io/InstructAvatar/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13865 2024-05-24 cs.CV 57%

ReVideo: Remake a Video with Motion and Content Control

Chong Mou, Mingdeng Cao, Xintao Wang, Zhaoyang Zhang, Ying Shan, Jian Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07306 2024-05-24 cs.CV 57%

Point Resampling and Ray Transformation Aid to Editable NeRF Models

Zhenyang Li, Zilong Chen, Feifan Qu, Mingqing Wang, Yizhou Zhao, Kai Zhang, Yifan Peng

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12796 2024-05-22 cs.CV 57%

DisenStudio: Customized Multi-subject Text-to-Video Generation with Disentangled Spatial Control

Hong Chen, Xin Wang, Yipeng Zhang, Yuwei Zhou, Zeyang Zhang, Siao Tang, Wenwu Zhu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.04965 2024-05-22 cs.CV 57%

Seeing a Rose in Five Thousand Ways

Yunzhi Zhang, Shangzhe Wu, Noah Snavely, Jiajun Wu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments CVPR 2023. Project page: https://cs.stanford.edu/~yzzhang/projects/rose/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01655 2024-05-21 cs.CV 57%

FashionEngine: Interactive 3D Human Generation and Editing via Multimodal Controls

Tao Hu, Fangzhou Hong, Zhaoxi Chen, Ziwei Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://taohuumd.github.io/projects/FashionEngine

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10508 2024-05-20 cs.CV 57%

ART3D: 3D Gaussian Splatting for Text-Guided Artistic Scenes Generation

Pengzhi Li, Chengshuai Tang, Qinxuan Huang, Zhiheng Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted at CVPR 2024 Workshop on AI3DG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17105 2024-05-14 cs.CV 57%

Synthesizing Iris Images using Generative Adversarial Networks: Survey and Comparative Analysis

Shivangi Yadav, Arun Ross

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06547 2024-05-13 cs.CV 57%

OneTo3D: One Image to Re-editable Dynamic 3D Model and Video Generation

Jinwei Lin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 24 pages, 13 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05768 2024-05-10 cs.CV 57%

FastScene: Text-Driven Fast 3D Indoor Scene Generation via Panoramic Gaussian Splatting

Yikun Ma, Dandan Zhan, Zhi Jin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted by IJCAI-2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07270 2024-05-07 cs.CV cs.CL cs.LG 57%

Open-ended VQA benchmarking of Vision-Language models by exploiting Classification datasets and their semantic hierarchy

Simon Ging, María A. Bravo, Thomas Brox

专题命中 可控生成 :generative vision(abstract);分类 cs.CV

Comments Accepted as Spotlight Paper for ICLR 2024. The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02601 2024-05-06 cs.CV cs.AI 57%

MagicDrive: Street View Generation with Diverse 3D Geometry Control

Ruiyuan Gao, Kai Chen, Enze Xie, Lanqing Hong, Zhenguo Li, Dit-Yan Yeung, Qiang Xu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://flymin.github.io/magicdrive; Figure 7 updated

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15789 2024-05-02 cs.CV 57%

MotionMaster: Training-free Camera Motion Transfer For Video Generation

Teng Hu, Jiangning Zhang, Ran Yi, Yating Wang, Hongrui Huang, Jieyu Weng, Yabiao Wang, Lizhuang Ma

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.08212 2024-05-01 cs.CV 57%

Visible-Infrared Person Re-Identification via Patch-Mixed Cross-Modality Learning

Zhihao Qian, Yutian Lin, Bo Du

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16581 2024-04-26 cs.CV 57%

AudioScenic: Audio-Driven Video Scene Editing

Kaixin Shen, Ruijie Quan, Linchao Zhu, Jun Xiao, Yi Yang

专题命中 可控生成 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13299 2024-04-23 cs.CV 57%

PCQA: A Strong Baseline for AIGC Quality Assessment Based on Prompt Condition

Xi Fang, Weigang Wang, Xiaoxin Lv, Jun Yan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Published in CVPR-2024's NTIRE: New Trends in Image Restoration and Enhancement workshop and challenges

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11554 2024-04-18 cs.CV 57%

Predicting Long-horizon Futures by Conditioning on Geometry and Time

Tarasha Khurana, Deva Ramanan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: http://www.cs.cmu.edu/~tkhurana/depthforecasting/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17121 2024-04-18 cs.CV cs.LG 57%

ScribbleGen: Generative Data Augmentation Improves Scribble-supervised Semantic Segmentation

Jacob Schnell, Jieke Wang, Lu Qi, Vincent Tao Hu, Meng Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03031 2024-04-18 cs.CV 57%

MCM: Multi-condition Motion Synthesis Framework for Multi-scenario

Zeyu Ling, Bo Han, Yongkang Wong, Mohan Kangkanhalli, Weidong Geng

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01203 2024-04-18 cs.LG cs.CV 57%

Neural Language of Thought Models

Yi-Fu Wu, Minseung Lee, Sungjin Ahn

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted in ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10307 2024-04-17 cs.CV cs.AI 57%

Learnable Prompt for Few-Shot Semantic Segmentation in Remote Sensing Domain

Steve Andreas Immanuel, Hagai Raja Sinulingga

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to CVPRW 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07039 2024-04-17 cs.CV 57%

Open-Pose 3D Zero-Shot Learning: Benchmark and Challenges

Weiguang Zhao, Guanyu Yang, Rui Zhang, Chenru Jiang, Chaolong Yang, Yuyao Yan, Amir Hussain, Kaizhu Huang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09111 2024-04-16 cs.CV 57%

Exploring Generative AI for Sim2Real in Driving Data Synthesis

Haonan Zhao, Yiting Wang, Thomas Bashford-Rogers, Valentina Donzella, Kurt Debattista

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00513 2024-04-16 cs.CV 57%

Transformer based Pluralistic Image Completion with Reduced Information Loss

Qiankun Liu, Yuqi Jiang, Zhentao Tan, Dongdong Chen, Ying Fu, Qi Chu, Gang Hua, Nenghai Yu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted by TPAMI (2024). arXiv admin note: text overlap with arXiv:2205.05076

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06451 2024-04-10 cs.CV 57%

SmartControl: Enhancing ControlNet for Handling Rough Visual Conditions

Xiaoyu Liu, Yuxiang Wei, Ming Liu, Xianhui Lin, Peiran Ren, Xuansong Xie, Wangmeng Zuo

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05661 2024-04-09 cs.CV 57%

Automatic Controllable Colorization via Imagination

Xiaoyan Cong, Yue Wu, Qifeng Chen, Chenyang Lei

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments CVPR 2024. Project page: https://xy-cong.github.io/imagine-colorization

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05626 2024-04-09 cs.CV 57%

Learning a Category-level Object Pose Estimator without Pose Annotations

Fengrui Tian, Yaoyao Liu, Adam Kortylewski, Yueqi Duan, Shaoyi Du, Alan Yuille, Angtian Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03656 2024-04-05 cs.CV 57%

MVD-Fusion: Single-view 3D via Depth-consistent Multi-view Generation

Hanzhe Hu, Zhizhuo Zhou, Varun Jampani, Shubham Tulsiani

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: https://mvd-fusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03256 2024-04-05 cs.CV 57%

Multi Positive Contrastive Learning with Pose-Consistent Generated Images

Sho Inayoshi, Aji Resindra Widya, Satoshi Ozaki, Junji Otsuka, Takeshi Ohashi

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.13856 2024-04-05 eess.IV cs.CV cs.LG 57%

Robust deep learning for eye fundus images: Bridging real and synthetic data for enhancing generalization

Guilherme C. Oliveira, Gustavo H. Rosa, Daniel C. G. Pedronette, João P. Papa, Himeesh Kumar, Leandro A. Passos, Dinesh Kumar

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted by the Biomedical Signal Processing and Control

Journal ref Biomedical Signal Processing and Control, 94 (2024), 106263

详情

展开后加载摘要…

URL PDF HTML 收藏