arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4233 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4233 篇

2409.18964 2024-09-30 cs.CV cs.AI cs.LG 57%

PhysGen: Rigid-Body Physics-Grounded Image-to-Video Generation

Shaowei Liu, Zhongzheng Ren, Saurabh Gupta, Shenlong Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024. Project page: https://stevenlsw.github.io/physgen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06164 2024-09-30 cs.CV 57%

Platypose: Calibrated Zero-Shot Multi-Hypothesis 3D Human Motion Estimation

Paweł A. Pierzchlewicz, Caio O. da Silva, R. James Cotton, Fabian H. Sinz

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16042 2024-09-27 eess.IV cs.CV 57%

Enhanced Unsupervised Image-to-Image Translation Using Contrastive Learning and Histogram of Oriented Gradients

Wanchen Zhao

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Critical Errors in Data or Analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17251 2024-09-27 cs.CV 57%

GenWarp: Single Image to Novel Views with Semantic-Preserving Generative Warping

Junyoung Seo, Kazumi Fukuda, Takashi Shibuya, Takuya Narihira, Naoki Murata, Shoukang Hu, Chieh-Hsin Lai, Seungryong Kim, Yuki Mitsufuji

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024 / Project page: https://GenWarp-NVS.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14579 2024-09-27 cs.CV 57%

Synthesizing Environment-Specific People in Photographs

Mirela Ostrek, Carol O'Sullivan, Michael J. Black, Justus Thies

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted at ECCV 2024, Project: https://esp.is.tue.mpg.de

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16709 2024-09-26 cs.CV 57%

Pose-Guided Fine-Grained Sign Language Video Generation

Tongkai Shi, Lianyu Hu, Fanhua Shang, Jichao Feng, Peidong Liu, Wei Feng

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15061 2024-09-26 cs.CV cs.RO 57%

The RoboDepth Challenge: Methods and Advancements Towards Robust Depth Estimation

Lingdong Kong, Yaru Niu, Shaoyuan Xie, Hanjiang Hu, Lai Xing Ng, Benoit R. Cottereau, Liangjun Zhang, Hesheng Wang, Wei Tsang Ooi, Ruijie Zhu, Ziyang Song, Li Liu, Tianzhu Zhang, Jun Yu, Mohan Jing, Pengwei Li, Xiaohua Qi, Cheng Jin, Yingfeng Chen, Jie Hou, Jie Zhang, Zhen Kan, Qiang Ling, Liang Peng, Minglei Li, Di Xu, Changpeng Yang, Yuanqi Yao, Gang Wu, Jian Kuai, Xianming Liu, Junjun Jiang, Jiamian Huang, Baojun Li, Jiale Chen, Shuang Zhang, Sun Ao, Zhenyu Li, Runze Chen, Haiyong Luo, Fang Zhao, Jingze Yu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Technical Report; 65 pages, 34 figures, 24 tables; Code at https://github.com/ldkong1205/RoboDepth

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15739 2024-09-25 cs.CV 57%

Teaching Tailored to Talent: Adverse Weather Restoration via Prompt Pool and Depth-Anything Constraint

Sixiang Chen, Tian Ye, Kai Zhang, Zhaohu Xing, Yunlong Lin, Lei Zhu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ECCV'2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09231 2024-09-25 cs.CV cs.LG 57%

Reliability in Semantic Segmentation: Can We Use Synthetic Data?

Thibaut Loiseau, Tuan-Hung Vu, Mickael Chen, Patrick Pérez, Matthieu Cord

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted at ECCV 2024, Project Page: https://valeoai.github.io/publications/genval/ , Code: https://github.com/valeoai/GenVal

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13843 2024-09-25 cs.CV 57%

CompoNeRF: Text-guided Multi-object Compositional NeRF with Editable 3D Scene Layout

Haotian Bai, Yuanhuiyi Lyu, Lutao Jiang, Sijia Li, Haonan Lu, Xiaodong Lin, Lin Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10504 2024-09-20 cs.CV 57%

Multi-scale Semantic Prior Features Guided Deep Neural Network for Urban Street-view Image

Jianshun Zeng, Wang Li, Yanjie Lv, Shuai Gao, YuChu Qin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09149 2024-09-17 cs.CV 57%

Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss

Qifan Fu, Xiaohang Yang, Muhammad Asad, Changjae Oh, Shanxin Yuan, Gregory Slabaugh

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments This paper has been accepted by the ECCV 2024 HANDS workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03018 2024-09-17 cs.CV 57%

DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance

Cong Wang, Jiaxi Gu, Panwen Hu, Songcen Xu, Hang Xu, Xiaodan Liang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08207 2024-09-13 cs.CV 57%

VI3DRM:Towards meticulous 3D Reconstruction from Sparse Views via Photo-Realistic Novel View Synthesis

Hao Chen, Jiafu Wu, Ying Jin, Jinlong Peng, Xiaofeng Mao, Mingmin Chi, Mufeng Yao, Bo Peng, Jian Li, Yun Cao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07179 2024-09-12 cs.CV 57%

Phy124: Fast Physics-Driven 4D Content Generation from a Single Image

Jiajing Lin, Zhenzhong Wang, Yongjie Hou, Yuzhou Tang, Min Jiang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06189 2024-09-12 cs.CV 57%

MyGo: Consistent and Controllable Multi-View Driving Video Generation with Camera Control

Yining Yao, Xi Guo, Chenjing Ding, Wei Wu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://metadrivescape.github.io/papers_project/MyGo/page.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13206 2024-09-06 cs.CV cs.AI 57%

Depth-guided NeRF Training via Earth Mover's Distance

Anita Rau, Josiah Aklilu, F. Christopher Holsinger, Serena Yeung-Levy

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01595 2024-09-04 cs.CV 57%

DiVE: DiT-based Video Generation with Enhanced Control

Junpeng Jiang, Gangyi Hong, Lijun Zhou, Enhui Ma, Hengtong Hu, Xia Zhou, Jie Xiang, Fan Liu, Kaicheng Yu, Haiyang Sun, Kun Zhan, Peng Jia, Miao Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04811 2024-09-04 cs.CV 57%

Image-Based Virtual Try-On: A Survey

Dan Song, Xuanpu Zhang, Juan Zhou, Weizhi Nie, Ruofeng Tong, Mohan Kankanhalli, An-An Liu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 30 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14342 2024-08-30 cs.CV physics.med-ph 57%

Dual-Domain CLIP-Assisted Residual Optimization Perception Model for Metal Artifact Reduction

Xinrui Zhang, Ailong Cai, Shaoyu Wang, Linyuan Wang, Zhizhong Zheng, Lei Li, Bin Yan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 14 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15995 2024-08-29 cs.CV 57%

TEDRA: Text-based Editing of Dynamic and Photoreal Actors

Basavaraj Sunagad, Heming Zhu, Mohit Mendiratta, Adam Kortylewski, Christian Theobalt, Marc Habermann

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments For project page, see this https://vcai.mpi-inf.mpg.de/projects/Tedra

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12340 2024-08-28 cs.CV 57%

VTON-HandFit: Virtual Try-on for Arbitrary Hand Pose Guided by Hand Priors Embedding

Yujie Liang, Xiaobin Hu, Boyuan Jiang, Donghao Luo, Kai WU, Wenhui Han, Taisong Jin, Chengjie Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments The project page is \url{https://vton-handfit.github.io}

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21136 2024-08-27 cs.CV 57%

MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal Controls

Yuxuan Bian, Ailing Zeng, Xuan Ju, Xian Liu, Zhaoyang Zhang, Wei Liu, Qiang Xu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02034 2024-08-22 cs.CV 57%

TrAME: Trajectory-Anchored Multi-View Editing for Text-Guided 3D Gaussian Splatting Manipulation

Chaofan Luo, Donglin Di, Xun Yang, Yongjia Ma, Zhou Xue, Chen Wei, Yebin Liu

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06168 2024-08-22 cs.CV cs.AI 57%

DiffuMatting: Synthesizing Arbitrary Objects with Matting-level Annotation

Xiaobin Hu, Xu Peng, Donghao Luo, Xiaozhong Ji, Jinlong Peng, Zhengkai Jiang, Jiangning Zhang, Taisong Jin, Chengjie Wang, Rongrong Ji

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments This paper was accepted by ECCV 2024, and the project page is accessible at: \url{https://diffumatting.github.io}

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09240 2024-08-20 cs.CV 57%

RepControlNet: ControlNet Reparameterization

Zhaoli Deng, Kaibin Zhou, Fanyi Wang, Zhenpeng Mi

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08556 2024-08-16 cs.CV cs.AI 57%

SM4Depth: Seamless Monocular Metric Depth Estimation across Multiple Cameras and Scenes by One Model

Yihao Liu, Feng Xue, Anlong Ming, Mingshuai Zhao, Huadong Ma, Nicu Sebe

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments Accepted by ACM MultiMedia 24, Project Page: xuefeng-cvr.github.io/SM4Depth

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08651 2024-08-15 cs.CV 57%

HAIFIT: Human-to-AI Fashion Image Translation

Jianan Jiang, Xinglin Li, Weiren Yu, Di Wu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 10 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04865 2024-08-12 cs.SD cs.MM eess.AS 57%

TEAdapter: Supply abundant guidance for controllable text-to-music generation

Jialing Zou, Jiahao Mei, Xudong Nan, Jinghua Li, Daoguo Dong, Liang He

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

Comments Accepted by ICME'24: IEEE International Conference on Multimedia and Expo

Journal ref 2024 IEEE International Conference on Multimedia and Expo (ICME 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16499 2024-08-07 cs.CV 57%

InceptionHuman: Controllable Prompt-to-NeRF for Photorealistic 3D Human Generation

Shiu-hong Kao, Xinhang Liu, Yu-Wing Tai, Chi-Keung Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏