arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4233 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4233 篇

2408.02100 2024-08-06 cs.CV 57%

View-consistent Object Removal in Radiance Fields

Yiren Lu, Jing Ma, Yu Yin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to ACM Multimedia (MM) 2024. Project website is accessible at https://vulab-ai.github.io/View-consistent_Object_Removal_in_Radiance_Fields

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01678 2024-08-06 cs.CV 57%

iControl3D: An Interactive System for Controllable 3D Scene Generation

Xingyi Li, Yizheng Wu, Jun Cen, Juewen Peng, Kewei Wang, Ke Xian, Zhe Wang, Zhiguo Cao, Guosheng Lin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01664 2024-08-06 cs.CV cs.AI 57%

SAT3D: Image-driven Semantic Attribute Transfer in 3D

Zhijun Zhai, Zengmao Wang, Xiaoxiao Long, Kaixuan Zhou, Bo Du

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Journal ref In Proceedings of the 32nd ACM International Conference on Multimedia, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01553 2024-08-06 cs.CV eess.IV 57%

Multi-task SAR Image Processing via GAN-based Unsupervised Manipulation

Xuran Hu, Mingzhe Zhu, Ziqiang Xu, Zhenpeng Feng, Ljubisa Stankovic

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments 19 pages, 17 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02875 2024-08-06 cs.CV cs.CL cs.IR 57%

Enhancing Conceptual Understanding in Multimodal Contrastive Learning through Hard Negative Samples

Philipp J. Rösch, Norbert Oswald, Michaela Geierhos, Jindřich Libovický

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21490 2024-08-01 eess.IV cs.AI cs.CV cs.LG 57%

Explainable and Controllable Motion Curve Guided Cardiac Ultrasound Video Generation

Junxuan Yu, Rusi Chen, Yongsong Zhou, Yanlin Chen, Yaofei Duan, Yuhao Huang, Han Zhou, Tan Tao, Xin Yang, Dong Ni

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by MICCAI MLMI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20336 2024-07-31 cs.CV 57%

Sun Off, Lights On: Photorealistic Monocular Nighttime Simulation for Robust Semantic Perception

Konstantinos Tzevelekakis, Shutong Zhang, Luc Van Gool, Christos Sakaridis

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14279 2024-07-31 cs.CV 57%

Zero123-6D: Zero-shot Novel View Synthesis for RGB Category-level 6D Pose Estimation

Francesco Di Felice, Alberto Remus, Stefano Gasperini, Benjamin Busam, Lionel Ott, Federico Tombari, Roland Siegwart, Carlo Alberto Avizzano

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 6 pages, 2 reference pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18595 2024-07-29 cs.CV 57%

LinguaLinker: Audio-Driven Portraits Animation with Implicit Facial Control Enhancement

Rui Zhang, Yixiao Fang, Zhengnan Lu, Pei Cheng, Zebiao Huang, Bin Fu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15931 2024-07-29 cs.CV cs.AI 57%

X-Portrait: Expressive Portrait Animation with Hierarchical Motion Attention

You Xie, Hongyi Xu, Guoxian Song, Chao Wang, Yichun Shi, Linjie Luo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments SIGGRAPH 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13675 2024-07-26 cs.CV 57%

MeshSegmenter: Zero-Shot Mesh Semantic Segmentation via Texture Synthesis

Ziming Zhong, Yanxu Xu, Jing Li, Jiale Xu, Zhengxin Li, Chaohui Yu, Shenghua Gao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments The paper was accepted by ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06903 2024-07-26 cs.CV cs.AI 57%

DreamScene360: Unconstrained Text-to-3D Scene Generation with Panoramic Gaussian Splatting

Shijie Zhou, Zhiwen Fan, Dejia Xu, Haoran Chang, Pradyumna Chari, Tejas Bharadwaj, Suya You, Zhangyang Wang, Achuta Kadambi

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16224 2024-07-24 cs.CV 57%

OutfitAnyone: Ultra-high Quality Virtual Try-On for Any Clothing and Any Person

Ke Sun, Jian Cao, Qi Wang, Linrui Tian, Xindi Zhang, Lian Zhuo, Bang Zhang, Liefeng Bo, Wenbo Zhou, Weiming Zhang, Daiheng Gao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 10 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14570 2024-07-24 cs.CV 57%

Are handcrafted filters helpful for attributing AI-generated images?

Jialiang Li, Haoyue Wang, Sheng Li, Zhenxing Qian, Xinpeng Zhang, Athanasios V. Vasilakos

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14949 2024-07-23 q-bio.NC cs.CV cs.HC 57%

CoCoG-2: Controllable generation of visual stimuli for understanding human concept representation

Chen Wei, Jiachen Zou, Dietmar Heinke, Quanying Liu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14936 2024-07-23 cs.MM 57%

EidetiCom: A Cross-modal Brain-Computer Semantic Communication Paradigm for Decoding Visual Perception

Linfeng Zheng, Peilin Chen, Shiqi Wang

专题命中 可控生成 :image generation(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09988 2024-07-22 eess.IV cs.CV 57%

Towards Architecture-Agnostic Untrained Network Priors for Image Reconstruction with Frequency Regularization

Yilin Liu, Yunkui Pang, Jiang Li, Yong Chen, Pew-Thian Yap

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted at ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14582 2024-07-19 cs.CV cs.AI 57%

PoseCrafter: One-Shot Personalized Video Synthesis Following Flexible Pose Control

Yong Zhong, Min Zhao, Zebin You, Xiaofeng Yu, Changwang Zhang, Chongxuan Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18211 2024-07-19 cs.CV cs.LG 57%

NeuroPictor: Refining fMRI-to-Image Reconstruction via Multi-individual Pretraining and Multi-level Modulation

Jingyang Huo, Yikai Wang, Xuelin Qian, Yun Wang, Chong Li, Jianfeng Feng, Yanwei Fu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12739 2024-07-18 cs.CV cs.HC 57%

GroundUp: Rapid Sketch-Based 3D City Massing

Gizem Esra Unlu, Mohamed Sayed, Yulia Gryaditskaya, Gabriel Brostow

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05547 2024-07-18 cs.CV 57%

LaSe-E2V: Towards Language-guided Semantic-Aware Event-to-Video Reconstruction

Kanghao Chen, Hangyu Li, JiaZhou Zhou, Zeyu Wang, Lin Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://vlislab22.github.io/LaSe-E2V/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10179 2024-07-18 cs.CV 57%

Animate Your Motion: Turning Still Images into Dynamic Videos

Mingxiao Li, Bo Wan, Marie-Francine Moens, Tinne Tuytelaars

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted at European Conference on Computer Vision (ECCV 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03244 2024-07-18 eess.IV cs.CV cs.LG 57%

EGIC: Enhanced Low-Bit-Rate Generative Image Compression Guided by Semantic Segmentation

Nikolai Körber, Eduard Kromer, Andreas Siebert, Sascha Hauke, Daniel Mueller-Gritschneder, Björn Schuller

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ECCV 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11494 2024-07-17 cs.CV 57%

Learning Semantic Latent Directions for Accurate and Controllable Human Motion Prediction

Guowei Xu, Jiale Tao, Wen Li, Lixin Duan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08733 2024-07-16 cs.CV 57%

GaussCtrl: Multi-View Consistent Text-Driven 3D Gaussian Splatting Editing

Jing Wu, Jia-Wang Bian, Xinghui Li, Guangrun Wang, Ian Reid, Philip Torr, Victor Adrian Prisacariu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ECCV2024, Project Website: https://gaussctrl.active.vision/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03913 2024-07-16 cs.CV 57%

Controllable Human-Object Interaction Synthesis

Jiaman Li, Alexander Clegg, Roozbeh Mottaghi, Jiajun Wu, Xavier Puig, C. Karen Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ECCV 2024, project webpage: https://lijiaman.github.io/projects/chois/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08209 2024-07-12 cs.CV 57%

Enriching Information and Preserving Semantic Consistency in Expanding Curvilinear Object Segmentation Datasets

Qin Lei, Jiang Zhong, Qizhu Dai

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07564 2024-07-12 cs.CV 57%

Trainable Highly-expressive Activation Functions

Irit Chelly, Shahaf E. Finder, Shira Ifergane, Oren Freifeld

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted to ECCV 2024 on July 1st, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07667 2024-07-11 cs.CV eess.IV 57%

VEnhancer: Generative Space-Time Enhancement for Video Generation

Jingwen He, Tianfan Xue, Dongyang Liu, Xinqi Lin, Peng Gao, Dahua Lin, Yu Qiao, Wanli Ouyang, Ziwei Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14121 2024-07-11 cs.CV 57%

External Knowledge Enhanced 3D Scene Generation from Sketch

Zijie Wu, Mingtao Feng, Yaonan Wang, He Xie, Weisheng Dong, Bo Miao, Ajmal Mian

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏