arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4233 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4233 篇

2401.14257 2024-01-30 cs.CV cs.AI 57%

Sketch2NeRF: Multi-view Sketch-guided Text-to-3D Generation

Minglin Chen, Weihao Yuan, Yukun Wang, Zhe Sheng, Yisheng He, Zilong Dong, Liefeng Bo, Yulan Guo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11239 2024-01-23 cs.CV 57%

Product-Level Try-on: Characteristics-preserving Try-on with Realistic Clothes Shading and Wrinkles

Yanlong Zang, Han Yang, Jiaxu Miao, Yi Yang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11122 2024-01-23 cs.CV 57%

Spatial Structure Constraints for Weakly Supervised Semantic Segmentation

Tao Chen, Yazhou Yao, Xingguo Huang, Zechao Li, Liqiang Nie, Jinhui Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments accepted by IEEE Transactions on Image Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07770 2024-01-17 cs.CV 57%

Seeing the Unseen: Visual Common Sense for Semantic Placement

Ram Ramrakhya, Aniruddha Kembhavi, Dhruv Batra, Zsolt Kira, Kuo-Hao Zeng, Luca Weihs

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07487 2024-01-17 cs.RO cs.CV 57%

Robo-ABC: Affordance Generalization Beyond Categories via Semantic Correspondence for Robot Manipulation

Yuanchen Ju, Kaizhe Hu, Guowei Zhang, Gu Zhang, Mingrun Jiang, Huazhe Xu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02142 2024-01-09 cs.CV 57%

GUESS:GradUally Enriching SyntheSis for Text-Driven Human Motion Generation

Xuehao Gao, Yang Yang, Zhenyu Xie, Shaoyi Du, Zhongqian Sun, Yang Wu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by IEEE Transactions on Visualization and Computer Graphics (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01862 2024-01-04 cs.CV cs.CL cs.LG 57%

A Vision Check-up for Language Models

Pratyusha Sharma, Tamar Rott Shaham, Manel Baradad, Stephanie Fu, Adrian Rodriguez-Munoz, Shivam Duggal, Phillip Isola, Antonio Torralba

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01827 2024-01-04 cs.CV 57%

Moonshot: Towards Controllable Video Generation and Editing with Multimodal Conditions

David Junhao Zhang, Dongxu Li, Hung Le, Mike Zheng Shou, Caiming Xiong, Doyen Sahoo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments project page: https://showlab.github.io/Moonshot/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17172 2023-12-29 cs.CV cs.AI cs.CL 57%

Unified-IO 2: Scaling Autoregressive Multimodal Models with Vision, Language, Audio, and Action

Jiasen Lu, Christopher Clark, Sangho Lee, Zichen Zhang, Savya Khosla, Ryan Marten, Derek Hoiem, Aniruddha Kembhavi

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 38 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15480 2023-12-27 cs.CV 57%

A Two-stage Personalized Virtual Try-on Framework with Shape Control and Texture Guidance

Shufang Zhang, Minxue Ni, Lei Wang, Wenxin Ding, Shuai Chen, Yuhong Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01406 2023-12-27 cs.CV 57%

Learning Residual Elastic Warps for Image Stitching under Dirichlet Boundary Condition

Minsu Kim, Yongjun Lee, Woo Kyoung Han, Kyong Hwan Jin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14724 2023-12-25 cs.CV stat.ML 57%

Images in Discrete Choice Modeling: Addressing Data Isomorphism in Multi-Modality Inputs

Brian Sifringer, Alexandre Alahi

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments 17 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14233 2023-12-25 cs.CV 57%

VCoder: Versatile Vision Encoders for Multimodal Large Language Models

Jitesh Jain, Jianwei Yang, Humphrey Shi

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Project Page: https://praeclarumjj3.github.io/vcoder/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14521 2023-12-21 cs.CV 57%

GaussianEditor: Swift and Controllable 3D Editing with Gaussian Splatting

Yiwen Chen, Zilong Chen, Chi Zhang, Feng Wang, Xiaofeng Yang, Yikai Wang, Zhongang Cai, Lei Yang, Huaping Liu, Guosheng Lin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://buaacyw.github.io/gaussian-editor/ Code: https://github.com/buaacyw/GaussianEditor

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02087 2023-12-06 cs.CV 57%

VideoSwap: Customized Video Subject Swapping with Interactive Semantic Point Correspondence

Yuchao Gu, Yipin Zhou, Bichen Wu, Licheng Yu, Jia-Wei Liu, Rui Zhao, Jay Zhangjie Wu, David Junhao Zhang, Mike Zheng Shou, Kevin Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page at https://videoswap.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12886 2023-12-06 cs.CV 57%

AnimateAnything: Fine-Grained Open Domain Image Animation with Motion Guidance

Zuozhuo Dai, Zhenghao Zhang, Yao Yao, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08956 2023-12-06 cs.CV 57%

PG-VTON: A Novel Image-Based Virtual Try-On Method via Progressive Inference Paradigm

Naiyu Fang, Lemiao Qiu, Shuyou Zhang, Zili Wang, Kerui Hu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03373 2023-11-30 cs.CV 57%

Training-Free Layout Control with Cross-Attention Guidance

Minghao Chen, Iro Laina, Andrea Vedaldi

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments WACV 2024, Project Page: https://silent-chen.github.io/layout-guidance/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15551 2023-11-28 cs.CV cs.AI cs.CR cs.LG eess.IV 57%

Instruct2Attack: Language-Guided Semantic Adversarial Attacks

Jiang Liu, Chen Wei, Yuxiang Guo, Heng Yu, Alan Yuille, Soheil Feizi, Chun Pong Lau, Rama Chellappa

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments under submission, code coming soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12454 2023-11-28 cs.SD cs.AI cs.MM eess.AS 57%

HierSpeech++: Bridging the Gap between Semantic and Acoustic Representation of Speech by Hierarchical Variational Inference for Zero-shot Speech Synthesis

Sang-Hoon Lee, Ha-Yeong Choi, Seung-Bin Kim, Seong-Whan Lee

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

Comments 16 pages, 9 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13655 2023-11-27 cs.CV 57%

GAN-Avatar: Controllable Personalized GAN-based Human Head Avatar

Berna Kabadayi, Wojciech Zielonka, Bharat Lal Bhatnagar, Gerard Pons-Moll, Justus Thies

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments Website: https://ganavatar.github.io/ , Video: https://www.youtube.com/watch?v=uAi5IVrzzZY&ab_channel=JustusThies , Accepted to 3DV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12043 2023-11-22 cs.CV cs.AI 57%

Efficient Domain Adaptation via Generative Prior for 3D Infant Pose Estimation

Zhuoran Zhou, Zhongyu Jiang, Wenhao Chai, Cheng-Yen Yang, Lei Li, Jenq-Neng Hwang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments WACVW 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11697 2023-11-21 cs.CV 57%

Cut-and-Paste: Subject-Driven Video Editing with Attention Control

Zhichao Zuo, Zhao Zhang, Yan Luo, Yang Zhao, Haijun Zhang, Yi Yang, Meng Wang

专题命中 可控生成 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02881 2023-11-14 cs.CV 57%

Probabilistic and Semantic Descriptions of Image Manifolds and Their Applications

Peter Tu, Zhaoyuan Yang, Richard Hartley, Zhiwei Xu, Jing Zhang, Yiwei Fu, Dylan Campbell, Jaskirat Singh, Tianyu Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 26 pages, 17 figures, 1 table, accepted to Frontiers in Computer Science, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03866 2023-11-08 cs.CV 57%

SCONE-GAN: Semantic Contrastive learning-based Generative Adversarial Network for an end-to-end image translation

Iman Abbasnejad, Fabio Zambetta, Flora Salim, Timothy Wiley, Jeffrey Chan, Russell Gallagher, Ehsan Abbasnejad

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16858 2023-11-08 cs.CV 57%

4D-Editor: Interactive Object-level Editing in Dynamic Neural Radiance Fields via Semantic Distillation

Dadong Jiang, Zhihui Ke, Xiaobo Zhou, Xidong Shi

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Project page: https://patrickddj.github.io/4D-Editor

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01573 2023-11-06 cs.CV cs.AI cs.CY cs.LG 57%

Improving Fairness using Vision-Language Driven Image Augmentation

Moreno D'Incà, Christos Tzelepis, Ioannis Patras, Nicu Sebe

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted for publication in WACV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00425 2023-11-02 cs.CV cs.AI 57%

Neural Implicit Field Editing Considering Object-environment Interaction

Zhihong Zeng, Zongji Wang, Yuanben Zhang, Weinan Cai, Zehao Cao, Lili Zhang, Yan Guo, Yanhong Zhang, Junyi Liu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19024 2023-10-31 cs.CV 57%

FPGAN-Control: A Controllable Fingerprint Generator for Training with Synthetic Data

Alon Shoshan, Nadav Bhonker, Emanuel Ben Baruch, Ori Nizan, Igor Kviatkovsky, Joshua Engelsma, Manoj Aggarwal, Gerard Medioni

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.12775 2023-10-25 cs.MM 57%

Semantic Change Driven Generative Semantic Communication Framework

Wanting Yang, Zehui Xiong, Hongyang Du, Yanli Yuan, Tony Q. S. Quek

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏