arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86761 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3489 篇

2308.07575 2023-08-22 cs.CV cs.AI cs.LG 70%

Story Visualization by Online Text Augmentation with Context Memory

Daechul Ahn, Daneul Kim, Gwangmo Song, Seung Hwan Kim, Honglak Lee, Dongyeop Kang, Jonghyun Choi

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICCV 2023, Project page: https://dcahn12.github.io/projects/CMOTA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09278 2023-08-21 cs.CV 70%

MATLABER: Material-Aware Text-to-3D via LAtent BRDF auto-EncodeR

Xudong Xu, Zhaoyang Lyu, Xingang Pan, Bo Dai

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06712 2023-08-21 cs.CV 70%

What does CLIP know about a red circle? Visual prompt engineering for VLMs

Aleksandar Shtedritski, Christian Rupprecht, Andrea Vedaldi

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICCV 2023 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.08095 2023-08-11 cs.CV 70%

Will Large-scale Generative Models Corrupt Future Datasets?

Ryuichiro Hataya, Han Bao, Hiromi Arai

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01546 2023-08-04 cs.SD cs.AI cs.LG cs.MM eess.AS 70%

MusicLDM: Enhancing Novelty in Text-to-Music Generation Using Beat-Synchronous Mixup Strategies

Ke Chen, Yusong Wu, Haohe Liu, Marianna Nezhurina, Taylor Berg-Kirkpatrick, Shlomo Dubnov

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.MM

Comments 16 pages, 3 figures, 2 tables, demo page: https://musicldm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.00211 2023-07-18 cs.CV eess.IV 70%

AIGCIQA2023: A Large-scale Image Quality Assessment Database for AI Generated Images: from the Perspectives of Quality, Authenticity and Correspondence

Jiarui Wang, Huiyu Duan, Jing Liu, Shi Chen, Xiongkuo Min, Guangtao Zhai

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14708 2023-07-07 cs.CV 70%

A Simple and Effective Baseline for Attentional Generative Adversarial Networks

Mingyu Jin, Chong Zhang, Qinkai Yu, Haochen Xue, Xiaobo Jin, Xi Yang

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16934 2023-07-03 cs.CV 70%

DreamDiffusion: Generating High-Quality Images from Brain EEG Signals

Yunpeng Bai, Xintao Wang, Yan-pei Cao, Yixiao Ge, Chun Yuan, Ying Shan

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16928 2023-06-30 cs.CV cs.AI cs.RO 70%

One-2-3-45: Any Single Image to 3D Mesh in 45 Seconds without Per-Shape Optimization

Minghua Liu, Chao Xu, Haian Jin, Linghao Chen, Mukund Varma T, Zexiang Xu, Hao Su

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments project website: one-2-3-45.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09329 2023-06-16 cs.CV 70%

DreamHuman: Animatable 3D Avatars from Text

Nikos Kolotouros, Thiemo Alldieck, Andrei Zanfir, Eduard Gabriel Bazavan, Mihai Fieraru, Cristian Sminchisescu

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Project website at https://dream-human.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07579 2023-06-14 cs.CV 70%

Parametric Implicit Face Representation for Audio-Driven Facial Reenactment

Ricong Huang, Peiwen Lai, Yipeng Qin, Guanbin Li

专题命中 文生图 :inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.13107 2023-06-14 cs.CV 70%

The Nuts and Bolts of Adopting Transformer in GANs

Rui Xu, Xiangyu Xu, Kai Chen, Bolei Zhou, Chen Change Loy

专题命中 文生图 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments CVPR2023 Workshop AI4CC. Project Page: https://nbei.github.io/stransgan.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07257 2023-06-13 cs.CV 70%

MovieFactory: Automatic Movie Creation from Text using Large Generative Models for Language and Images

Junchen Zhu, Huan Yang, Huiguo He, Wenjing Wang, Zixi Tuo, Wen-Huang Cheng, Lianli Gao, Jingkuan Song, Jianlong Fu

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07200 2023-06-13 cs.CV cs.LG 70%

Fill-Up: Balancing Long-Tailed Data with Generative Models

Joonghyuk Shin, Minguk Kang, Jaesik Park

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 32 pages, 19 Figures, and 10 Tables. Project webpage at https://alex4727.github.io/Fill-Up/

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.12561 2023-06-07 cs.CV cs.CL cs.LG 70%

Retrieval-Augmented Multimodal Language Modeling

Michihiro Yasunaga, Armen Aghajanyan, Weijia Shi, Rich James, Jure Leskovec, Percy Liang, Mike Lewis, Luke Zettlemoyer, Wen-tau Yih

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Published at ICML 2023. Blog post available at https://cs.stanford.edu/~myasu/blog/racm3/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02776 2023-06-06 cs.CV 70%

Cheap-fake Detection with LLM using Prompt Engineering

Guangyang Wu, Weijie Wu, Xiaohong Liu, Kele Xu, Tianjiao Wan, Wenyi Wang

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments ICME2023 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09898 2023-06-05 cs.CV 70%

MetaCLUE: Towards Comprehensive Visual Metaphors Research

Arjun R. Akula, Brendan Driscoll, Pradyumna Narayana, Soravit Changpinyo, Zhiwei Jia, Suyash Damle, Garima Pruthi, Sugato Basu, Leonidas Guibas, William T. Freeman, Yuanzhen Li, Varun Jampani

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted in CVPR 2023. Project page: https://metaclue.github.io/ , Video summary: https://youtu.be/V3TmeNETL-o

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12799 2023-05-23 cs.CV 70%

Interactive Data Synthesis for Systematic Vision Adaptation via LLMs-AIGCs Collaboration

Qifan Yu, Juncheng Li, Wentao Ye, Siliang Tang, Yueting Zhuang

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 11 pages, 6 figures, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.00070 2023-05-16 cs.LG cs.CV 70%

Debiasing Vision-Language Models via Biased Prompts

Ching-Yao Chuang, Varun Jampani, Yuanzhen Li, Antonio Torralba, Stefanie Jegelka

专题命中 文生图 :text-to-image(abstract);generative vision(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13221 2023-05-15 cs.CV 70%

Explore the Power of Synthetic Data on Few-shot Object Detection

Shaobo Lin, Kun Wang, Xingyu Zeng, Rui Zhao

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Journal ref CVPR2023 Workshop on Generative Models for Computer Vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05275 2023-04-24 cs.CV 70%

Detecting Images Generated by Diffusers

Davide Alessandro Coccomini, Andrea Esuli, Fabrizio Falchi, Claudio Gennaro, Giuseppe Amato

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.10261 2023-04-21 cs.CV 70%

Anything-3D: Towards Single-view Anything Reconstruction in the Wild

Qiuhong Shen, Xingyi Yang, Xinchao Wang

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05818 2023-04-13 cs.CV 70%

Gradient-Free Textual Inversion

Zhengcong Fei, Mingyuan Fan, Junshi Huang

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.02234 2023-04-11 cs.LG cs.CR cs.CV 70%

JPEG Compressed Images Can Bypass Protections Against AI Editing

Pedro Sandoval-Segura, Jonas Geiping, Tom Goldstein

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03119 2023-04-07 cs.CV 70%

Zero-shot Generative Model Adaptation via Image-specific Prompt Learning

Jiayi Guo, Chaofei Wang, You Wu, Eric Zhang, Kai Wang, Xingqian Xu, Shiji Song, Humphrey Shi, Gao Huang

专题命中 文生图 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by CVPR 2023. GitHub: https://github.com/Picsart-AI-Research/IPL-Zero-Shot-Generative-Model-Adaptation

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.02828 2023-04-07 cs.CV cs.CY 70%

Uncurated Image-Text Datasets: Shedding Light on Demographic Bias

Noa Garcia, Yusuke Hirota, Yankun Wu, Yuta Nakashima

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13455 2023-03-24 cs.CV cs.CL 70%

CoBIT: A Contrastive Bi-directional Image-Text Generation Model

Haoxuan You, Mandy Guo, Zhecan Wang, Kai-Wei Chang, Jason Baldridge, Jiahui Yu

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.04493 2023-03-23 cs.CV cs.LG 70%

SDFusion: Multimodal 3D Shape Completion, Reconstruction, and Generation

Yen-Chi Cheng, Hsin-Ying Lee, Sergey Tulyakov, Alexander Schwing, Liangyan Gui

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments In CVPR 2023. Project page and code is available at: https://yccyenchicheng.github.io/SDFusion/. Fix some typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.00750 2023-03-02 cs.CV 70%

StraIT: Non-autoregressive Generation with Stratified Image Transformer

Shengju Qian, Huiwen Chang, Yuanzhen Li, Zizhao Zhang, Jiaya Jia, Han Zhang

专题命中 文生图 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.12066 2023-02-24 cs.CV 70%

Teaching CLIP to Count to Ten

Roni Paiss, Ariel Ephrat, Omer Tov, Shiran Zada, Inbar Mosseri, Michal Irani, Tali Dekel

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏