arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3489 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3489 篇

2505.00029 2025-05-02 cs.CL cs.AI 67%

Keep the General, Inject the Specific: Structured Dialogue Fine-Tuning for Knowledge Injection without Catastrophic Forgetting

Yijie Hong, Xiaofei Yin, Xinzhong Wang, Yi Tu, Ya Guo, Sufeng Duan, Weiqiang Wang, Lingyong Fang, Depeng Wang, Huijia Zhu

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Security Lab, Ant Group(蚂蚁集团安全实验室)

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19419 2025-03-12 cs.CL 67%

KAHANI: Culturally-Nuanced Visual Storytelling Tool for Non-Western Cultures

Hamna, Deepthi Sudharsan, Agrima Seth, Ritvik Budhiraja, Deepika Khullar, Vyshak Jain, Kalika Bali, Aditya Vashistha, Sameer Segal

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05476 2025-02-18 cs.HC cs.AI cs.ET 67%

Artworks Reimagined: Exploring Human-AI Co-Creation through Body Prompting

Jonas Oppenlaender, Hannah Johnston, Johanna Silvennoinen, Helena Barranha

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

Comments 29 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09307 2025-02-14 cs.CL cs.AI 67%

When the LM misunderstood the human chuckled: Analyzing garden path effects in humans and language models

Samuel Joseph Amouyal, Aya Meltzer-Asscher, Jonathan Berant

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09284 2025-01-20 cs.AI cs.CR 67%

SEAL: Entangled White-box Watermarks on Low-Rank Adaptation

Giyeong Oh, Saejin Kim, Woohyun Cho, Sangkyu Lee, Jiwan Chung, Dokyung Song, Youngjae Yu

专题命中 文生图 :text-to-image(abstract);image synthesis(abstract)

Comments Author name corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17308 2025-01-20 cs.LG math.ST stat.TH 67%

Consistent estimation of generative model representations in the data kernel perspective space

Aranyak Acharyya, Michael W. Trosset, Carey E. Priebe, Hayden S. Helm

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04265 2024-11-11 cs.AI 67%

FLIRT: Feedback Loop In-context Red Teaming

Ninareh Mehrabi, Palash Goyal, Christophe Dupuy, Qian Hu, Shalini Ghosh, Richard Zemel, Kai-Wei Chang, Aram Galstyan, Rahul Gupta

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04207 2024-10-16 cs.LG stat.ML 67%

Learning on LoRAs: GL-Equivariant Processing of Low-Rank Weight Spaces for Large Finetuned Models

Theo Putterman, Derek Lim, Yoav Gelberg, Stefanie Jegelka, Haggai Maron

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00173 2024-10-02 cs.LG 67%

GaNDLF-Synth: A Framework to Democratize Generative AI for (Bio)Medical Imaging

Sarthak Pati, Szymon Mazurek, Spyridon Bakas

专题命中 文生图 :diffusion(abstract);image synthesis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08675 2024-07-23 cs.AI 67%

CAD-Prompted Generative Models: A Pathway to Feasible and Novel Engineering Designs

Leah Chong, Jude Rayan, Steven Dow, Ioanna Lykourentzou, Faez Ahmed

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments 11 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09507 2024-07-18 eess.IV 67%

Can Generative AI Replace Immunofluorescent Staining Processes? A Comparison Study of Synthetically Generated CellPainting Images from Brightfield

Xiaodan Xing, Siofra Murdoch, Chunling Tang, Giorgos Papanastasiou, Jan Cross-Zamirski, Yunzhe Guo, Xianglu Xiao, Carola-Bibiane Schönlieb, Yinhai Wang, Guang Yang

专题命中 文生图 :diffusion(abstract);image synthesis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08100 2024-07-12 cs.LG math.OC math.PR 67%

Non-convergence of Adam and other adaptive stochastic gradient descent optimization methods for non-vanishing learning rates

Steffen Dereich, Robin Graeber, Arnulf Jentzen

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments 54 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07672 2024-07-11 cs.HC 67%

StoryDiffusion: How to Support UX Storyboarding With Generative-AI

Zhaohui Liang, Xiaoyu Zhang, Kevin Ma, Zhao Liu, Xipei Ren, Kosa Goucher-Lambert, Can Liu

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13534 2024-07-08 cs.HC 67%

Prompting AI Art: An Investigation into the Creative Skill of Prompt Engineering

Jonas Oppenlaender, Rhema Linder, Johanna Silvennoinen

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

Comments 42 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08739 2024-06-14 cs.CY cs.LG 67%

At the edge of a generative cultural precipice

Diego Porres, Alex Gomez-Villa

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments Accepted at the CVPR Fourth Workshop on Ethical Considerations in Creative applications of Computer Vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18385 2024-05-01 cs.HC cs.AI 67%

Equivalence: An analysis of artists' roles with Image Generative AI from Conceptual Art perspective through an interactive installation design practice

Yixuan Li, Dan C. Baciu, Marcos Novak, George Legrady

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00018 2024-04-02 cs.HC cs.AI cs.SI 67%

Can AI Outperform Human Experts in Creating Social Media Creatives?

Eunkyung Park, Raymond K. Wong, Junbum Kwon

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01673 2024-01-26 eess.AS cs.CL cs.SD 67%

Disentanglement in a GAN for Unconditional Speech Synthesis

Matthew Baas, Herman Kamper

专题命中 文生图 :diffusion(abstract);image synthesis(abstract)

Comments 12 pages, 5 tables, 4 figures. Accepted to IEEE TASLP. arXiv admin note: substantial text overlap with arXiv:2210.05271

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10434 2023-10-24 cs.CL cs.AI cs.LG 67%

Learning the Visualness of Text Using Large Vision-Language Models

Gaurav Verma, Ryan A. Rossi, Christopher Tensmeyer, Jiuxiang Gu, Ani Nenkova

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

Comments Accepted at EMNLP 2023 (Main, long); 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10120 2023-10-18 cs.LG cs.AI 67%

Selective Amnesia: A Continual Learning Approach to Forgetting in Deep Generative Models

Alvin Heng, Harold Soh

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12915 2023-09-19 cs.HC cs.AI 67%

Language as Reality: A Co-Creative Storytelling Game Experience in 1001 Nights using Generative AI

Yuqian Sun, Zhouyi Li, Ke Fang, Chang Hee Lee, Ali Asadipour

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments The paper was accepted by The 19th AAAI Conference on Artificial Intelligence and Interactive Digital Entertainment (AIIDE 23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05940 2023-09-13 cs.CR 67%

Catch You Everything Everywhere: Guarding Textual Inversion via Concept Watermarking

Weitao Feng, Jiyan He, Jie Zhang, Tianwei Zhang, Wenbo Zhou, Weiming Zhang, Nenghai Yu

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04997 2023-09-12 cs.CY 67%

Gender Bias in Multimodal Models: A Transnational Feminist Approach Considering Geographical Region and Culture

Abhishek Mandal, Suzanne Little, Susan Leavy

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments Selected for publication at the Aequitas 2023: Workshop on Fairness and Bias in AI | co-located with ECAI 2023, Kraków, Poland

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.08961 2023-08-28 cs.CL cs.AI cs.HC 67%

Grimm in Wonderland: Prompt Engineering with Midjourney to Illustrate Fairytales

Martin Ruskov

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

Comments 19th Conference on Information and Research science Connecting to Digital and Library Science, February 23-24, 2023, Bari, Italy

Journal ref in 19th IRCDL, CEUR WS vol. 3365, pp. 180-191 (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14151 2023-07-27 cs.LG stat.ML 67%

Learning Disentangled Discrete Representations

David Friede, Christian Reimers, Heiner Stuckenschmidt, Mathias Niepert

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03668 2023-06-02 cs.LG cs.CL 67%

Hard Prompts Made Easy: Gradient-Based Discrete Optimization for Prompt Tuning and Discovery

Yuxin Wen, Neel Jain, John Kirchenbauer, Micah Goldblum, Jonas Geiping, Tom Goldstein

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments 15 pages, 12 figures, Code is available at https://github.com/YuxinWenRick/hard-prompts-made-easy

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11176 2023-05-25 cs.RO cs.AI 67%

Instruct2Act: Mapping Multi-modality Instructions to Robotic Actions with Large Language Model

Siyuan Huang, Zhengkai Jiang, Hao Dong, Yu Qiao, Peng Gao, Hongsheng Li

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12013 2023-05-23 cs.HC cs.AI cs.CY 67%

Constructing Dreams using Generative AI

Safinah Ali, Daniella DiPaola, Randi Williams, Prerna Ravi, Cynthia Breazeal

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.12253 2023-03-23 cs.HC 67%

The Prompt Artists

Minsuk Chang, Stefania Druga, Alex Fiannaca, Pedro Vergani, Chinmay Kulkarni, Carrie Cai, Michael Terry

专题命中 文生图 :text-to-image(abstract);image editing(abstract)

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06832 2023-03-17 cs.LG cs.AI 67%

ODIN: On-demand Data Formulation to Mitigate Dataset Lock-in

SP Choi, Jihun Lee, Hyeongseok Ahn, Sanghee Jung, Bumsoo Kang

专题命中 文生图 :text-to-image(abstract);diffusion(abstract)

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏