arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-01 至 2025-10-01 共收录 6 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 6 篇

2501.15562 2025-10-01 cs.CV cs.AI 88%

CE-SDWV: Effective and Efficient Concept Erasure for Text-to-Image Diffusion Models via a Semantic-Driven Word Vocabulary

Jiahang Tu, Qian Feng, Jiahua Dong, Hanbin Zhao, Chao Zhang, Nicu Sebe, Hui Qian

机构 * College of Computer Science and Technology, Zhejiang University, China(浙江大学计算机科学与技术学院) Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi(阿布扎赫德莫罕默德·本·扎耶德人工智能大学) Department of Information Engineering and Computer Science, University of Trento, Italy(意大利特伦托大学信息工程与计算机科学系)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments 25 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25771 2025-10-01 cs.CV cs.AI 88%

Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs

Jia Jun Cheng Xian, Muchen Li, Haotian Yang, Xin Tao, Pengfei Wan, Leonid Sigal, Renjie Liao

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能向量研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) Kling Team, Kuaishou Technology(快手科技 Kling 团队) NSERC CRC Chair(加拿大NSERC CRC主席)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04946 2025-10-01 cs.CV cs.CL 88%

Taming the Tri-Space Tension: ARC-Guided Hallucination Modeling and Control for Text-to-Image Generation

Jianjiang Yang, Ziyan Huang, Yanshu li, Da Peng, Huaiyuan Yao

机构 * University of Bristol(布里斯托大学) South China University of Technology(华南理工大学) Brown University(布朗大学) Xi’an Jiaotong University(西安交通大学) Arizona State University(亚利桑那州立大学)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments 9 pages,6 figures,7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26641 2025-10-01 cs.CV 85%

Query-Kontext: An Unified Multimodal Model for Image Generation and Editing

Yuxin Song, Wenkai Dong, Shizun Wang, Qi Zhang, Song Xue, Tao Yuan, Hu Yang, Haocheng Feng, Hang Zhou, Xinyan Xiao, Jingdong Wang

机构 * Baidu VIS(百度视觉) National University of Singapore(新加坡国立大学)

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 23 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23398 2025-10-01 cs.CV cs.CY 83%

A Large Scale Analysis of Gender Biases in Text-to-Image Generative Models

Leander Girrbach, Stephan Alaniz, Genevieve Smith, Zeynep Akata

机构 * Technical University of Munich, Munich Center for Machine Learning, MDSI(慕尼黑技术大学、慕尼黑机器学习中心、MDSI) LTCI, Télécom Paris, Institut Polytechnique de Paris(LTCI、巴黎电信学院、巴黎理工学院) Helmholtz Munich(海德堡-慕尼黑研究中心) University of California, Berkeley(加州大学伯克利分校)

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments 40 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26055 2025-10-01 cs.GR cs.CV cs.LG 62%

GaussEdit: Adaptive 3D Scene Editing with Text and Image Prompts

Zhenyu Shu, Junlong Yu, Kai Chao, Shiqing Xin, Ligang Liu

机构 * School of Computer and Data Engineering, NingboTech University(计算机与数据工程学院,宁波科技学院) Ningbo Institute, Zhejiang University(浙江大学宁波学院) School of Software Technology, Zhejiang University(软件技术学院,浙江大学) School of Big Data and Artificial Intelligence Management, Xi’an Jiaotong University(大数据与人工智能管理学院,西安交通大学) School of Computer Science and Technology, ShanDong University(计算机科学与技术学院,山东大学) Graphics & Geometric Computing Laboratory, School of Mathematical Sciences, University of Science and Technology of China(图形与几何计算实验室,数学科学学院,中国科学技术大学)

专题命中 文生图 :image synthesis(abstract);分类 cs.CV、cs.GR

Journal ref IEEE Transactions on Visualization and Computer Graphics. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏