arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-28 至 2025-10-28 共收录 9 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 9 篇

2510.22851 2025-10-28 cs.CV cs.AI 85%

Semantic Surgery: Zero-Shot Concept Erasure in Diffusion Models

Lexiang Xiong, Chengyu Liu, Jingwen Ye, Yan Liu, Yuecong Xu

机构 * National University of Singapore(国立新加坡大学) Sichuan University(四川大学)

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to the 39th Conference on Neural Information Processing Systems (NeurIPS 2025). Code is available at https://github.com/Lexiang-Xiong/Semantic-Surgery

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21763 2025-10-28 cs.CV cs.AI 85%

Proportion and Perspective Control for Flow-Based Image Generation

Julien Boudier, Hugo Caselles-Dupré

机构 * Obvious Research(Obvious研究)

专题命中 可控生成 :image generation(title);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)

Comments Technical report after open-source release

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08441 2025-10-28 cs.CV cs.AI 74%

Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation

Anlin Zheng, Xin Wen, Xuanyang Zhang, Chuofan Ma, Tiancai Wang, Gang Yu, Xiangyu Zhang, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) StepFun Dexmal MEGVII Technology(MEGVII科技)

专题命中 可控生成 :image generation(title);分类 cs.CV

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22010 2025-10-28 cs.CV cs.LG eess.IV 70%

FlowOpt: Fast Optimization Through Whole Flow Processes for Training-Free Editing

Or Ronai, Vladimir Kulikov, Tomer Michaeli

专题命中 可控生成 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Project's webpage at https://orronai.github.io/FlowOpt/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10999 2025-10-28 cs.CV cs.AI cs.CL cs.MM 62%

ControlText: Unlocking Controllable Fonts in Multilingual Text Rendering without Font Annotations

Bowen Jiang, Yuan Yuan, Xinyi Bai, Zhuoqun Hao, Alyson Yin, Yaojie Hu, Wenyu Liao, Lyle Ungar, Camillo J. Taylor

机构 * University of Pennsylvania(宾夕法尼亚大学) Cornell University(康奈尔大学) University of California, Irvine(加州大学伊藤分校)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.MM

Comments The 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP) Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22981 2025-10-28 cs.AI cs.CV 57%

Exploring Semantic-constrained Adversarial Example with Instruction Uncertainty Reduction

Jin Hu, Jiakai Wang, Linna Jing, Haolin Li, Haodong Liu, Haotong Qin, Aishan Liu, Ke Xu, Xianglong Liu

机构 * State Key Laboratory of Complex & Critical Software Environment (CCSE), Beihang University(复杂与关键软件环境国家重点实验室,北京航空航天大学) Zhongguancun Laboratory(中关村实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Department of Information Technology and Electrical Engineering, ETH Zurich(苏黎世联邦理工学院信息科技与电气工程系)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22534 2025-10-28 cs.CV 57%

SRSR: Enhancing Semantic Accuracy in Real-World Image Super-Resolution with Spatially Re-Focused Text-Conditioning

Chen Chen, Majid Abdolshah, Violetta Shevchenko, Hongdong Li, Chang Xu, Pulak Purkait

机构 * Amazon(亚马逊公司) The University of Sydney(悉尼大学) Australian National University(澳大利亚国立大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21887 2025-10-28 cs.CV cs.AI cs.LG 57%

Generative AI in Depth: A Survey of Recent Advances, Model Variants, and Real-World Applications

Shamim Yazdani, Akansha Singh, Nripsuta Saxena, Zichong Wang, Avash Palikhe, Deng Pan, Umapada Pal, Jie Yang, Wenbin Zhang

机构 * Florida International University(佛罗里达国际大学) Manipal Institute of Technology(曼海姆技术学院) University of Southern California(南加州大学) Indian Statistical Institute(印度统计研究所) University of Wollongong(沃林根大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by the Journal of Big Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12650 2025-10-28 cs.LG cs.AI 50%

Score-informed Neural Operator for Enhancing Ordering-based Causal Discovery

Jiyeon Kang, Songseong Kim, Chanhui Lee, Doyeong Hwang, Joanie Hayoun Chung, Yunkyung Ko, Sumin Lee, Sungwoong Kim, Sungbin Lim

专题命中 可控生成 :diffusion(abstract)

Comments Accepted to NeurIPS 2025. 36 pages, 18 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏