arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-16 至 2025-09-16 共收录 8 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 8 篇

2403.09638 2025-09-16 cs.CV 89%

SCP-Diff: Spatial-Categorical Joint Prior for Diffusion Based Semantic Image Synthesis

Huan-ang Gao, Mingju Gao, Jiaju Li, Wenyi Li, Rong Zhi, Hao Tang, Hao Zhao

机构 * Institute for AI Industry Research (AIR), Tsinghua University University of Chinese Academy of Sciences Mercedes-Benz Group China Ltd. Peking University \& Carnegie Mellon University ,\

专题命中 可控生成 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Project Page: https://air-discover.github.io/SCP-Diff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20083 2025-09-16 cs.CV 83%

KB-DMGen: Knowledge-Based Global Guidance and Dynamic Pose Masking for Human Image Generation

Shibang Liu, Xuemei Xie, Guangming Shi

机构 * Shibang Liu Xuemei Xie Guangming Shi

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04126 2025-09-16 cs.CV cs.AI 83%

MEPG:Multi-Expert Planning and Generation for Compositionally-Rich Image Generation

Yuan Zhao, Lin Liu

专题命中 可控生成 :image generation(title);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10463 2025-09-16 cs.LG cs.CV 61%

The 1st International Workshop on Disentangled Representation Learning for Controllable Generation (DRL4Real): Methods and Results

Qiuyu Chen, Xin Jin, Yue Song, Xihui Liu, Shuai Yang, Tao Yang, Ziqiang Li, Jianguo Huang, Yuntao Wei, Ba'ao Xie, Nicu Sebe, Wenjun, Zeng, Jooyeol Yun, Davide Abati, Mohamed Omran, Jaegul Choo, Amir Habibian, Auke Wiggers, Masato Kobayashi, Ning Ding, Toru Tamaki, Marzieh Gheisari, Auguste Genovesio, Yuheng Chen, Dingkun Liu, Xinyao Yang, Xinping Xu, Baicheng Chen, Dongrui Wu, Junhao Geng, Lexiang Lv, Jianxin Lin, Hanzhe Liang, Jie Zhou, Xuanxin Chen, Jinbao Wang, Can Gao, Zhangyi Wang, Zongze Li, Bihan Wen, Yixin Gao, Xiaohan Pan, Xin Li, Zhibo Chen, Baorui Peng, Zhongming Chen, Haoran Jin

专题命中 可控生成 :diffusion(abstract,comments);分类 cs.CV

Comments Workshop summary paper for ICCV 2025, 9 accepted papers, 9 figures, IEEE conference format, covers topics including diffusion models, controllable generation, 3D-aware disentanglement, autonomous driving applications, and EEG analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11840 2025-09-16 cs.CV 57%

Synthetic Captions for Open-Vocabulary Zero-Shot Segmentation

Tim Lebailly, Vijay Veerabadran, Satwik Kottur, Karl Ridgeway, Michael Louis Iuzzolino

机构 * Meta KU Leuven(鲁汶大学)

专题命中 可控生成 :generative vision(abstract);分类 cs.CV

Comments ICCV 2025 CDEL Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19189 2025-09-16 cs.CV cs.LG 57%

An End-to-End Depth-Based Pipeline for Selfie Image Rectification

Ahmed Alhawwary, Janne Mustaniemi, Phong Nguyen-Ha, Janne Heikkilä

机构 * Center for Machine Vision and Signal Analysis (CMVS), University of Oulu(机器视觉与信号分析中心(CMVS)、奥卢大学) Qualcomm AI Research(高通人工智能研究)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted at IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02353 2025-09-16 cs.CV cs.AI cs.LG 57%

Semantic Augmentation in Images using Language

Sahiti Yerramilli, Jayant Sravan Tamarapalli, Tanmay Girish Kulkarni, Jonathan Francis, Eric Nyberg

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10466 2025-09-16 cs.CV cs.HC 57%

A Real-Time Diminished Reality Approach to Privacy in MR Collaboration

Christian Fane

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments 50 pages, 12 figures | Demo video: https://youtu.be/udBxj35GEKI?t=499 | Code: https://github.com/c1h1r1i1s1 (multiple repositories)

详情

展开后加载摘要…

URL PDF HTML 收藏