arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-08-12 至 2025-08-12 共收录 8 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 8 篇

2408.13623 2025-08-12 cs.CV 85%

Prompt-Softbox-Prompt: A Free-Text Embedding Control for Image Editing

Yitong Yang, Yinglin Wang, Tian Zhang, Jing Wang, Shuting He

机构 * Shanghai University of Finance and Economics(上海财经大学) School of Computing and Artificial Intelligence(计算机与人工智能学院) MoE Key Laboratory of Interdisciplinary Research of Computation and Economics(交叉计算与经济学联合实验室)

专题命中 可控生成 :image editing(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07647 2025-08-12 cs.CV 83%

LaRender: Training-Free Occlusion Control in Image Generation via Latent Rendering

Xiaohang Zhan, Dingming Liu

机构 * Tencent(腾讯)

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by ICCV 2025 (oral). Project page: https://xiaohangzhan.github.io/projects/larender/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07246 2025-08-12 cs.CV 79%

Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers

Xin Ma, Yaohui Wang, Genyun Jia, Xinyuan Chen, Tien-Tsin Wong, Cunjian Chen

机构 * Department of Data Science & AI, Faculty of Information Technology, Monash University(数据科学与人工智能系,信息科技学院,墨尔本大学) Nanjing University of Posts and Telecommunications(南京邮电大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

Comments Project Page: https://maxin-cn.github.io/miramo_project

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23186 2025-08-12 cs.CV 79%

HiGarment: Cross-modal Harmony Based Diffusion Model for Flat Sketch to Realistic Garment Image

Junyi Guo, Jingxuan Zhang, Fangyu Wu, Huanda Lu, Qiufeng Wang, Wenmian Yang, Eng Gee Lim, Dongming Lu

机构 * Xi’an Jiaotong Liverpool University(西安交通大学利物浦大学) NingboTech University(宁波科技学院) Beijing Normal University(北京师范大学) Zhejiang University(浙江大学)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07135 2025-08-12 cs.HC 78%

Canvas3D: Empowering Precise Spatial Control for Image Generation with Constraints from a 3D Virtual Canvas

Runlin Duan, Yuzhao Chen, Rahul Jain, Yichen Hu, Jingyu Shi, Karthik Ramani

专题命中 可控生成 :image generation(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06551 2025-08-12 cs.CV 70%

Slice or the Whole Pie? Utility Control for AI Models

Ye Tao

机构 * Ye Tao

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08086 2025-08-12 cs.CV cs.GR 62%

Matrix-3D: Omnidirectional Explorable 3D World Generation

Zhongqi Yang, Wenhang Ge, Yuqi Li, Jiaqi Chen, Haoyuan Li, Mengyin An, Fei Kang, Hua Xue, Baixin Xu, Yuyang Yin, Eric Li, Yang Liu, Yikai Wang, Hao-Xiang Guo, Yahui Zhou

机构 * Skywork AI Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16868 2025-08-12 cs.IT cs.AI cs.CV math.IT 57%

Codebook-enabled Generative End-to-end Semantic Communication Powered by Transformer

Peigen Ye, Yaping Sun, Shumin Yao, Hao Chen, Xiaodong Xu, Shuguang Cui

机构 * The Shenzhen Campus of Sun Yat-sen University, Sun Yat-sen University, Shenzhen, China(中山大学深圳校区,中山大学,深圳,中国) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室,深圳,中国) SSE, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学深圳校区,香港中文大学,深圳,中国) Beijing University of Posts(北京邮电大学)

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments IEEE INFOCOM PerAI6G 2024(accepted)

详情

展开后加载摘要…

URL PDF HTML 收藏