arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-03 至 2025-09-03 共收录 10 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 10 篇

2509.01107 2025-09-03 cs.CV 79%

FICGen: Frequency-Inspired Contextual Disentanglement for Layout-driven Degraded Image Generation

Wenzhuang Wang, Yifan Zhao, Mingcan Ma, Ming Liu, Zhonglin Jiang, Yong Chen, Jia Li

机构 * State Key Laboratory of Virtual Reality Technology and Systems, SCSE&QRI, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学) Geely Automobile Research Institute (Ningbo) Co., Ltd(吉利汽车研究院(宁波)有限公司)

专题命中 可控生成 :image generation(title);diffusion(abstract);分类 cs.CV

Comments 21 pages, 19 figures, ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00428 2025-09-03 cs.CV 79%

Mixture of Global and Local Experts with Diffusion Transformer for Controllable Face Generation

Xuechao Zou, Shun Zhang, Xing Fu, Yue Li, Kai Li, Yushe Cao, Congyan Lang, Pin Tao, Junliang Xing

机构 * Beijing Jiaotong University(北京交通大学) Ant Group(蚂蚁集团) Qinghai University(青海大学) Tsinghua University(清华大学)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

Comments 14 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01405 2025-09-03 cs.CV 77%

Neural Scene Designer: Self-Styled Semantic Image Manipulation

Jianman Lin, Tianshui Chen, Chunmei Qing, Zhijing Yang, Shuangping Huang, Yuheng Ren, Liang Lin

机构 * South China University of Technology(南方科技大学) Guangdong University of Technology(广东工业大学) Jimei University(集美大学) Xiamen Kunlu AI Research Institute(厦门鲲 lun AI 研究院) Sun Yat-sen University(中山大学)

专题命中 可控生成 :diffusion(abstract);image editing(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00541 2025-09-03 cs.GR cs.AI cs.CV 73%

LatentEdit: Adaptive Latent Control for Consistent Semantic Editing

Siyi Liu, Weiming Chen, Yushun Tang, Zhihai He

机构 * Southern University of Science and Technology, China(南方科技大学,中国) Pengcheng Laboratory, China(鹏城实验室,中国)

专题命中 可控生成 :diffusion(abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments Accepted by PRCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02278 2025-09-03 cs.GR cs.AI cs.MM 62%

Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation

Zikai Huang, Yihan Zhou, Xuemiao Xu, Cheng Xu, Xiaofen Xing, Jing Qin, Shengfeng He

机构 * School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) South China University of Technology(华南理工大学) Guangdong Engineering Center for Large Model and GenAI Technology(广东省大模型与生成式人工智能技术工程中心) Guangdong Provincial Key Lab of Computational Intelligence and Cyberspace Information(广东省计算智能与网络信息重点实验室) Centre for Smart Health, Hong Kong Polytechnic University(香港理工大学智能健康研究中心) CAS-Hong Kong Joint Laboratory for Multimodal Medical Molecular Imaging(中国科学院-香港联合多模态医学分子成像联合实验室) School of Electronic and Information Engineering, South China University of Technology(华南理工大学电子与信息学院) Pazhou Lab, Guangzhou, Guangdong, China(广州琶洲实验室) School of Computing and Information Systems, Singapore Management University(新加坡国立大学计算机与信息系统学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.GR、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09012 2025-09-03 cs.CV cs.AI cs.CL cs.MM 62%

Multimodal LLMs Can Reason about Aesthetics in Zero-Shot

Ruixiang Jiang, Changwen Chen

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 可控生成 :image generation(abstract);分类 cs.CV、cs.MM

Comments ACM MM 2025 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01596 2025-09-03 cs.CV cs.AI 57%

O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing

Yuqing Chen, Junjie Wang, Lin Liu, Ruihang Chu, Xiaopeng Zhang, Qi Tian, Yujiu Yang

机构 * Tsinghua University(清华大学) Huawei Inc.(华为公司) Pengcheng National Laboratory(Pengcheng国家实验室)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11156 2025-09-03 astro-ph.EP astro-ph.SR 50%

Hydrodynamical simulations of the vertical shear instability with dynamic dust and cooling rates in protoplanetary disks

Yuya Fukuhara, Mario Flock, Satoshi Okuzumi, Ryosuke T. Tominaga

专题命中 可控生成 :diffusion(abstract)

Comments 16 pages, 20 figures, 1 table, Accepted for publication in Astronomy & Astrophysics (A&A)

Journal ref A&A 701, A72 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20519 2025-09-03 cs.LG cs.AI cs.RO 50%

Goal-Conditioned Data Augmentation for Offline Reinforcement Learning

Xingshuai Huang, Di Wu, Benoit Boulet

机构 * McGill University(麦吉尔大学)

专题命中 可控生成 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01262 2025-09-03 physics.optics 50%

Integrated photonic neuromorphic computing: device, architecture, chip, algorithm

Shuiying Xiang, Chengyang Yu, Yizhi Wang, Xintao Zeng, Yuna Zhang, Dianzhuang Zheng, Xinran Niu, Haowen Zhao, Hanxu Zhou, Yanan Han, Xingxing Guo, Yahui Zhang, Yue Hao

专题命中 可控生成 :image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏