arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-03 至 2025-09-03 共收录 120 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 10 篇

2509.01405 2025-09-03 cs.CV 77%

Neural Scene Designer: Self-Styled Semantic Image Manipulation

Jianman Lin, Tianshui Chen, Chunmei Qing, Zhijing Yang, Shuangping Huang, Yuheng Ren, Liang Lin

机构 * South China University of Technology(南方科技大学) Guangdong University of Technology(广东工业大学) Jimei University(集美大学) Xiamen Kunlu AI Research Institute(厦门鲲 lun AI 研究院) Sun Yat-sen University(中山大学)

专题命中 可控生成 :diffusion(abstract);image editing(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00541 2025-09-03 cs.GR cs.AI cs.CV 73%

LatentEdit: Adaptive Latent Control for Consistent Semantic Editing

Siyi Liu, Weiming Chen, Yushun Tang, Zhihai He

机构 * Southern University of Science and Technology, China(南方科技大学,中国) Pengcheng Laboratory, China(鹏城实验室,中国)

专题命中 可控生成 :diffusion(abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments Accepted by PRCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02278 2025-09-03 cs.GR cs.AI cs.MM 62%

Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation

Zikai Huang, Yihan Zhou, Xuemiao Xu, Cheng Xu, Xiaofen Xing, Jing Qin, Shengfeng He

机构 * School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) South China University of Technology(华南理工大学) Guangdong Engineering Center for Large Model and GenAI Technology(广东省大模型与生成式人工智能技术工程中心) Guangdong Provincial Key Lab of Computational Intelligence and Cyberspace Information(广东省计算智能与网络信息重点实验室) Centre for Smart Health, Hong Kong Polytechnic University(香港理工大学智能健康研究中心) CAS-Hong Kong Joint Laboratory for Multimodal Medical Molecular Imaging(中国科学院-香港联合多模态医学分子成像联合实验室) School of Electronic and Information Engineering, South China University of Technology(华南理工大学电子与信息学院) Pazhou Lab, Guangzhou, Guangdong, China(广州琶洲实验室) School of Computing and Information Systems, Singapore Management University(新加坡国立大学计算机与信息系统学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.GR、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09012 2025-09-03 cs.CV cs.AI cs.CL cs.MM 62%

Multimodal LLMs Can Reason about Aesthetics in Zero-Shot

Ruixiang Jiang, Changwen Chen

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 可控生成 :image generation(abstract);分类 cs.CV、cs.MM

Comments ACM MM 2025 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01596 2025-09-03 cs.CV cs.AI 57%

O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing

Yuqing Chen, Junjie Wang, Lin Liu, Ruihang Chu, Xiaopeng Zhang, Qi Tian, Yujiu Yang

机构 * Tsinghua University(清华大学) Huawei Inc.(华为公司) Pengcheng National Laboratory(Pengcheng国家实验室)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11156 2025-09-03 astro-ph.EP astro-ph.SR 50%

Hydrodynamical simulations of the vertical shear instability with dynamic dust and cooling rates in protoplanetary disks

Yuya Fukuhara, Mario Flock, Satoshi Okuzumi, Ryosuke T. Tominaga

专题命中 可控生成 :diffusion(abstract)

Comments 16 pages, 20 figures, 1 table, Accepted for publication in Astronomy & Astrophysics (A&A)

Journal ref A&A 701, A72 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20519 2025-09-03 cs.LG cs.AI cs.RO 50%

Goal-Conditioned Data Augmentation for Offline Reinforcement Learning

Xingshuai Huang, Di Wu, Benoit Boulet

机构 * McGill University(麦吉尔大学)

专题命中 可控生成 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01262 2025-09-03 physics.optics 50%

Integrated photonic neuromorphic computing: device, architecture, chip, algorithm

Shuiying Xiang, Chengyang Yu, Yizhi Wang, Xintao Zeng, Yuna Zhang, Dianzhuang Zheng, Xinran Niu, Haowen Zhao, Hanxu Zhou, Yanan Han, Xingxing Guo, Yahui Zhang, Yue Hao

专题命中 可控生成 :image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像修复 4 篇

2509.01964 2025-09-03 cs.CV cs.AI 79%

2D Gaussian Splatting with Semantic Alignment for Image Inpainting

Hongyu Li, Chaofeng Chen, Xiaoming Li, Guangming Lu

专题命中 图像修复 :inpainting(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00396 2025-09-03 cs.CV cs.AI 79%

DAOVI: Distortion-Aware Omnidirectional Video Inpainting

Ryosuke Seshimo, Mariko Isogawa

机构 * Keio University(Keio大学)

专题命中 图像修复 :inpainting(title,abstract);分类 cs.CV

Comments BMVC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01898 2025-09-03 cs.CV 57%

DroneSR: Rethinking Few-shot Thermal Image Super-Resolution from Drone-based Perspective

Zhipeng Weng, Xiaopeng Liu, Ce Liu, Xingyuan Guo, Yukai Shi, Liang Lin

机构 * School of Information Engineering, Guangdong University of Technology(广东工业大学信息工程学院) Guangdong Power Grid, Ltd.(广东电网有限公司) School of Computer Science, Sun Yat-sen University(中山大学计算机学院)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01071 2025-09-03 cs.CV 57%

A Unified Low-level Foundation Model for Enhancing Pathology Image Quality

Ziyi Liu, Zhe Xu, Jiabo Ma, Wenqaing Li, Junlin Hou, Fuxiang Huang, Xi Wang, Ronald Cheong Kin Chan, Terence Tsz Wai Wong, Hao Chen

机构 * Department of Computer Science Engineering, The Hong Kong University of Science and Technology(计算机科学与工程系,香港科技大学) Department of Anatomical and Cellular Pathology, The Chinese University of Hong Kong(解剖学与细胞病理学系,香港中文大学) Department of Chemical and Biological Engineering, Hong Kong University of Science and Technology(化学与生物工程系,香港科技大学) Division of Life Science, Hong Kong University of Science and Technology(生命科学系,香港科技大学) HKUST Shenzhen-Hong Kong Collaborative Innovation Research Institute(香港科技大学深圳-香港协同创新研究院)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 6 篇

2509.01181 2025-09-03 cs.CV cs.AI 85%

FocusDPO: Dynamic Preference Optimization for Multi-Subject Personalized Image Generation via Adaptive Focus

Qiaoqiao Jin, Siming Fu, Dong She, Weinan Jia, Hualiang Wang, Mu Liu, Jidong Jiang

机构 * ByteDance FanQie(字节跳动FanQie)

专题命中 个性化与一致性 :image generation(title,abstract);image synthesis(abstract);personalized generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01977 2025-09-03 cs.CV 79%

MOSAIC: Multi-Subject Personalized Generation via Correspondence-Aware Alignment and Disentanglement

Dong She, Siming Fu, Mushui Liu, Qiaoqiao Jin, Hualiang Wang, Mu Liu, Jidong Jiang

机构 * Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 个性化与一致性 :personalized generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06397 2025-09-03 cs.CV 70%

Removing Averaging: Personalized Lip-Sync Driven Characters Based on Identity Adapter

Yanyu Zhu, Lichen Bai, Jintao Xu, Hai-tao Zheng

机构 * Shenzhen International Graduate School, Tsinghua Universiy(清华大学深圳国际研究生院) Tencent(腾讯) Seoul National University(首尔国立大学)

专题命中 个性化与一致性 :diffusion(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01362 2025-09-03 cs.CV cs.MM 62%

Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement

Jiayi Gao, Changcheng Hua, Qingchao Chen, Yuxin Peng, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01492 2025-09-03 cs.CV 57%

A Continuous-Time Consistency Model for 3D Point Cloud Generation

Sebastian Eilermann, René Heesch, Oliver Niggemann

机构 * Institute for Artificial Intelligence(人工智能研究所) Helmut Schmidt University(海姆特·施密特大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01819 2025-09-03 cs.RO 50%

ManiFlow: A General Robot Manipulation Policy via Consistency Flow Training

Ge Yan, Jiyue Zhu, Yuquan Deng, Shiqi Yang, Ri-Zhao Qiu, Xuxin Cheng, Marius Memmel, Ranjay Krishna, Ankit Goyal, Xiaolong Wang, Dieter Fox

机构 * University of Washington(华盛顿大学) UC San Diego(圣地亚哥大学) Nvidia(英伟达)

专题命中 个性化与一致性 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 4 篇

2509.02474 2025-09-03 cs.GR cs.CV cs.LG 62%

Unifi3D: A Study on 3D Representations for Generation and Reconstruction in a Common Framework

Nina Wiedemann, Sainan Liu, Quentin Leboutet, Katelyn Gao, Benjamin Ummenhofer, Michael Paulitsch, Kai Yuan

机构 * Intel Corporation(英特尔公司)

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00777 2025-09-03 cs.GR cs.CV 62%

IntrinsicReal: Adapting IntrinsicAnything from Synthetic to Real Objects

Xiaokang Wei, Zizheng Yan, Zhangyang Xiong, Yiming Hao, Yipeng Qin, Xiaoguang Han

机构 * The Hong Kong Polytechnic University(香港理工大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Cardiff University(卡迪夫大学) NanJing XiaoZhuang University(南京小庄大学)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01411 2025-09-03 cs.CV 57%

MILO: A Lightweight Perceptual Quality Metric for Image and Latent-Space Optimization

Uğur Çoğalan, Mojtaba Bemana, Karol Myszkowski, Hans-Peter Seidel, Colin Groth

机构 * Max Planck Institute for Informatics(马克斯·普朗克研究所(信息研究所))

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00381 2025-09-03 cs.CV cs.HC 57%

Visually Grounded Narratives: Reducing Cognitive Burden in Researcher-Participant Interaction

Runtong Wu, Jiayao Song, Fei Teng, Xianhao Ren, Yuyan Gao, Kailun Yang

机构 * School of Mathematics, Hunan University(湖南大学数学学院) School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) International Business School, Henan University of Economics and Law(河南财经政法大学国际商学院) Science & Technology College, University of Lorraine(洛林大学科学技术学院)

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 7 篇

2503.16375 2025-09-03 cs.CV 70%

NuiScene: Exploring Efficient Generation of Unbounded Outdoor Scenes

Han-Hung Lee, Qinghong Han, Angel X. Chang

机构 * Simon Fraser University(西蒙弗雷泽大学)

专题命中 效率与蒸馏 :diffusion(abstract);inpainting(abstract);分类 cs.CV

Comments Project Page: \url{https://3dlg-hcvc.github.io/NuiScene/}

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02069 2025-09-03 cs.LG q-bio.QM 50%

Data-Dependent Smoothing for Protein Discovery with Walk-Jump Sampling

Srinivas Anumasa, Barath Chandran. C, Tingting Chen, Dianbo Liu

机构 * National University of Singapore(新加坡国立大学) Indian Institute of Technology, Roorkee(印度理工学院罗尔克学院)

专题命中 效率与蒸馏 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01942 2025-09-03 stat.AP gr-qc 50%

Efficient Bayesian Sampling with Langevin Birth-Death Dynamics

Alex Leviyev, Francesco Iacovelli, Aaron Zimmerman

专题命中 效率与蒸馏 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01679 2025-09-03 cs.LG cs.NA math.NA stat.ML 50%

Efficient Transformer-Inspired Variants of Physics-Informed Deep Operator Networks

Zhi-Feng Wei, Wenqian Chen, Panos Stinis

机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室) University of Washington(华盛顿大学) Brown University(布朗大学)

专题命中 效率与蒸馏 :diffusion(abstract)

Comments Code will be released upon acceptance

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01575 2025-09-03 math.NA cs.NA 50%

An efficient spline-based scheme on Shishkin-type meshes for solving singularly perturbed coupled systems with Robin boundary conditions

Kousalya Ramanujam, Vembu Shanthi

专题命中 效率与蒸馏 :diffusion(abstract)

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15530 2025-09-03 physics.comp-ph cond-mat.mtrl-sci 50%

Accurate and efficient machine learning interatomic potentials for finite temperature modeling of molecular crystals

Flaviano Della Pia, Benjamin X. Shi, Venkat Kapil, Andrea Zen, Dario Alfè, Angelos Michaelides

专题命中 效率与蒸馏 :diffusion(abstract)

Comments Updated figure 1 with corrected energy errors

Journal ref Chem. Sci., 16, 11419-11433 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10690 2025-09-03 cs.LG 50%

Sampling, Diffusions, and Stochastic Localization

Andrea Montanari

机构 * Department of Statistics and Department of Mathematics, Stanford University(统计学系和数学系,斯坦福大学) Granica Computing Inc(Granica计算公司)

专题命中 效率与蒸馏 :diffusion(abstract)

Comments 38 pages, 5 pdf figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他图像生成 1 篇

2503.23149 2025-09-03 eess.IV 50%

Towards Interpretable Counterfactual Generation via Multimodal Autoregression

Chenglong Ma, Yuanfeng Ji, Jin Ye, Lu Zhang, Ying Chen, Tianbin Li, Mingjie Li, Junjun He, Hongming Shan

专题命中 其他图像生成 :image generation(abstract)

Comments MICCAI'25

详情

展开后加载摘要…

URL PDF HTML 收藏