arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-23 至 2025-09-23 共收录 69 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69 篇

2509.18096 2025-09-23 cs.CV 89%

Seg4Diff: Unveiling Open-Vocabulary Segmentation in Text-to-Image Diffusion Transformers

Chaehyun Kim, Heeseong Shin, Eunbeen Hong, Heeji Yoon, Anurag Arnab, Paul Hongsuck Seo, Sunghwan Hong, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能研究所) Korea University(韩国大学) ETH Zürich(苏黎世联邦理工学院)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments NeurIPS 2025. Project page: https://cvlab-kaist.github.io/Seg4Diff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16342 2025-09-23 eess.AS cs.LG cs.SD 88%

Similarity-Guided Diffusion for Long-Gap Music Inpainting

Sean Turland, Eloi Moliner, Vesa Välimäki

机构 * Acoustics Lab, Dept. Information(信息学院声学实验室) Communications Engineering, Aalto University, Espoo, Finland(通讯工程,阿alto大学,埃斯波,芬兰)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract)

Comments 5 pages, 2 figures. Submitted to IEEE ICASSP 2026. Audio examples and supplementary material are available at: https://s-turland.github.io/SimDPS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11196 2025-09-23 cs.CV 85%

DiCo: Revitalizing ConvNets for Scalable and Efficient Diffusion Modeling

Yuang Ai, Qihang Fan, Xuefeng Hu, Zhenheng Yang, Ran He, Huaibo Huang

机构 * CASIA(中国科学院自动化研究所) UCAS(中国科学技术大学) ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments NeurIPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13499 2025-09-23 cs.CV 85%

U-Shape Mamba: State Space Model for faster diffusion

Alex Ergasti, Filippo Botti, Tomaso Fontanini, Claudio Ferrari, Massimo Bertozzi, Andrea Prati

机构 * University of Parma(帕尔马大学) University of Siena(锡耶纳大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted at CVPR 2025 eLVM workshop. The code is here: https://github.com/ErgastiAlex/U-Shape-Mamba

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16131 2025-09-23 cs.LG cs.CV 83%

Dynamic Classifier-Free Diffusion Guidance via Online Feedback

Pinelopi Papalampidi, Olivia Wiles, Ira Ktena, Aleksandar Shtedritski, Emanuele Bugliarello, Ivana Kajic, Isabela Albuquerque, Aida Nematzadeh

机构 * Google DeepMind(谷歌DeepMind) Ellison Institute of Technology(埃利森技术研究所) University of Oxford(牛津大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02363 2025-09-23 cs.CV 83%

Optimal Transport for Rectified Flow Image Editing: Unifying Inversion-Based and Direct Methods

Marian Lupascu, Mihai-Sorin Stupariu

机构 * Department of Computer Science, University of Bucharest(计算机科学系,布加勒斯特大学)

专题命中 扩散模型 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments 27 pages, 26 figures, WACV conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12974 2025-09-23 cs.CV 83%

Attentive Eraser: Unleashing Diffusion Model's Object Removal Potential via Self-Attention Redirection Guidance

Wenhao Sun, Benlei Cui, Xue-Mei Dong, Jingqun Tang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by AAAI 2025(Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17250 2025-09-23 cs.LG eess.SP 82%

Graph Signal Generative Diffusion Models

Yigit Berkay Uslu, Samar Hadou, Sergio Rozada, Shirin Saeedi Bidokhti, Alejandro Ribeiro

机构 * Dept. of Electrical and Systems Engineering, University of Pennsylvania, Philadelphia, PA, USA(电气与系统工程系,宾夕法尼亚大学) Dept. of Signal Processing and Communications, King Juan Carlos University, Madrid, Spain(信号处理与通信系,国王胡安·卡洛斯大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

Comments Submitted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17985 2025-09-23 cs.GR 79%

VideoFrom3D: 3D Scene Video Generation via Complementary Image and Video Diffusion Models

Geonung Kim, Janghyeok Han, Sunghyun Cho

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

Comments Project page: https://kimgeonung.github.io/VideoFrom3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17941 2025-09-23 cs.RO cs.AI cs.CV cs.LG 79%

ComposableNav: Instruction-Following Navigation in Dynamic Environments via Composable Diffusion

Zichao Hu, Chen Tang, Michael J. Munje, Yifeng Zhu, Alex Liu, Shuijing Liu, Garrett Warnell, Peter Stone, Joydeep Biswas

机构 * Department of Computer Science, The University of Texas at Austin(德克萨斯大学计算机科学系) Army Research Laboratory(陆军研究实验室) Sony AI(索尼人工智能)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Conference on Robot Learning (CoRL) 2025 Project site: https://amrl.cs.utexas.edu/ComposableNav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17684 2025-09-23 cs.CV cs.RO 79%

DINOv3-Diffusion Policy: Self-Supervised Large Visual Model for Visuomotor Diffusion Policy Learning

ThankGod Egbe, Peng Wang, Zhihao Guo, Zidong Chen

机构 * Department of Computing and Mathematics, Manchester Metropolitan University(计算与数学系,曼彻斯特 Metropolitan 大学) Department of Computing, Imperial College London(计算系,帝国理工学院伦敦分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17627 2025-09-23 cs.CV 79%

OmniInsert: Mask-Free Video Insertion of Any Reference via Diffusion Transformer Models

Jinshu Chen, Xinghui Li, Xu Bai, Tianxiang Ma, Pengze Zhang, Zhuowei Chen, Gen Li, Lijie Liu, Songtao Zhao, Bingchuan Li, Qian He

机构 * Intelligent Creation Lab, ByteDance(字节跳动智能创作实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Github Page: https://phantom-video.github.io/OmniInsert/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17397 2025-09-23 cs.CV cs.ET 79%

Diff-GNSS: Diffusion-based Pseudorange Error Estimation

Jiaqi Zhu, Shouyi Lu, Ziyao Li, Guirong Zhuo, Lu Xiong

机构 * School of Automotive Studies, Tongji University(同济大学汽车学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17232 2025-09-23 cs.CV 79%

DT-NeRF: A Diffusion and Transformer-Based Optimization Approach for Neural Radiance Fields in 3D Reconstruction

Bo Liu, Runlong Li, Li Zhou, Yan Zhou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17206 2025-09-23 cs.CV cs.AI cs.LG 79%

Guided and Unguided Conditional Diffusion Mechanisms for Structured and Semantically-Aware 3D Point Cloud Generation

Gunner Stone, Sushmita Sarker, Alireza Tavakkoli

机构 * Department of Computer Science Engineering, University of Nevada, Reno, USA

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17024 2025-09-23 cs.CV cs.AI 79%

When Color-Space Decoupling Meets Diffusion for Adverse-Weather Image Restoration

Wenxuan Fang, Jili Fan, Chao Wang, Xiantao Hu, Jiangwei Weng, Ying Tai, Jian Yang, Jun Li

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(计算机科学与工程学院,南京理工大学) School of Electrical Engineering, Southeast University(电气工程学院,东南大学) School of Intelligence Science and Technology, Nanjing University(智能科学与技术学院,南京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16897 2025-09-23 cs.CV 79%

PRISM: Precision-Recall Informed Data-Free Knowledge Distillation via Generative Diffusion

Xuewan He, Jielei Wang, Zihan Cheng, Yuchen Su, Shiyue Huang, Guoming Lu

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13797 2025-09-23 cs.CV 79%

DynFaceRestore: Balancing Fidelity and Quality in Diffusion-Guided Blind Face Restoration with Dynamic Blur-Level Mapping and Guidance

Huu-Phu Do, Yu-Wei Chen, Yi-Cheng Liao, Chi-Wei Hsiao, Han-Yang Wang, Wei-Chen Chiu, Ching-Chun Huang

机构 * National Yang Ming Chiao Tung University(国家阳明交通大学) MediaTek Inc.(联发科技)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16572 2025-09-23 eess.IV cs.CV 79%

Single-step Diffusion for Image Compression at Ultra-Low Bitrates

Chanung Park, Joo Chan Lee, Jong Hwan Ko

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21476 2025-09-23 cs.CV cs.AI 79%

GarmentDiffusion: 3D Garment Sewing Pattern Generation with Multimodal Diffusion Transformers

Xinyu Li, Qi Yao, Yuanda Wang

机构 * Shenfu Research(沈孚研究所) Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments The 34th International Joint Conference on Artificial Intelligence (IJCAI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09419 2025-09-23 cs.CV 79%

Alias-Free Latent Diffusion Models: Improving Fractional Shift Equivariance of Diffusion Latent Space

Yifan Zhou, Zeqi Xiao, Shuai Yang, Xingang Pan

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室) Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Code is available at: https://github.com/SingleZombie/AFLDM

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16507 2025-09-23 cs.CV 79%

OS-DiffVSR: Towards One-step Latent Diffusion Model for High-detailed Real-world Video Super-Resolution

Hanting Li, Huaao Tang, Jianhong Han, Tianxiong Zhou, Jiulong Cui, Haizhen Xie, Yan Chen, Jie Hu

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16429 2025-09-23 cs.CV 79%

TractoTransformer: Diffusion MRI Streamline Tractography using CNN and Transformer Networks

Itzik Waizman, Yakov Gusakov, Itay Benou, Tammy Riklin Raviv

机构 * Ben-Gurion University of the Negev(本· Gurion 军事大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16238 2025-09-23 q-bio.NC cs.GR 79%

Evolvable Graph Diffusion Optimal Transport with Pattern-Specific Alignment for Brain Connectome Modeling

Xiaoqi Sheng, Jiawen Liu, Jiaming Liang, Yiheng Zhang, Hongmin Cai

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15124 2025-09-23 cs.LG cs.CV 79%

Side Effects of Erasing Concepts from Diffusion Models

Shaswati Saha, Sourajit Saha, Manas Gaur, Tejas Gokhale

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩分校)

专题命中 扩散模型 :diffusion(title);text-to-image(abstract);分类 cs.CV

Comments Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18045 2025-09-23 math.PR 78%

Density convergence on Markov diffusion chaos via Stein's method

Thanh Dang, Yaozhong Hu

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17850 2025-09-23 cs.RO 78%

SocialTraj: Two-Stage Socially-Aware Trajectory Prediction for Autonomous Driving via Conditional Diffusion Model

Xiao Zhou, Zengqi Peng, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17793 2025-09-23 math.NA cs.NA 78%

Solving time-fractional diffusion equations with Robin boundary conditions via fractional Hamiltonian boundary value methods

Qian Luo, Aiguo Xiao, Xiaoqiang Yan, Jingmin Xia

专题命中 扩散模型 :diffusion(title,abstract)

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01939 2025-09-23 cs.RO cs.SY eess.SY 78%

Equality Constrained Diffusion for Direct Trajectory Optimization

Vince Kurtz, Joel W. Burdick

机构 * Department of Civil and Mechanical Engineering, California Institute of Technology(土木与机械工程系,加州理工学院)

专题命中 扩散模型 :diffusion(title,abstract)

Comments ACC 2025, fixed typo in equations (11)-(12)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17324 2025-09-23 cs.ET cs.LG quant-ph 78%

DiffQ: Unified Parameter Initialization for Variational Quantum Algorithms via Diffusion Models

Chi Zhang, Mengxin Zheng, Qian Lou, Fan Chen

机构 * University of Central Florida, FL, USA(佛罗里达中央大学) Indiana University, Bloomington, IN, USA(印第安纳大学)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏