arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-09-30 至 2025-09-30 共收录 120 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 120 篇

2509.24875 2025-09-30 cs.CV cs.LG 88%

Environment-Aware Satellite Image Generation with Diffusion Models

Nikos Kostagiolas, Pantelis Georgiades, Yannis Panagakis, Mihalis A. Nicolaou

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09622 2025-09-30 cs.CV 85%

LoRACLR: Contrastive Adaptation for Customization of Diffusion Models

Enis Simsar, Thomas Hofmann, Federico Tombari, Pinar Yanardag

机构 * ETH Zürich(苏黎世联邦理工学院) TU Munich(慕尼黑技术大学) Google(谷歌) Virginia Tech(弗吉尼亚理工大学)

专题命中 扩散模型 :diffusion(title);image generation(abstract);text-to-image(abstract);image synthesis(abstract)

Comments Accepted to CVPR'25. Project page: https://loraclr.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24369 2025-09-30 cs.CV cs.AI cs.MM 84%

From Satellite to Street: A Hybrid Framework Integrating Stable Diffusion and PanoGAN for Consistent Cross-View Synthesis

Khawlah Bajbaa, Abbas Anwar, Muhammad Saqib, Hafeez Anwar, Nabin Sharma, Muhammad Usman

机构 * Department of Information and Computer Science, King Fahd University of Petroleum and Minerals(信息与计算机科学系,国王法赫德石油与矿物大学) NCMI, CSIRO(CSIRO国家科学机构) Department of Computer Science, National University of Computer and Emerging Sciences (FAST-NUCES)(计算机科学系,国家计算机与新兴科学大学(FAST-NUCES)) Faculty of Engineering and IT, University of Technology Sydney(工程与信息技术学院,技术大学悉尼) Faculty of Science, University of Ontario Institute of Technology(科学学院, Ontario Institute of Technology大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.00796 2025-09-30 cs.LG cs.AI cs.CV 84%

Diffusion Models: A Comprehensive Survey of Methods and Applications

Ling Yang, Zhilong Zhang, Yang Song, Shenda Hong, Runsheng Xu, Yue Zhao, Wentao Zhang, Bin Cui, Ming-Hsuan Yang

机构 * Peking University(北京大学) OpenAI University of California, Los Angeles(加州大学洛杉矶分校) Carnegie Mellon University(卡内基梅隆大学) University of California at Merced(加州大学默塞德分校)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments 59 pages, 19 figures, citing 396 (up-to-date) papers, project: https://github.com/YangLing0818/Diffusion-Models-Papers-Survey-Taxonomy, accepted by ACM Computing Surveys

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24128 2025-09-30 cs.CV 83%

GANji: A Framework for Introductory AI Image Generation

Chandon Hamel, Mike Busch

机构 * Anderson College of Business and Computing(安德森商学院与计算学院) Regis University(雷吉大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07936 2025-09-30 cs.CV eess.IV 83%

Feature Space Analysis by Guided Diffusion Model

Kimiaki Shirahama, Miki Yanobu, Kaduki Yamashita, Miho Ohsaki

机构 * Department of Information Systems Design, Doshisha University(信息系统设计系,多智大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 37 pages, 13 figures, codes: https://github.com/KimiakiShirahama/FeatureSpaceAnalysisByGuidedDiffusionModel

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17324 2025-09-30 cs.LG cs.CV 83%

Origins of Creativity in Attention-Based Diffusion Models

Emma Finn, T. Anderson Keller, Manos Theodosis, Demba E. Ba

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22376 2025-09-30 cs.LG cs.AI cs.CL cs.CV 83%

Rare-to-Frequent: Unlocking Compositional Generation Power of Diffusion Models on Rare Concepts with LLM Guidance

Dongmin Park, Sebin Kim, Taehong Moon, Minkyu Kim, Kangwook Lee, Jaewoong Cho

机构 * KRAFTON Seoul National University(首尔国立大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments ICLR 2025 (spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23605 2025-09-30 cs.CV 83%

VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis

Zeren Xiong, Yue Yu, Zedong Zhang, Shuo Chen, Jian Yang, Jun Li

机构 * Nanjing University of Science and Technology(南京理工大学) Nanjing University(南京大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01467 2025-09-30 cs.CV 83%

Representation Entanglement for Generation: Training Diffusion Transformers Is Much Easier Than You Think

Ge Wu, Shen Zhang, Ruijing Shi, Shanghua Gao, Zhenyuan Chen, Lei Wang, Zhaowei Chen, Hongcheng Gao, Yao Tang, Jian Yang, Ming-Ming Cheng, Xiang Li

机构 * NKIARI, Shenzhen Futian(NKIARI,深圳福田) VCIP, CS, Nankai University(VCIP,计算机科学,南开大学) JIIOV Technology(JIIOV技术) Harvard University(哈佛大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21262 2025-09-30 cs.CL 82%

Un-Doubling Diffusion: LLM-guided Disambiguation of Homonym Duplication

Evgeny Kaskov, Elizaveta Petrova, Petr Surovtsev, Anna Kostikova, Ilya Mistiurin, Alexander Kapitanov, Alexander Nagaev

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23718 2025-09-30 cs.GR cs.CV cs.LG 81%

Diff-3DCap: Shape Captioning with Diffusion Models

Zhenyu Shu, Jiawei Wen, Shiyang Li, Shiqing Xin, Ligang Liu

机构 * School of Computer and Data Engineering, NingboTech University(宁波科技学院计算机与数据工程学院) Ningbo Institute, Zhejiang University(浙江大学宁波院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Computer Science and Technology, ShanDong University(山东大学计算机科学与技术学院) Graphics & Geometric Computing Laboratory, School of Mathematical Sciences, University of Science and Technology of China(中国科学技术大学数学科学学院图形与几何计算实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Journal ref IEEE Transactions on Visualization and Computer Graphics. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23709 2025-09-30 cs.GR cs.CV cs.LG 81%

StrucADT: Generating Structure-controlled 3D Point Clouds with Adjacency Diffusion Transformer

Zhenyu Shu, Jiajun Shen, Zhongui Chen, Xiaoguang Han, Shiqing Xin

机构 * School of Computer and Data Engineering, NingboTech University(计算机与数据工程学院,宁波科技学院) Ningbo Institute, Zhejiang University(浙江大学宁波院) School of Software Technology, Zhejiang University(浙江大学软件技术学院) School of Informatics, Xiamen University(厦门大学信息学院) Shenzhen Research Institute of Big Data, Chinese University of Hong Kong(香港中文大学深圳大数据研究院) School of Computer Science and Technology, ShanDong University(山东大学计算机科学与技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

Journal ref IEEE Transactions on Visualization and Computer Graphics. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24353 2025-09-30 cs.CV 80%

NeRV-Diffusion: Diffuse Implicit Neural Representations for Video Synthesis

Yixuan Ren, Hanyu Wang, Hao Chen, Bo He, Abhinav Shrivastava

机构 * University of Maryland, College Park(马里兰大学学院 park)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project Page: https://nerv-diffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24997 2025-09-30 cs.CV 79%

PanoWorld-X: Generating Explorable Panoramic Worlds via Sphere-Aware Video Diffusion

Yuyang Yin, HaoXiang Guo, Fangfu Liu, Mengyu Wang, Hanwen Liang, Eric Li, Yikai Wang, Xiaojie Jin, Yao Zhao, Yunchao Wei

机构 * Beijing Jiaotong University(北京交通大学) Skywork AI Tsinghua University(清华大学) University of Toronto(多伦多大学) Beijing Normal University(北京师范大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: \url{https://yuyangyin.github.io/PanoWorld-X/}

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24903 2025-09-30 cs.RO cs.CV eess.IV 79%

DRCP: Diffusion on Reinforced Cooperative Perception for Perceiving Beyond Limits

Lantao Li, Kang Yang, Rui Song, Chen Sun

机构 * Sony (China) Limited(索尼(中国)有限公司) Renmin University of China(中国人民大学) Fraunhofer IVI(弗劳恩霍夫IVI研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24580 2025-09-30 cs.LG cs.CV 79%

SAIP: A Plug-and-Play Scale-adaptive Module in Diffusion-based Inverse Problems

Lingyu Wang, Xiangming Meng

机构 * Zhejiang University(浙江大学) ZJU-UIUC Institute(浙大UIUC研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24227 2025-09-30 eess.IV cs.CV cs.LG 79%

Non-Invasive Detection of PROState Cancer with Novel Time-Dependent Diffusion MRI and AI-Enhanced Quantitative Radiological Interpretation: PROS-TD-AI

Baltasar Ramos, Cristian Garrido, Paulette Narv'aez, Santiago Gelerstein Claro, Haotian Li, Rafael Salvador, Constanza V'asquez-Venegas, Iv'an Gallegos, Yi Zhang, V'ictor Casta~neda, Cristian Acevedo, Dan Wu, Gonzalo C'ardenas, Camilo G. Sotomayor

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Study protocol preprint (not peer reviewed). Prepared with the MDPI Journal of Imaging Word author template. Primary category: eess.IV. Code and patient data are not publicly available due to privacy; requests will be considered under a data-use agreement

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24194 2025-09-30 cs.CV 79%

An Efficient 3D Latent Diffusion Model for T1-contrast Enhanced MRI Generation

Zach Eidex, Mojtaba Safari, Jie Ding, Richard Qiu, Justin Roper, David Yu, Hui-Kuo Shu, Zhen Tian, Hui Mao, Xiaofeng Yang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24185 2025-09-30 cs.CV 79%

Simulating Post-Neoadjuvant Chemotherapy Breast Cancer MRI via Diffusion Model with Prompt Tuning

Jonghun Kim, Hyunjin Park

机构 * Department of Electrical and Computer Engineering, Sungkyunkwan University, Suwon, Korea(电子与计算机工程系,成均馆大学,Suwon, Korea)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ISBI'25, 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23971 2025-09-30 cs.CV 79%

VFSI: Validity First Spatial Intelligence for Constraint-Guided Traffic Diffusion

Kargi Chauhan, Leilani H. Gilpin

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21839 2025-09-30 cs.CV cs.AI 79%

DiTraj: training-free trajectory control for video diffusion transformer

Cheng Lei, Jiayu Zhang, Yue Ma, Xinyu Wang, Long Chen, Liang Tang, Yiqiang Yan, Fei Su, Zhicheng Zhao

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Lenovo(联想) HKUST(香港科技大学) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09212 2025-09-30 cs.LG cs.CV stat.ML 79%

Warm Starts Accelerate Conditional Diffusion

Jonas Scholz, Richard E. Turner

机构 * University of Cambridge(剑桥大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17550 2025-09-30 cs.CV 79%

T2VUnlearning: A Concept Erasing Method for Text-to-Video Diffusion Models

Xiaoyu Ye, Songjie Cheng, Yongtao Wang, Yajiao Xiong, Yishen Li

机构 * Peking University(北京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10549 2025-09-30 cs.CV cs.CR 79%

Controllable Adversarial Makeup for Privacy via Text-Guided Diffusion

Youngjin Kwon, Xiao Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA信息安全研究中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23906 2025-09-30 cs.CV cs.AI 79%

EWC-Guided Diffusion Replay for Exemplar-Free Continual Learning in Medical Imaging

Anoushka Harit, William Prew, Zhongtian Sun, Florian Markowetz

机构 * University of Cambridge(剑桥大学) University of Kent(肯特大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at AI That Keeps Up: NeurIPS 2025 Workshop on Continual and Compatible Foundation Model Updates

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23723 2025-09-30 cs.CV 79%

DiffPCN: Latent Diffusion Model Based on Multi-view Depth Images for Point Cloud Completion

Zijun Li, Hongyu Yan, Shijie Li, Kunming Luo, Li Lu, Xulei Yang, Weisi Lin

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23625 2025-09-30 cs.CV cs.AI cs.CL cs.LG 79%

RIV: Recursive Introspection Mask Diffusion Vision Language Model

YuQian Li, Limeng Qiao, Lin Ma

机构 * Meituan(美团)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23603 2025-09-30 cs.CV 79%

MAN: Latent Diffusion Enhanced Multistage Anti-Noise Network for Efficient and High-Quality Low-Dose CT Image Denoising

Tangtangfang Fang, Jingxi Hu, Xiangjian He, Jiaqi Yang

机构 * School of Computer Science, University of Nottingham Ningbo China(诺丁汉大学宁波校区计算机科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Submitted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22723 2025-09-30 cs.CR cs.CV 79%

Responsible Diffusion: A Comprehensive Survey on Safety, Ethics, and Trust in Diffusion Models

Kang Wei, Xin Yuan, Fushuo Huo, Chuan Ma, Long Yuan, Songze Li, Ming Ding, Dacheng Tao

机构 * School of Cyber Science and Engineering, Southeast University(电子科技大学信息与通信工程学院) Data61, CSIRO(数据61,CSIRO) Zhejiang Laboratory(浙江省实验室) school of Computer Science and Artificial Intelligence, Wuhan University of Technology(计算机科学与人工智能学院,武汉理工大学) College of Computing and Data Science, Nanyang Technological University(计算科学与数据科学学院,南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏