arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-08-05 至 2025-08-05 共收录 70 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70 篇

2503.11972 2025-08-05 cs.DC 89%

MoDM: Efficient Serving for Image Generation via Mixture-of-Diffusion Models

Yuchen Xia, Divyam Sharma, Yichao Yuan, Souvik Kundu, Nishil Talati

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract)

Comments To appear in ASPLOS'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13023 2025-08-05 cs.CV cs.AI cs.MM 88%

Anti-Inpainting: A Proactive Defense Approach against Malicious Diffusion-based Inpainters under Unknown Conditions

Yimao Guo, Zuomin Qu, Wei Lu, Xiangyang Luo

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10340 2025-08-05 cs.CV 85%

Text Embedding Knows How to Quantize Text-Guided Diffusion Models

Hongjae Lee, Myungjun Son, Dongjea Kang, Seung-Won Jung

机构 * Korea University(韩国大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19853 2025-08-05 cs.CV cs.GR cs.LG 84%

Conditional Balance: Improving Multi-Conditioning Trade-Offs in Image Generation

Nadav Z. Cohen, Oron Nir, Ariel Shamir

机构 * Reichman University(里奇曼大学) Microsoft Corporation(微软公司)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV、cs.GR

Comments Conference paper at CVPR 2025. Project page: https://nadavc220.github.io/conditional-balance.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23268 2025-08-05 cs.CV 84%

PixNerd: Pixel Neural Field Diffusion

Shuai Wang, Ziteng Gao, Chenhui Zhu, Weilin Huang, Limin Wang

机构 * Nanjing University(南京大学) ByteDance Seed(字节跳动种子) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments a single-scale, single-stage, efficient, end-to-end pixel space diffusion model

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15580 2025-08-05 cs.CV 83%

TKG-DM: Training-free Chroma Key Content Generation Diffusion Model

Ryugo Morita, Stanislav Frolov, Brian Bernhard Moser, Takahiro Shirakawa, Ko Watanabe, Andreas Dengel, Jinjia Zhou

机构 * Faculty of Science and Engineering(科学与工程学部) RPTU Kaiserslautern-Landau & DFKI GmbH(科隆-兰道大学与DFKI GmbH)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR2025(Highlight). Code at: https://github.com/ryugo417/TKG-DM

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18092 2025-08-05 cs.CV cs.AI cs.RO 83%

DiffSSC: Semantic LiDAR Scan Completion using Denoising Diffusion Probabilistic Models

Helin Cao, Sven Behnke

机构 * Autonomous Intelligent Systems group, Computer Science Institute VI – Intelligent Systems and Robotics – and the Center for Robotics and the Lamarr Institute for Machine Learning and Artificial Intelligence, University of Bonn, Germany(自主智能系统组,计算机科学研究所VI——智能系统与机器人——和机器人中心以及拉马尔人工智能与机器学习研究所,波恩大学,德国)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025), Hangzhou, China, Oct 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01130 2025-08-05 cs.CV 83%

Joint Generative Modeling of Grounded Scene Graphs and Images via Diffusion Models

Bicheng Xu, Qi Yan, Renjie Liao, Lele Wang, Leonid Sigal

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能向量研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02528 2025-08-05 eess.IV cs.CV 79%

From Pixels to Pathology: Restoration Diffusion for Diagnostic-Consistent Virtual IHC

Jingsong Liu, Xiaofeng Deng, Han Li, Azar Kazemi, Christian Grashei, Gesa Wilkens, Xin You, Tanja Groll, Nassir Navab, Carolin Mogler, Peter J. Schüffler

机构 * organization= Institute of Pathology, Technical University of Munich, TUM School of Medicine organization= Computer Aided Medical Procedures (CAMP), TU Munich , city= Munich , country= Germany organization= Munich Center for Machine Learning (MCML) , city= Munich , country= Germany organization= TUM School of Computation, Information organization= Department of Medical Informatics, School of Medicine, Mashhad University of Medical Sciences , city= Mashhad , country= Iran organization= Munich Data Science Institute (MDSI) , city= Munich , country= Germany

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02323 2025-08-05 cs.CV 79%

Dream-to-Recon: Monocular 3D Reconstruction with Diffusion-Depth Distillation from Single Images

Philipp Wulff, Felix Wimbauer, Dominik Muhle, Daniel Cremers

机构 * Technical University of Munich(慕尼黑技术大学) MCML SE3 Labs(SE3实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025. Website: https://philippwulff.github.io/dream-to-recon

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01058 2025-08-05 eess.IV cs.CV 79%

ReCoSeg++:Extended Residual-Guided Cross-Modal Diffusion for Brain Tumor Segmentation

Sara Yavari, Rahul Nitin Pandya, Jacob Furst

机构 * School of Computing, DePaul University(计算学院,德保罗大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00896 2025-08-05 cs.CV cond-mat.mtrl-sci eess.IV 79%

Phase-fraction guided denoising diffusion model for augmenting multiphase steel microstructure segmentation via micrograph image-mask pair synthesis

Hoang Hai Nam Nguyen, Minh Tien Tran, Hoheok Kim, Ho Won Lee

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00443 2025-08-05 cs.CV 79%

SDMatte: Grafting Diffusion Models for Interactive Matting

Longfei Huang, Yu Liang, Hao Zhang, Jinwei Chen, Wei Dong, Lunde Chen, Wanyu Liu, Bo Li, Peng-Tao Jiang

机构 * Shanghai University(上海大学) vivo Mobile Communication Co., Ltd.(vivo移动通信有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at ICCV 2025, 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12049 2025-08-05 cs.CV 79%

TACO: Taming Diffusion for in-the-wild Video Amodal Completion

Ruijie Lu, Yixin Chen, Yu Liu, Jiaxiang Tang, Junfeng Ni, Diwen Wan, Gang Zeng, Siyuan Huang

机构 * State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) State Key Laboratory of General Artificial Intelligence, BIGAI(BIGAI 通用人工智能国家重点实验室) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025.Project page: https://jason-aplp.github.io/TACO

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01835 2025-08-05 cs.CV 79%

Diffusion-based 3D Hand Motion Recovery with Intuitive Physics

Yufei Zhang, Zijun Cui, Jeffrey O. Kephart, Qiang Ji

机构 * Rensselaer Polytechnic Institute(拉特格斯理工学院) Michigan State University(密歇根州立大学) IBM Research(IBM研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01778 2025-08-05 cs.CV cs.RO 79%

DiffSemanticFusion: Semantic Raster BEV Fusion for Autonomous Driving via Online HD Map Diffusion

Zhigang Sun, Yiru Wang, Anqing Jiang, Shuo Wang, Yu Gao, Yuwen Heng, Shouyi Zhang, An He, Hao Jiang, Jinhao Chai, Zichong Gu, Wang Jijun, Shichen Tang, Lavdim Halilaj, Juergen Luettin, Hao Sun

机构 * Bosch Corporate Research, Bosch (China) Investment Ltd.(博世企业研究院、博世(中国)投资有限公司) School of Communication and Information Engineering, Shanghai University(上海大学通信与信息工程学院) Shanghai Jiaotong University(上海交通大学) AIR, Tsinghua University(清华大学人工智能研究院) Robert Bosch GmbH(罗伯特·博世集团)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01698 2025-08-05 cs.CV 79%

Versatile Transition Generation with Image-to-Video Diffusion

Zuhao Yang, Jiahui Zhang, Yingchen Yu, Shijian Lu, Song Bai

机构 * Nanyang Technological University(南洋理工大学) ByteDance Inc.(字节跳动公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01230 2025-08-05 physics.comp-ph cs.CV 79%

Point-wise Diffusion Models for Physical Systems with Shape Variations: Application to Spatio-temporal and Large-scale system

Jiyong Kim, Sunwoong Yang, Namwoo Kang

机构 * KAIST(韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00941 2025-08-05 cs.CV 79%

Latent Diffusion Based Face Enhancement under Degraded Conditions for Forensic Face Recognition

Hassan Ugail, Hamad Mansour Alawar, AbdulNasser Abbas Zehi, Ahmed Mohammad Alkendi, Ismail Lujain Jaleel

机构 * Centre for Visual Computing and Intelligent Systems(视觉计算与智能系统中心) Unviversity of Bradford(布拉德福德大学) General Department of Forensic Science and Criminology(法医学与犯罪学部门) Dubai Police Headquarters(迪拜警察总部) theCircle Ltd(theCircle公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00599 2025-08-05 cs.CV 79%

DPoser-X: Diffusion Model as Robust 3D Whole-body Human Pose Prior

Junzhe Lu, Jing Lin, Hongkun Dou, Ailing Zeng, Yue Deng, Xian Liu, Zhongang Cai, Lei Yang, Yulun Zhang, Haoqian Wang, Ziwei Liu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Beihang University(北航) NVIDIA Research(NVIDIA研究) SenseTime Research(商汤科技研究院) Shanghai Jiao Tong University(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025 (oral); Code released: https://github.com/moonbow721/DPoser

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23685 2025-08-05 cs.CV 79%

UniLDiff: Unlocking the Power of Diffusion Priors for All-in-One Image Restoration

Zihan Cheng, Liangtai Zhou, Dian Chen, Ni Tang, Xiaotong Luo, Yanyun Qu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04847 2025-08-05 cs.CV 79%

HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation

Qijun Gan, Yi Ren, Chen Zhang, Zhenhui Ye, Pan Xie, Xiang Yin, Zehuan Yuan, Bingyue Peng, Jianke Zhu

机构 * Zhejiang University(浙江大学) ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments https://agnjason.github.io/HumanDiT-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16725 2025-08-05 cs.CV 79%

$\textit{Revelio}$: Interpreting and leveraging semantic information in diffusion models

Dahye Kim, Xavier Thomas, Deepti Ghadiyaram

机构 * Boston University(波士顿大学) Runway

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08524 2025-08-05 cs.CV cs.AI 79%

GS-ID: Illumination Decomposition on Gaussian Splatting via Adaptive Light Aggregation and Diffusion-Guided Material Priors

Kang Du, Zhihao Liang, Yulin Shen, Zeyu Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) South China University of Technology(华南理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 17 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02193 2025-08-05 cs.CL cs.LG 79%

Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference

Yuxuan Song, Zheng Zhang, Cheng Luo, Pengyang Gao, Fan Xia, Hao Luo, Zheng Li, Yuehang Yang, Hongli Yu, Xingwei Qu, Yuwei Fu, Jing Su, Ge Zhang, Wenhao Huang, Mingxuan Wang, Lin Yan, Xiaoying Jia, Jingjing Liu, Wei-Ying Ma, Ya-Qin Zhang, Yonghui Wu, Hao Zhou

机构 * ByteDance Seed(字节跳动种子) Institute for AI Industry Research (AIR)(人工智能产业研究院) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract)

Comments Demo is available at https://studio.seed.ai/exp/seed_diffusion/; Project page is https://seed.bytedance.com/seed_diffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02391 2025-08-05 cs.SD cs.AI eess.AS 78%

Inference-time Scaling for Diffusion-based Audio Super-resolution

Yizhu Jin, Zhen Ye, Zeyue Tian, Haohe Liu, Qiuqiang Kong, Yike Guo, Wei Xue

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) University of Surrey(萨里大学) Chinese University of Hong Kong(香港中文大学)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01024 2025-08-05 hep-ph nucl-th 78%

Assessing the lattice QCD space diffusion coefficient and the thermalization time of charm quark by mean of D meson observables at LHC

Maria Lucia Sambataro, Vincenzo Minissale, Salvatore Plumari, Vincenzo Greco

专题命中 扩散模型 :diffusion(title,abstract)

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16525 2025-08-05 stat.ML cs.LG 78%

Enhancing OOD Detection Using Latent Diffusion

Heng Gao, Jun Li

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克Quantin研究院) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) Fudan University(复旦大学)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01987 2025-08-05 cs.LG cs.AI cs.IR 78%

Controllable and Stealthy Shilling Attacks via Dispersive Latent Diffusion

Shutong Qiao, Wei Yuan, Junliang Yu, Tong Chen, Quoc Viet Hung Nguyen, Hongzhi Yin

机构 * University of Queensland(昆士兰大学) Griffith University(格里菲斯大学)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01975 2025-08-05 cs.LG stat.ML 78%

Diffusion models for inverse problems

Hyungjin Chung, Jeongsol Kim, Jong Chul Ye

机构 * EverEx KAIST(韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏