arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2501.15598 2025-03-21 cs.CV cs.AI cs.LG q-bio.QM stat.ML 79%

Diffusion Generative Modeling for Spatially Resolved Gene Expression Inference from Histology Images

Sichen Zhu, Yuchen Zhu, Molei Tao, Peng Qiu

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10411 2025-03-21 cs.CV cs.AI 79%

Repurposing Stable Diffusion Attention for Training-Free Unsupervised Interactive Segmentation

Markus Karmann, Onay Urfalioglu

机构 * Vivo Tech Research GmbH(维沃技术研究有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15667 2025-03-21 cs.CV 79%

DiffPortrait360: Consistent Portrait Diffusion for 360 View Synthesis

Yuming Gu, Phong Tran, Yujian Zheng, Hongyi Xu, Heyuan Li, Adilbek Karmanov, Hao Li

机构 * University of Southern California(南加州大学) MBZUAI(Mohamed bin Zayed 人工智能大学) ByteDance Inc.(字节跳动公司) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Pinscreen Inc.(Pinscreen公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Page:https://freedomgu.github.io/DiffPortrait360 Code:https://github.com/FreedomGu/DiffPortrait360/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15216 2025-03-21 cs.CV 79%

Label-efficient multi-organ segmentation with a diffusion model

Yongzhi Huang, Fengjun Xi, Liyun Tu, Jinxin Zhu, Haseeb Hassan, Liyilei Su, Yun Peng, Jingyu Li, Jun Ma, Bingding Huang

机构 * College of Big Data and Internet, Shenzhen Technology University(深圳技术大学大数据与互联网学院) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) Department of Radiology, Beijing Tiantan Hospital, Capital Medical University(首都医科大学附属北京天坛医院放射科)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15208 2025-03-20 cs.CV 79%

DiST-4D: Disentangled Spatiotemporal Diffusion with Metric Depth for 4D Driving Scene Generation

Jiazhe Guo, Yikang Ding, Xiwu Chen, Shuo Chen, Bohan Li, Yingshuang Zou, Xiaoyang Lyu, Feiyang Tan, Xiaojuan Qi, Zhiheng Li, Hao Zhao

机构 * Megvii(旷视科技) Mach Drive

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15017 2025-03-20 cs.CV 79%

Exploiting Diffusion Prior for Real-World Image Dehazing with Unpaired Training

Yunwei Lan, Zhigao Cui, Chang Liu, Jialun Peng, Nian Wang, Xin Luo, Dong Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14966 2025-03-20 cs.CV eess.IV 79%

Ultrasound Image-to-Video Synthesis via Latent Dynamic Diffusion Models

Tingxiu Chen, Yilei Shi, Zixuan Zheng, Bingcong Yan, Jingliang Hu, Xiao Xiang Zhu, Lichao Mou

机构 * MedAI Technology (Wuxi) Co. Ltd.(MedAI科技(无锡)有限公司) Technical University of Munich(慕尼黑工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments MICCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14863 2025-03-20 cs.CV 79%

Temporal-Consistent Video Restoration with Pre-trained Diffusion Models

Hengkang Wang, Yang Liu, Huidong Liu, Chien-Chih Wang, Yanhui Guo, Hongdong Li, Bryan Wang, Ju Sun

机构 * University of Minnesota(明尼苏达大学) Amazon.com, Inc.(亚马逊公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14830 2025-03-20 cs.CV 79%

Decompositional Neural Scene Reconstruction with Generative Diffusion Prior

Junfeng Ni, Yu Liu, Ruijie Lu, Zirui Zhou, Song-Chun Zhu, Yixin Chen, Siyuan Huang

机构 * Tsinghua University(清华大学) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,北京智源人工智能研究院) Peking University(北京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR'25. Project page: https://dp-recon.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14654 2025-03-20 cs.CV 79%

A Simple Combination of Diffusion Models for Better Quality Trade-Offs in Image Denoising

Jonas Dornbusch, Emanuel Pfarr, Florin-Alexandru Vasluianu, Frank Werner, Radu Timofte

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00315 2025-03-20 cs.LG cs.AI cs.CV 79%

ADBM: Adversarial diffusion bridge model for reliable adversarial purification

Xiao Li, Wenxuan Sun, Huanran Chen, Qiongxiu Li, Yining Liu, Yingzhe He, Jie Shi, Xiaolin Hu

机构 * Tsinghua University(清华大学) Peking University(北京大学) Beijing Institute of Technology(北京理工大学) Aalborg University(奥尔堡大学) Harbin Institute of Technology, Weihai(哈尔滨工业大学(威海)) Huawei Technologies(华为技术有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025, fix typos in the proof

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14402 2025-03-19 cs.CV 79%

Diffusion-based Facial Aesthetics Enhancement with 3D Structure Guidance

Lisha Li, Jingwen Hou, Weide Liu, Yuming Fang, Jiebin Yan

机构 * School of Computing and Artificial Intelligence, Jiangxi University of Finance and Economics(江西财经大学计算与人工智能学院) Boston Children’s Hospital(波士顿儿童医院) Harvard Medical School(哈佛医学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14325 2025-03-19 cs.CV eess.IV 79%

LeanVAE: An Ultra-Efficient Reconstruction VAE for Video Diffusion Models

Yu Cheng, Fajie Yuan

机构 * Westlake University(西湖大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13957 2025-03-19 cs.CV 79%

DIFFVSGG: Diffusion-Driven Online Video Scene Graph Generation

Mu Chen, Liulei Li, Wenguan Wang, Yi Yang

机构 * Zhejiang University(浙江大学) University of Technology Sydney(悉尼科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025, Code: https://github.com/kagawa588/DiffVsgg

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13541 2025-03-19 cs.GR 79%

DDPM-Polycube: A Denoising Diffusion Probabilistic Model for Polycube-Based Hexahedral Mesh Generation and Volumetric Spline Construction

Yuxuan Yu, Yuzhuo Fang, Hua Tong, Jiashuo Liu, Yongjie Jessica Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01790 2025-03-19 cs.CV 79%

Ingredients: Blending Custom Photos with Video Diffusion Transformers

Zhengcong Fei, Debang Li, Di Qiu, Changqian Yu, Mingyuan Fan

机构 * Kunlun Inc.(昆仑公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08116 2025-03-19 cs.CV cs.LG 79%

Diffusion-based Data Augmentation and Knowledge Distillation with Generated Soft Labels Solving Data Scarcity Problems of SAR Oil Spill Segmentation

Jaeho Moon, Jeonghwan Yun, Jaehyun Kim, Jaehyup Lee, Munchurl Kim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Kyungpook National University(庆北国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19108 2025-03-19 cs.CV 79%

Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model

Feng Liu, Shiwei Zhang, Xiaofeng Wang, Yujie Wei, Haonan Qiu, Yuzhong Zhao, Yingya Zhang, Qixiang Ye, Fang Wan

机构 * University of Chinese Academy of Sciences(中国科学院大学) Alibaba Group(阿里巴巴集团) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Fudan University(复旦大学) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted in CVPR 2025. Project: https://liewfeng.github.io/TeaCache

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21301 2025-03-19 eess.IV cs.AI cs.CV cs.LG 79%

Evaluating the Posterior Sampling Ability of Plug&Play Diffusion Methods in Sparse-View CT

Liam Moroy, Guillaume Bourmaud, Frédéric Champagnat, Jean-François Giovannelli

机构 * ONERA, Univ. Paris Saclay(法国航空航天实验室、巴黎萨克雷大学) IMS (Univ. Bordeaux – CNRS – BINP)(波尔多大学、法国国家科学研究中心、核物理与粒子物理研究所联合组成的信息处理与系统研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13272 2025-03-18 cs.CV 79%

Generative Gaussian Splatting: Generating 3D Scenes with Video Diffusion Priors

Katja Schwarz, Norman Mueller, Peter Kontschieder

机构 * Meta Reality Labs(元宇宙实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13229 2025-03-18 cs.CV 79%

HoloGest: Decoupled Diffusion and Motion Priors for Generating Holisticly Expressive Co-speech Gestures

Yongkang Cheng, Shaoli Huang

机构 * Tencent AILab(腾讯AI实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by 3DV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13004 2025-03-18 cs.CV 79%

TFDM: Time-Variant Frequency-Based Point Cloud Diffusion with Mamba

Jiaxu Liu, Li Li, Hubert P. H. Shum, Toby P. Breckon

机构 * Durham University(杜伦大学) King’s College London(伦敦国王学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12963 2025-03-18 cs.CV 79%

Unlock Pose Diversity: Accurate and Efficient Implicit Keypoint-based Spatiotemporal Diffusion for Audio-driven Talking Portrait

Chaolong Yang, Kai Yao, Yuyao Yan, Chenru Jiang, Weiguang Zhao, Jie Sun, Guangliang Cheng, Yifei Zhang, Bin Dong, Kaizhu Huang

机构 * University of Liverpool(利物浦大学) Ant Group(蚂蚁集团) Xi’an Jiaotong-Liverpool University(西交利物浦大学) Duke Kunshan University(昆山杜克大学) Ricoh Software Research Center(理光软件研究中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12779 2025-03-18 cs.CV 79%

TransDiff: Diffusion-Based Method for Manipulating Transparent Objects Using a Single RGB-D Image

Haoxiao Wang, Kaichen Zhou, Binrui Gu, Zhiyuan Feng, Weijie Wang, Peilin Sun, Yicheng Xiao, Jianhua Zhang, Hao Dong

机构 * Peking University(北京大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) Southeast University(东南大学) Tianjin University of Technology(天津理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12758 2025-03-18 cs.CV eess.IV 79%

VasTSD: Learning 3D Vascular Tree-state Space Diffusion Model for Angiography Synthesis

Zhifeng Wang, Renjiao Yi, Xin Wen, Chenyang Zhu, Kai Xu

机构 * National University of Defense Technology(国防科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12536 2025-03-18 cs.LG cs.CV cs.CY 79%

Debiasing Diffusion Model: Enhancing Fairness through Latent Representation Learning in Stable Diffusion Model

Lin-Chun Huang, Ching Chieh Tsao, Fang-Yi Su, Jung-Hsien Chiang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12466 2025-03-18 cs.RO cs.CV 79%

Modality-Composable Diffusion Policy via Inference-Time Distribution-level Composition

Jiahang Cao, Qiang Zhang, Hanzhong Guo, Jiaxu Wang, Hao Cheng, Renjing Xu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) The University of Hong Kong(香港大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICLR 2025 Generative Models for Robot Learning Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12401 2025-03-18 cs.CV 79%

MExD: An Expert-Infused Diffusion Model for Whole-Slide Image Classification

Jianwei Zhao, Xin Li, Fan Yang, Qiang Zhai, Ao Luo, Yang Zhao, Hong Cheng, Huazhu Fu

机构 * UESTC(电子科技大学) AIQ(人工智能公司) SICAU(四川农业大学) SWJTU(西南交通大学) IHPC, A*STAR(新加坡科技研究局高性能计算研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12131 2025-03-18 cs.CV cs.AI cs.LG cs.SD eess.AS 79%

DiffGAP: A Lightweight Diffusion Module in Contrastive Space for Bridging Cross-Model Gap

Shentong Mo, Zehua Chen, Fan Bao, Jun Zhu

机构 * Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学) Shengshu AI(昇树科技)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12102 2025-03-18 cs.CV 79%

A Speech-to-Video Synthesis Approach Using Spatio-Temporal Diffusion for Vocal Tract MRI

Paula Andrea Pérez-Toro, Tomás Arias-Vergara, Fangxu Xing, Xiaofeng Liu, Maureen Stone, Jiachen Zhuo, Juan Rafael Orozco-Arroyave, Elmar Nöth, Jana Hutter, Jerry L. Prince, Andreas Maier, Jonghye Woo

机构 * Harvard Medical School/Massachusetts General Hospital(哈佛医学院/麻省总医院) Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔朗根-纽伦堡弗里德里希-亚历山大大学) Universidad de Antioquia(安蒂奥基亚大学) Yale University(耶鲁大学) University of Maryland School of Dentistry(马里兰大学牙科学院) University Hospital Erlangen(埃尔朗根大学医院) Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏