arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2502.07238 2025-03-18 cs.CV cs.AI 79%

Diffusion Suction Grasping with Large-Scale Parcel Dataset

Ding-Tao Huang, Xinyi He, Debei Hua, Dongfang Yu, En-Te Lin, Long Zeng

机构 * Tsinghua University(清华大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Institute for Ocean Engineering, Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院海洋工程研究院) Fuwei Intelligent Technology Co., Ltd(福惟智能科技有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02525 2025-03-18 cs.CV cs.RO 79%

Diff9D: Diffusion-Based Domain-Generalized Category-Level 9-DoF Object Pose Estimation

Jian Liu, Wei Sun, Hui Yang, Pengchao Deng, Chongpei Liu, Nicu Sebe, Hossein Rahmani, Ajmal Mian

机构 * Hunan University(湖南大学) University of Trento(特伦托大学) Lancaster University(兰卡斯特大学) The University of Western Australia(西澳大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 17 pages, 13 figures

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07663 2025-03-18 eess.IV cs.CV 79%

Co-learning Single-Step Diffusion Upsampler and Downsampler with Two Discriminators and Distillation

Sohwi Kim, Tae-Kyun Kim

机构 * School of Computing, KAIST(韩国科学技术院计算机学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06757 2025-03-18 eess.IV cs.CV 79%

MDiff-FMT: Morphology-aware Diffusion Model for Fluorescence Molecular Tomography with Small-scale Datasets

Peng Zhang, Qianqian Xue, Xingyu Liu, Guanglei Zhang, Wenjian Wang, Jiye Liang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15020 2025-03-18 cs.CV 79%

A3D: Does Diffusion Dream about 3D Alignment?

Savva Ignatyev, Nina Konovalova, Daniil Selikhanovych, Oleg Voynov, Nikolay Patakin, Ilya Olkov, Dmitry Senushkin, Alexey Artemov, Anton Konushin, Alexander Filippov, Peter Wonka, Evgeny Burnaev

机构 * Skoltech(斯科尔科沃科技学院) AIRI Medida AI AI Foundation and Algorithm Lab(AI基金会与算法实验室) KAUST(阿卜杜拉国王科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06743 2025-03-18 cs.CV 79%

TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution

Baolin Liu, Zongyuan Yang, Pengfei Wang, Junjie Zhou, Ziqi Liu, Ziyi Song, Yan Liu, Yongping Xiong

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Correct and update some data

Journal ref Pattern Recognition (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11404 2025-03-17 cs.CR cs.AI cs.CV 79%

Towards A Correct Usage of Cryptography in Semantic Watermarks for Diffusion Models

Jonas Thietke, Andreas Müller, Denis Lukovnikov, Asja Fischer, Erwin Quiring

机构 * Ruhr University Bochum(鲁尔大学波鸿分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 8 pages, 3 figures, WMark@ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11372 2025-03-17 cs.RO cs.CV 79%

BEVDiffLoc: End-to-End LiDAR Global Localization in BEV View based on Diffusion Model

Ziyue Wang, Chenghao Shi, Neng Wang, Qinghua Yu, Xieyuanli Chen, Huimin Lu

机构 * National Key Laboratory of Equipment State Sensing and Smart Support(装备状态感知与智能支撑国家重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11321 2025-03-17 cs.CV eess.IV 79%

Leveraging Diffusion Knowledge for Generative Image Compression with Fractal Frequency-Aware Band Learning

Lingyu Zhu, Xiangrui Zeng, Bolin Chen, Peilin Chen, Yung-Hui Li, Shiqi Wang

机构 * City University of Hong Kong(香港城市大学) Hon Hai Research Institute(鸿海研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11028 2025-03-17 cs.CV 79%

EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models

Yixuan Zhang, Qing Chang, Yuxi Wang, Guang Chen, Zhaoxiang Zhang, Junran Peng

机构 * University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology Beijing(北京科技大学) The New Laboratory of Pattern Recognition (NLPR), State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室模式识别新实验室) The New Laboratory of Pattern Recognition (NLPR)(模式识别新实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10678 2025-03-17 cs.CV 79%

VRMDiff: Text-Guided Video Referring Matting Generation of Diffusion

Lehan Yang, Jincen Song, Tianlong Wang, Daiqing Qi, Weili Shi, Yuheng Liu, Sheng Li

机构 * University of Virginia(弗吉尼亚大学) Columbia University(哥伦比亚大学) Texas A&M University(德克萨斯农工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00671 2025-03-17 cs.CV 79%

FiffDepth: Feed-forward Transformation of Diffusion-Based Generators for Detailed Depth Estimation

Yunpeng Bai, Qixing Huang

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12523 2025-03-17 cs.LG cs.CV 79%

Data Pruning in Generative Diffusion Models

Rania Briq, Jiangtao Wang, Stefan Kesselheim

机构 * Juelich Supercomputing Centre(于利希超级计算中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21705 2025-03-17 cs.CV 79%

Tora: Trajectory-oriented Diffusion Transformer for Video Generation

Zhenghao Zhang, Junchao Liao, Menghao Li, Zuozhuo Dai, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang

机构 * Alibaba Cloud Computing(阿里巴巴云计算) Fudan University(复旦大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025 Conference Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10626 2025-03-14 cs.CV cs.AI cs.LG cs.RO 79%

NIL: No-data Imitation Learning by Leveraging Pre-trained Video Diffusion Models

Mert Albaba, Chenhao Li, Markos Diomataris, Omid Taheri, Andreas Krause, Michael Black

机构 * ETH Zürich(苏黎世联邦理工学院) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10604 2025-03-14 cs.CV 79%

MuDG: Taming Multi-modal Diffusion with Gaussian Splatting for Urban Scene Reconstruction

Yingshuang Zou, Yikang Ding, Chuanrui Zhang, Jiazhe Guo, Bohan Li, Xiaoyang Lyu, Feiyang Tan, Xiaojuan Qi, Haoqian Wang

机构 * THU(清华大学) MEGVII(旷视科技) Mach Drive(马赫驱动) SJTU(上海交通大学) HKU(香港大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10592 2025-03-14 cs.CV 79%

CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models

Hao He, Ceyuan Yang, Shanchuan Lin, Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li

机构 * The Chinese University of Hong Kong(香港中文大学) ByteDance Seed(字节跳动 Seed) Stanford University(斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://hehao13.github.io/Projects-CameraCtrl-II/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10350 2025-03-14 cs.CV 79%

Enhancing Facial Privacy Protection via Weakening Diffusion Purification

Ali Salar, Qing Liu, Yingli Tian, Guoying Zhao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09013 2025-03-14 cs.CV 79%

Arbitrary-steps Image Super-resolution via Diffusion Inversion

Zongsheng Yue, Kang Liao, Chen Change Loy

机构 * Xi’an Jiaotong University(西安交通大学) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025. Project: https://github.com/zsyOAOA/InvSR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09993 2025-03-14 cs.CV 79%

Channel-wise Noise Scheduled Diffusion for Inverse Rendering in Indoor Scenes

JunYong Choi, Min-Cheol Sagong, SeokYeong Lee, Seung-Won Jung, Ig-Jae Kim, Junghyun Cho

机构 * Korea Institute of Science and Technology(KIST)(韩国科学技术研究院) Korea University(高丽大学) University of Science and Technology(科学技术大学) Yonsei-KIST Convergence Research Institute(延世-韩国科学技术研究院融合研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09942 2025-03-14 cs.CV 79%

Cosh-DiT: Co-Speech Gesture Video Synthesis via Hybrid Audio-Visual Diffusion Transformers

Yasheng Sun, Zhiliang Xu, Hang Zhou, Jiazhi Guan, Quanwei Yang, Kaisiyuan Wang, Borong Liang, Yingying Li, Haocheng Feng, Jingdong Wang, Ziwei Liu, Koike Hideki

机构 * King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) Baidu(百度) Tokyo Institute of Technology(东京工业大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project Page: https://sunyasheng.github.io/projects/COSH-DIT

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09634 2025-03-14 cs.GR 79%

Identity Preserving Latent Diffusion for Brain Aging Modeling

Gexin Huang, Zhangsihao Yang, Yalin Wang, Guido Gerig, Mengwei Ren, Xiaoxiao Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06426 2025-03-14 cs.LG cs.CV cs.DC 79%

Federated Learning for Diffusion Models

Zihao Peng, Xijun Wang, Shengbo Chen, Hong Rao, Cong Shen

机构 * Nanchang University(南昌大学) Sun Yat-sen University(中山大学) University of Virginia(弗吉尼亚大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09262 2025-03-14 cs.CV 79%

LatentSync: Taming Audio-Conditioned Latent Diffusion Models for Lip Sync with SyncNet Supervision

Chunyu Li, Chao Zhang, Weikai Xu, Jingyu Lin, Jinghui Xie, Weiguo Feng, Bingyue Peng, Cunjian Chen, Weiwei Xing

机构 * ByteDance(字节跳动) Beijing Jiaotong University(北京交通大学) Monash University(莫纳什大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09566 2025-03-13 cs.CV 79%

TPDiff: Temporal Pyramid Video Diffusion Model

Lingmin Ran, Mike Zheng Shou

机构 * National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://showlab.github.io/TPDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09410 2025-03-13 cs.CV 79%

Monte Carlo Diffusion for Generalizable Learning-Based RANSAC

Jiale Wang, Chen Zhao, Wei Ke, Tong Zhang

机构 * Xi’an Jiaotong University(西安交通大学) EPFL(洛桑联邦理工学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19355 2025-03-13 cs.CV 79%

FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality

Zhengyao Lv, Chenyang Si, Junhao Song, Zhenyu Yang, Yu Qiao, Ziwei Liu, Kwan-Yee K. Wong

机构 * The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05274 2025-03-13 cs.LG cs.CV 79%

Two Simple Principles for Diffusion-Based Test-Time Adaptation

Kaiyu Song, Hanjiang Lai, Yan Pan, Kun Yue, Jian Yin

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13352 2025-03-13 eess.IV cs.CV cs.LG 79%

Polyhedra Encoding Transformers: Enhancing Diffusion MRI Analysis Beyond Voxel and Volumetric Embedding

Tianyuan Yao, Zhiyuan Li, Praitayini Kanakaraj, Derek B. Archer, Kurt Schilling, Lori Beason-Held, Susan Resnick, Bennett A. Landman, Yuankai Huo

机构 * Vanderbilt University(范德堡大学) Vanderbilt University Medical Center(范德堡大学医学中心) National Institute on Aging(美国国家老龄化研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08664 2025-03-12 cs.CV cs.AI 79%

MEAT: Multiview Diffusion Model for Human Generation on Megapixels with Mesh Attention

Yuhan Wang, Fangzhou Hong, Shuai Yang, Liming Jiang, Wayne Wu, Chen Change Loy

机构 * S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab) WICT, Peking University(北京大学WICT) UCLA(加利福尼亚大学洛杉矶分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025. Code https://github.com/johannwyh/MEAT Project Page https://johann.wang/MEAT/

详情

展开后加载摘要…

URL PDF HTML 收藏