arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2503.18933 2025-03-25 cs.CV 79%

SyncVP: Joint Diffusion for Synchronous Multi-Modal Video Prediction

Enrico Pallotta, Sina Mokhtarzadeh Azar, Shuai Li, Olga Zatsarynna, Juergen Gall

机构 * University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18627 2025-03-25 cs.CV cs.AI 79%

Dig2DIG: Dig into Diffusion Information Gains for Image Fusion

Bing Cao, Baoshuo Cai, Changqing Zhang, Qinghua Hu

机构 * College of Intelligence and Computing, Tianjin University(天津大学智能与计算学部)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18536 2025-03-25 cs.CV 79%

DiN: Diffusion Model for Robust Medical VQA with Semantic Noisy Labels

Erjian Guo, Zhen Zhao, Zicheng Wang, Tong Chen, Yunyi Liu, Luping Zhou

机构 * University of Sydney(悉尼大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18512 2025-03-25 cs.CV eess.IV 79%

Uncertainty-guided Perturbation for Image Super-Resolution Diffusion Model

Leheng Zhang, Weiyi You, Kexuan Shi, Shuhang Gu

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07856 2025-03-25 cs.CV cs.AI cs.LG 79%

MaRS: A Fast Sampler for Mean Reverting Diffusion based on ODE and SDE Solvers

Ao Li, Wei Fang, Hongbo Zhao, Le Lu, Ge Yang, Minfeng Xu

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所) DAMO Academy, Alibaba Group(阿里巴巴达摩院) Hupan Laboratory(湖畔实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18459 2025-03-25 cs.CV 79%

Hiding Images in Diffusion Models by Editing Learned Score Functions

Haoyu Chen, Yunqiao Yang, Nan Zhong, Kede Ma

机构 * City University of Hong Kong(香港城市大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18370 2025-03-25 cs.CV 79%

DiffusedWrinkles: A Diffusion-Based Model for Data-Driven Garment Animation

Raquel Vidaurre, Elena Garces, Dan Casas

机构 * Universidad Rey Juan Carlos(胡安·卡洛斯国王大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments BMVC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18312 2025-03-25 cs.CV 79%

Diff-Palm: Realistic Palmprint Generation with Polynomial Creases and Intra-Class Variation Controllable Diffusion Models

Jianlong Jin, Chenglong Zhao, Ruixin Zhang, Sheng Shang, Jianqing Xu, Jingyun Zhang, ShaoMing Wang, Yang Zhao, Shouhong Ding, Wei Jia, Yunsheng Wu

机构 * Hefei University of Technology(合肥工业大学) Tencent Youtu Lab(腾讯优图实验室) Tencent WeChat Pay Lab(腾讯微信支付实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18170 2025-03-25 cs.CV cs.AI 79%

Self-Attention Diffusion Models for Zero-Shot Biomedical Image Segmentation: Unlocking New Frontiers in Medical Imaging

Abderrachid Hamrani, Anuradha Godavarty

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18083 2025-03-25 cs.CV 79%

Unified Geometry and Color Compression Framework for Point Clouds via Generative Diffusion Priors

Tianxin Huang, Gim Hee Lee

机构 * National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17934 2025-03-25 cs.CV 79%

TransAnimate: Taming Layer Diffusion to Generate RGBA Video

Xuewei Chen, Zhimin Chen, Yiren Song

机构 * Clemson University(克莱姆森大学) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17907 2025-03-25 cs.CV eess.IV 79%

Guided Diffusion for the Extension of Machine Vision to Human Visual Perception

Takahiro Shindo, Yui Tatsumi, Taiju Watanabe, Hiroshi Watanabe

机构 * Waseda University(早稻田大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17804 2025-03-25 eess.IV cs.CV 79%

DVG-Diffusion: Dual-View Guided Diffusion Model for CT Reconstruction from X-Rays

Xing Xie, Jiawei Liu, Huijie Fan, Zhi Han, Yandong Tang, Liangqiong Qu

机构 * Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) The University of Hong Kong(香港大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17488 2025-03-25 cs.CV 79%

ProDehaze: Prompting Diffusion Models Toward Faithful Image Dehazing

Tianwen Zhou, Jing Wang, Songtao Wu, Kuanhong Xu

机构 * University College London(伦敦大学学院) Sony China Ltd.(索尼中国有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01407 2025-03-25 cs.CV cs.AI 79%

Divide and Conquer: Heterogeneous Noise Integration for Diffusion-based Adversarial Purification

Gaozheng Pei, Shaojie Lyu, Gong Chen, Ke Ma, Qianqian Xu, Yingfei Sun, Qingming Huang

机构 * School of Electronic, Electrical and Communication Engineering, UCAS(中国科学院大学电子电气与通信工程学院) Tencent Corporate(腾讯公司) Institute of Computing Technology, CAS(中国科学院计算技术研究所) School of Computer Science and Technology, UCAS(中国科学院大学计算机科学与技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01320 2025-03-25 cs.CV 79%

SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration

Jianyi Wang, Zhijie Lin, Meng Wei, Yang Zhao, Ceyuan Yang, Fei Xiao, Chen Change Loy, Lu Jiang

机构 * Nanyang Technological University(南洋理工大学) ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments CVPR25 CR ver., add a co-author additionally. Project page: https://iceclear.github.io/projects/seedvr/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13684 2025-03-25 cs.CV 79%

MMO-IG: Multi-Class and Multi-Scale Object Image Generation for Remote Sensing

Chuang Yang, Bingxuan Zhao, Qing Zhou, Qi Wang

机构 * School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University(西北工业大学光学与电子信息学院(iOPEN))

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10783 2025-03-25 cs.CV 79%

Video Diffusion Transformers are In-Context Learners

Zhengcong Fei, Di Qiu, Debang Li, Changqian Yu, Mingyuan Fan

机构 * Kunlun Inc.(昆仑公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17687 2025-03-25 cs.CV 79%

GenDeg: Diffusion-based Degradation Synthesis for Generalizable All-In-One Image Restoration

Sudarshan Rajagopalan, Nithin Gopalakrishnan Nair, Jay N. Paranjape, Vishal M. Patel

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025. Project Page: https://sudraj2002.github.io/gendegpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15959 2025-03-25 cs.RO cs.CV 79%

Diffusion Transformer Policy

Zhi Hou, Tianyi Zhang, Yuwen Xiong, Hengjun Pu, Chengyang Zhao, Ronglei Tong, Yu Qiao, Jifeng Dai, Yuntao Chen

机构 * Shanghai AI Lab(上海人工智能实验室) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab) Peking University(北京大学) SenseTime Research(商汤科技研究院) Tsinghua University(清华大学) Center for Artificial Intelligence and Robotics, HKISI, CAS(中国科学院香港创新研究院人工智能与机器人中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments preprint; New Project Page: https://robodita.github.io; revert unsuitable replacement

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17736 2025-03-25 eess.SP cs.CV cs.IT eess.IV math.IT 79%

Diffusion-Aided Joint Source Channel Coding For High Realism Wireless Image Transmission

Mingyu Yang, Bowen Liu, Boyang Wang, Hun-Seok Kim

机构 * University of Michigan(密歇根大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15868 2025-03-24 cs.CV 79%

UniCoRN: Latent Diffusion-based Unified Controllable Image Restoration Network across Multiple Degradations

Debabrata Mandal, Soumitri Chattopadhyay, Guansen Tong, Praneeth Chakravarthula

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16646 2025-03-24 cs.CV 79%

TopoDiffusionNet: A Topology-aware Diffusion Model

Saumya Gupta, Dimitris Samaras, Chao Chen

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted to ICLR 2025 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16983 2025-03-24 cs.CV cs.AI 79%

Enabling Versatile Controls for Video Diffusion Models

Xu Zhang, Hao Zhou, Haoming Qin, Xiaobin Lu, Jiaxing Yan, Guanzhong Wang, Zeyu Chen, Yi Liu

机构 * PaddlePaddle Team, Baidu Inc.(百度飞桨团队) Xiamen University(厦门大学) Sun Yat-sen University(中山大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Codes and Supplementary Material: http://github.com/PaddlePaddle/PaddleMIX/tree/develop/ppdiffusers/examples/ppvctrl

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16635 2025-03-24 eess.IV cs.CV 79%

Fed-NDIF: A Noise-Embedded Federated Diffusion Model For Low-Count Whole-Body PET Denoising

Yinchi Zhou, Huidong Xie, Menghua Xia, Qiong Liu, Bo Zhou, Tianqi Chen, Jun Hou, Liang Guo, Xinyuan Zheng, Hanzhong Wang, Biao Li, Axel Rominger, Kuangyu Shi, Nicha C. Dvorneka, Chi Liu

机构 * Yale University(耶鲁大学) Northwestern University(西北大学) Ruijin Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院) Inselspital, Bern University Hospital, University of Bern(伯尔尼大学医院 Inselspital,伯尔尼大学) Technical University of Munich(慕尼黑工业大学) Yale School of Medicine(耶鲁医学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16218 2025-03-21 cs.CV 79%

Temporal Score Analysis for Understanding and Correcting Diffusion Artifacts

Yu Cao, Zengqun Zhao, Ioannis Patras, Shaogang Gong

机构 * Queen Mary University of London(伦敦玛丽女王大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16065 2025-03-21 cs.CV 79%

Shining Yourself: High-Fidelity Ornaments Virtual Try-on with Diffusion Model

Yingmao Miao, Zhanpeng Huang, Rui Han, Zibin Wang, Chenhao Lin, Chao Shen

机构 * SenseTime Research(商汤科技研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15975 2025-03-21 cs.CV 79%

Acc3D: Accelerating Single Image to 3D Diffusion Models via Edge Consistency Guided Score Distillation

Kendong Liu, Zhiyu Zhu, Hui Liu, Junhui Hou

机构 * City University of Hong Kong(香港城市大学) Saint Francis University(圣弗朗西斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15927 2025-03-21 cs.CV 79%

BlockDance: Reuse Structurally Similar Spatio-Temporal Features to Accelerate Diffusion Transformers

Hui Zhang, Tingwei Gao, Jie Shao, Zuxuan Wu

机构 * Fudan University(复旦大学) ByteDance Intelligent Creation(字节跳动智能创作)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15914 2025-03-21 cs.CV 79%

Text-Driven Diffusion Model for Sign Language Production

Jiayi He, Xu Wang, Ruobei Zhang, Shengeng Tang, Yaxiong Wang, Lechao Cheng

机构 * School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏