arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2502.06997 2025-02-21 eess.IV cs.CV 79%

Conditional diffusion model with spatial attention and latent embedding for medical image segmentation

Behzad Hejrati, Soumyanil Banerjee, Carri Glide-Hurst, Ming Dong

机构 * Wayne State University(韦恩州立大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 13 pages, 5 figures, 3 tables, Accepted in MICCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03293 2025-02-21 cs.CV 79%

Text-to-Image Rectified Flow as Plug-and-Play Priors

Xiaofeng Yang, Cheng Chen, Xulei Yang, Fayao Liu, Guosheng Lin

专题命中 扩散模型 :text-to-image(title);diffusion(abstract);分类 cs.CV

Comments ICLR 2025 Camera Ready. Code: https://github.com/yangxiaofeng/rectified_flow_prior

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02664 2025-02-21 cs.LG cs.AI cs.CV 79%

On Memorization in Diffusion Models

Xiangming Gu, Chao Du, Tianyu Pang, Chongxuan Li, Min Lin, Ye Wang

机构 * National University of Singapore(新加坡国立大学) Sea AI Lab(Sea AI实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments TMLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00064 2025-02-20 cs.CV cs.AI 79%

DiffGuard: Text-Based Safety Checker for Diffusion Models

Massine El Khader, Elias Al Bouzidi, Abdellah Oumida, Mohammed Sbaihi, Eliott Binard, Jean-Philippe Poli, Wassila Ouerdane, Boussad Addad, Katarzyna Kapusta

机构 * Université Paris-Saclay(巴黎萨克雷大学) CentraleSupélec(中央高等电力学院) Thales SIX GTS France(泰雷兹法国第六全球技术服务公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05317 2025-02-20 cs.LG cs.AI cs.CV 79%

Accelerating Diffusion Transformers with Token-wise Feature Caching

Chang Zou, Xuyang Liu, Ting Liu, Siteng Huang, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) University of Electronic Science & Technology of China(电子科技大学) Sichuan University(四川大学) National University of Defense Technology(国防科技大学) Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ToCa is honored to be accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13234 2025-02-20 cs.CV cs.AI cs.LG 79%

MotionMatcher: Motion Customization of Text-to-Video Diffusion Models via Motion Feature Matching

Yen-Siang Wu, Chi-Pin Huang, Fu-En Yang, Yu-Chiang Frank Wang

机构 * National Taiwan University(台湾大学) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Project page: https://www.csie.ntu.edu.tw/~b09902097/motionmatcher/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03496 2025-02-20 eess.IV cs.GR 79%

FreqPrior: Improving Video Diffusion Models with Frequency Filtering Gaussian Noise

Yunlong Yuan, Yuanfan Guo, Chunwei Wang, Wei Zhang, Hang Xu, Li Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12794 2025-02-19 cs.CR cs.CV cs.LG 79%

RAPID: Retrieval Augmented Training of Differentially Private Diffusion Models

Tanqiu Jiang, Changjiang Li, Fenglong Ma, Ting Wang

机构 * Stony Brook University(石溪大学) Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Published in ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12752 2025-02-19 cs.CV 79%

High-Fidelity Novel View Synthesis via Splatting-Guided Diffusion

Xiang Zhang, Yang Zhang, Lukas Mehl, Markus Gross, Christopher Schroers

机构 * ETH Zürich(苏黎世联邦理工学院) DisneyResearch|Studios(迪士尼研究工作室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20324 2025-02-19 cs.CV cs.LG 79%

Don't drop your samples! Coherence-aware training benefits Conditional diffusion

Nicolas Dufour, Victor Besnier, Vicky Kalogeiton, David Picard

机构 * École des Ponts(巴黎桥路学院) Univ Gustave Eiffel(古斯塔夫·埃菲尔大学) CNRS(法国国家科学研究中心) LIX(LIX实验室) École Polytechnique(巴黎综合理工学院) IP Paris(巴黎理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted at CVPR 2024 as a Highlight. Project page: https://nicolas-dufour.github.io/cad.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12154 2025-02-18 cs.CV cs.AI cs.LG 79%

Diffusion Models without Classifier-free Guidance

Zhicong Tang, Jianmin Bao, Dong Chen, Baining Guo

机构 * Tsinghua University(清华大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11989 2025-02-18 cs.HC cs.AI cs.CV 79%

Characterizing Photorealism and Artifacts in Diffusion Model-Generated Images

Negar Kamali, Karyn Nakamura, Aakriti Kumar, Angelos Chatzimparmpas, Jessica Hullman, Matthew Groh

机构 * Northwestern University(西北大学) Utrecht University(乌得勒支大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 26 pages, 24 Figures, Accepted by ACM CHI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11974 2025-02-18 cs.CV 79%

Image Inversion: A Survey from GANs to Diffusion and Beyond

Yinan Chen, Jiangning Zhang, Yali Bi, Xiaobin Hu, Teng Hu, Zhucun Xue, Ran Yi, Yong Liu, Ying Tai

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11515 2025-02-18 cs.CV 79%

SayAnything: Audio-Driven Lip Synchronization with Conditional Video Diffusion

Junxian Ma, Shiwen Wang, Jian Yang, Junyi Hu, Jian Liang, Guosheng Lin, Jingbo chen, Kai Li, Yu Meng

机构 * University of Chinese Academy of Sciences(中国科学院大学) Peking University(北京大学) Nanyang Technological University(南洋理工大学) City University of Hong Kong(香港城市大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10957 2025-02-18 cs.CV physics.ao-ph 79%

Skillful Nowcasting of Convective Clouds With a Cascade Diffusion Model

Haoming Chen, Xiaohui Zhong, Qiang Zhai, Xiaomeng Li, Ying Wa Chan, Pak Wai Chan, Yuanyuan Huang, Hao Li, Xiaoming Shi

机构 * The Hong Kong University of Science and Technology(香港科技大学) Fudan University(复旦大学) Hong Kong Observatory(香港天文台)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10841 2025-02-18 cs.CV 79%

SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers

Di Qiu, Zhengcong Fei, Rui Wang, Jialin Bai, Changqian Yu, Mingyuan Fan, Guibin Chen, Xiang Wen

机构 * Cranberry-Lemon University(蔓越莓柠檬大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00463 2025-02-18 cs.LG cs.CR cs.CV 79%

SAT-LDM: Provably Generalizable Image Watermarking for Latent Diffusion Models with Self-Augmented Training

Lu Zhang, Liang Zeng

机构 * Huazhong University of Science and Technology(华中科技大学) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 21 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17042 2025-02-18 cs.CV 79%

Adapting Image-to-Video Diffusion Models for Large-Motion Frame Interpolation

Luoxu Jin, Hiroshi Watanabe

机构 * Waseda University(早稻田大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09725 2025-02-18 cs.RO cs.CV 79%

Precise Pick-and-Place using Score-Based Diffusion Networks

Shih-Wei Guo, Tsu-Ching Hsiao, Yu-Lun Liu, Chun-Yi Lee

机构 * National Tsing Hua University(国立清华大学) National Taiwan University(国立台湾大学) National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 8 pages, 7 figures. Project webpage: https://tony2guo.github.io/precise-pick-and-place/

Journal ref 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2024, pp. 7484-7491

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15886 2025-02-18 cs.CV cs.AI 79%

CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models

Zheng Chong, Xiao Dong, Haoxiang Li, Shiyue Zhang, Wenqing Zhang, Xujie Zhang, Hanqing Zhao, Dongmei Jiang, Xiaodan Liang

机构 * Sun Yat-sen University(中山大学) Pixocial Technology(Pixocial科技公司) Pengcheng Laboratory(鹏城实验室) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Guangdong Key Laboratory of Big Data Analysis and Processing(广东省大数据分析与处理重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02879 2025-02-18 cs.CV 79%

Zero-Reference Lighting Estimation Diffusion Model for Low-Light Image Enhancement

Jinhong He, Minglong Xue, Aoxiang Ning, Chengyun Song

机构 * Chongqing University of Technology(重庆理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02676 2025-02-18 cs.RO cs.CV cs.LG 79%

Planning-Guided Diffusion Policy Learning for Generalizable Contact-Rich Bimanual Manipulation

Xuanlin Li, Tong Zhao, Xinghao Zhu, Jiuguang Wang, Tao Pang, Kuan Fang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09793 2025-02-17 cs.CV 79%

Noise Controlled CT Super-Resolution with Conditional Diffusion Model

Yuang Wang, Siyeop Yoon, Rui Hu, Baihui Yu, Duhgoon Lee, Rajiv Gupta, Li Zhang, Zhiqiang Chen, Dufan Wu

机构 * Massachusetts General Hospital(麻省总医院) Harvard Medical School(哈佛医学院) Neurologica Corp.(纽罗雷卡公司) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments The 8th International Conference on Image Formation in X-Ray Computed Tomography, Bamberg, Germany, August 5 - 9, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09533 2025-02-14 cs.CV 79%

Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model

Fei Shen, Cong Wang, Junyao Gao, Qin Guo, Jisheng Dang, Jinhui Tang, Tat-Seng Chua

机构 * Nanjing University of Science and Technology(南京理工大学) Nanjing University(南京大学) Tongji University(同济大学) Peking University(北京大学) Sun Yat-sen University(中山大学) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09164 2025-02-14 cs.CV cs.LG 79%

E-MD3C: Taming Masked Diffusion Transformers for Efficient Zero-Shot Object Customization

Trung X. Pham, Zhang Kang, Ji Woo Hong, Xuran Zheng, Chang D. Yoo

机构 * KAIST(韩国科学技术院) School of Electrical Engineering(电气工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 16 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02130 2025-02-14 cs.SD cs.CV eess.AS 79%

MDSGen: Fast and Efficient Masked Diffusion Temporal-Aware Transformers for Open-Domain Sound Generation

Trung X. Pham, Tri Ton, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院(KAIST))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02252 2025-02-13 cs.CV 79%

GlyphDraw2: Automatic Generation of Complex Glyph Posters with Diffusion Models and Large Language Models

Jian Ma, Yonglin Deng, Chen Chen, Nanyang Du, Haonan Lu, Zhenyu Yang

机构 * OPPO AI Center(OPPO人工智能中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15020 2025-02-13 cs.CV cs.AI cs.LG math.DS stat.ML 79%

AdjointDEIS: Efficient Gradients for Diffusion Models

Zander W. Blasingame, Chen Liu

机构 * Clarkson University(克拉克森大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments NeurIPS 2024 conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06822 2025-02-12 cs.LG cs.CL cs.GR 79%

DiffListener: Discrete Diffusion Model for Listener Generation

Siyeol Jung, Taehwan Kim

机构 * Artificial Intelligence Graduate School, UNIST(蔚山科学技术院人工智能研究生院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

Comments Accepted at ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06552 2025-02-11 cs.CV 79%

Diffusion Models for Computational Neuroimaging: A Survey

Haokai Zhao, Haowei Lou, Lina Yao, Wei Peng, Ehsan Adeli, Kilian M Pohl, Yu Zhang

机构 * UNSW Sydney(新南威尔士大学悉尼分校) CSIRO’s Data61(澳大利亚联邦科学与工业研究组织Data61) Stanford University(斯坦福大学) Lehigh University(理海大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 9 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏