arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70277 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2411.17973 2025-04-25 cs.CV cs.AI cs.LG 79%

Improved implicit diffusion model with knowledge distillation to estimate the spatial distribution density of carbon stock in remote sensing imagery

Zhenyu Yu, Jinnian Wang, Mohd Yamani Idna Idris

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16843 2025-04-24 cs.RO cs.GR 79%

Physically Consistent Humanoid Loco-Manipulation using Latent Diffusion Models

Ilyass Taouil, Haizhou Zhao, Angela Dai, Majid Khadiv

机构 * Technical University of Munich(慕尼黑技术大学) Tandon School of Engineering(工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04867 2025-04-24 cs.CV 79%

HandDiffuse: Generative Controllers for Two-Hand Interactions via Diffusion Models

Pei Lin, Sihang Xu, Hongdi Yang, Yiran Liu, Xin Chen, Jingya Wang, Jingyi Yu, Lan Xu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16016 2025-04-23 cs.CV 79%

Efficient Temporal Consistency in Diffusion-Based Video Editing with Adaptor Modules: A Theoretical Framework

Xinyuan Song, Yangfan He, Sida Li, Jianhui Wang, Hongyang He, Xinhang Yuan, Ruoyu Wang, Jiaqi Chen, Keqin Li, Kuan Lu, Menghao Huo, Binxu Li, Pei Liu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments arXiv admin note: substantial text overlap with arXiv:2501.04606

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15932 2025-04-23 cs.CV 79%

Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning

Wang Lin, Liyu Jia, Wentao Hu, Kaihang Pan, Zhongqi Yue, Wei Zhao, Jingyuan Chen, Fei Wu, Hanwang Zhang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Huawei Singapore Research Center(华为新加坡研究中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15267 2025-04-22 cs.CV 79%

Diffusion Bridge Models for 3D Medical Image Translation

Shaorong Zhang, Tamoghna Chattopadhyay, Sophia I. Thomopoulos, Jose-Luis Ambite, Paul M. Thompson, Greg Ver Steeg

机构 * University of California Riverside(加州大学河滨分校) Imaging Genetics Center, Mark and Mary Stevens Neuroimaging and Informatics Institute, Keck School of Medicine, University of Southern California(加州大学洛杉矶分校医学学院) Information Sciences Institute, University of Southern California(加州大学洛杉矶分校信息科学研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14952 2025-04-22 cs.CV eess.IV 79%

PIV-FlowDiffuser:Transfer-learning-based denoising diffusion models for PIV

Qianyu Zhu, Junjie Wang, Jeremiah Hu, Jia Ai, Yong Lee

机构 * organization= Hubei Provincial Engineering Research Center of Robotics \& Intelligent Manufacturing School of Mechanical Electronic Engineering, Wuhan University of Technology (WHUT) , addressline= 122 Luoshi Road , postcode= 430070 , postcodesep= , city= Wuhan , country= China

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10148 2025-04-22 cs.CV 79%

Hierarchical and Step-Layer-Wise Tuning of Attention Specialty for Multi-Instance Synthesis in Diffusion Transformers

Chunyang Zhang, Zhenhong Sun, Zhicheng Zhang, Junyan Wang, Yu Zhang, Dong Gong, Huadong Mo, Daoyi Dong

机构 * School of Systems and Computing University of New South Wales(系统与计算学院 新南威尔士大学) School of Engineering Australian National University(工程学院 澳大利亚国立大学) School of Business University of New South Wales(商学院 新南威尔士大学) Australian Institute for Machine Learning University of Adelaide(机器学习研究所 阿德莱德大学) School of Computer Science and Engineering University of New South Wales(计算机科学与工程学院 新南威尔士大学) School of Computer Science University of Technology Sydney(计算机科学学院 技术大学悉尼)

专题命中 扩散模型 :diffusion(title);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14535 2025-04-22 cs.CV 79%

FlowLoss: Dynamic Flow-Conditioned Loss Strategy for Video Diffusion Models

Kuanting Wu, Kei Ota, Asako Kanezaki

机构 * Science Tokyo(科学东京) Mitsubishi Electric(三菱电机)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14294 2025-04-22 cs.CV 79%

From Missing Pieces to Masterpieces: Image Completion with Context-Adaptive Diffusion

Pourya Shamsolmoali, Masoumeh Zareapoor, Huiyu Zhou, Michael Felsberg, Dacheng Tao, Xuelong Li

机构 * Department of Computer Science, University of York, UK(英国约克大学计算机科学系) SCEE, East China Normal University, China(中国华东师范大学SCEE) Department of Electrical Engineering, Shanghai Jiao Tong University, China(中国上海交通大学电子工程系) School of Computing and Mathematical Sciences, University of Leicester, UK(英国莱斯特大学计算与数学科学学院) Computer Vision Laboratory, Linkoping University, Sweden(瑞典利厄浦大学计算机视觉实验室) College of Computing and Data Science at Nanyang Technological University, Singapore(新加坡南洋理工大学计算与数据科学学院) Institute of Artificial Intelligence (TeleAI) of China Telecom(中国电信人工智能研究所(TeleAI))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments Accepted in TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07947 2025-04-22 eess.IV cs.AI cs.CV 79%

Conditional Brownian Bridge Diffusion Model for VHR SAR to Optical Image Translation

Seon-Hoon Kim, Dae-Won Chung

机构 * University of Science and Technology (UST)(科学技术大学) Korea Aerospace Research Institute(韩国航空航天研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 5 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07860 2025-04-22 cs.CV 79%

Controlling Space and Time with Diffusion Models

Daniel Watson, Saurabh Saxena, Lala Li, Andrea Tagliasacchi, David J. Fleet

机构 * Google DeepMind(谷歌DeepMind)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025, First three authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13561 2025-04-21 cs.CV 79%

WeatherGen: A Unified Diverse Weather Generator for LiDAR Point Clouds via Spider Mamba Diffusion

Yang Wu, Yun Zhu, Kaihua Zhang, Jianjun Qian, Jin Xie, Jian Yang

机构 * PCA Lab, Nanjing University of Science and Technology(南京理工大学光电信息科学与工程实验室) School of Automation, Southeast University(东南大学自动化学院) State Key Laboratory for Novel Software Technology, Nanjing University(南京大学软件新技术国家重点实验室) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11603 2025-04-21 cs.CV 79%

LaMD: Latent Motion Diffusion for Image-Conditional Video Generation

Yaosi Hu, Zhenzhong Chen, Chong Luo

机构 * School of Remote Sensing and Information Engineering, Wuhan University(武汉大学遥感信息工程学院) Microsoft Research Asia(微软亚洲研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments accepted by IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13026 2025-04-18 cs.CV 79%

TTRD3: Texture Transfer Residual Denoising Dual Diffusion Model for Remote Sensing Image Super-Resolution

Yide Liu, Haijiang Sun, Xiaowen Zhang, Qiaoyuan Liu, Zhouchang Chen, Chongzhuo Xiao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12605 2025-04-18 cs.CV 79%

AdaQual-Diff: Diffusion-Based Image Restoration via Adaptive Quality Prompting

Xin Su, Chen Wu, Yu Zhang, Chen Lyu, Zhuoran Zheng

机构 * Fuzhou University(福州大学) University of Science and Technology of China(中国科学技术大学) University of the Chinese Academy of Sciences(中国科学院大学) Shandong Normal University(山东师范大学) Sun Yat-sen University(中山大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12351 2025-04-18 cs.GR cs.AI eess.IV q-bio.TO 79%

Prototype-Guided Diffusion for Digital Pathology: Achieving Foundation Model Performance with Minimal Clinical Data

Ekaterina Redekop, Mara Pleasure, Vedrana Ivezic, Zichen Wang, Kimberly Flores, Anthony Sisk, William Speier, Corey Arnold

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12027 2025-04-18 cs.CV 79%

Understanding Attention Mechanism in Video Diffusion Models

Bingyan Liu, Chengyu Wang, Tongtong Su, Huan Ten, Jun Huang, Kailing Guo, Kui Jia

机构 * South China University of Technology(华南理工大学) Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05803 2025-04-18 cs.LG cs.AI cs.CV math.ST stat.TH 79%

Test-time Alignment of Diffusion Models without Reward Over-optimization

Sunwoo Kim, Minkyu Kim, Dongmin Park

机构 * Seoul National University(首尔大学) KRAFTON(克拉夫顿公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025 (Spotlight). The Thirteenth International Conference on Learning Representations. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12259 2025-04-17 cs.CV 79%

VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate

Zhihang Yuan, Rui Xie, Yuzhang Shang, Hanling Zhang, Siyuan Wang, Shengen Yan, Guohao Dai, Yu Wang

机构 * Tsinghua University(清华大学) Infinigence AI(智源人工智能) Illinois Tech(伊利诺伊理工大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12222 2025-04-17 cs.CV 79%

Coding-Prior Guided Diffusion Network for Video Deblurring

Yike Liu, Jianhui Zhang, Haipeng Li, Shuaicheng Liu, Bing Zeng

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12112 2025-04-17 cs.CV eess.IV 79%

A Diffusion-Based Framework for Terrain-Aware Remote Sensing Image Reconstruction

Zhenyu Yu, Mohd Yamani Inda Idris, Pei Wang

机构 * Universiti Malaya(马来亚大学) Kunming University of Science and Technology(昆明理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11923 2025-04-17 cs.LG cs.CV 79%

SemDiff: Generating Natural Unrestricted Adversarial Examples via Semantic Attributes Optimization in Diffusion Models

Zeyu Dai, Shengcai Liu, Rui He, Jiahao Wu, Ning Lu, Wenqi Fan, Qing Li, Ke Tang

机构 * Southern University of Science and Technology(南方科技大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11825 2025-04-17 eess.IV cs.CV 79%

TextDiffSeg: Text-guided Latent Diffusion Model for 3d Medical Images Segmentation

Kangbo Ma

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19653 2025-04-17 cs.CV cs.AI 79%

OpenSDI: Spotting Diffusion-Generated Images in the Open World

Yabin Wang, Zhiwu Huang, Xiaopeng Hong

机构 * University of Southampton(南安普顿大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11674 2025-04-17 cs.RO cs.CV 79%

DM-OSVP++: One-Shot View Planning Using 3D Diffusion Models for Active RGB-Based Object Reconstruction

Sicong Pan, Liren Jin, Xuying Huang, Cyrill Stachniss, Marija Popović, Maren Bennewitz

机构 * University of Bonn(波恩大学) Center for Robotics(机器人中心) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究所) Delft University of Technology(代尔夫特理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05402 2025-04-17 cs.CV 79%

Time-adaptive Video Frame Interpolation based on Residual Diffusion

Victor Fonte Chavez, Claudia Esteves, Jean-Bernard Hayet

机构 * Centro de Investigación en Matemáticas(数学研究中心) University of Guanajuato(瓜纳华托大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06817 2025-04-17 eess.IV cs.GR cs.LG 79%

Diffusion-empowered AutoPrompt MedSAM

Peng Huang, Shu Hu, Bo Peng, Xun Gong, Penghang Yin, Hongtu Zhu, Xi Wu, Xin Wang

机构 * School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院) Purdue University(普渡大学) University at Albany, State University of New York(纽约州立大学奥尔巴尼分校) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) School of Computer Science, Chengdu University of Information Technology(成都信息工程大学计算机学院) AI Plus Institute, University at Albany, State University of New York(纽约州立大学奥尔巴尼分校AI Plus研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15273 2025-04-17 cs.CV cs.LG eess.IV 79%

Recovering high-quality FODs from a reduced number of diffusion-weighted images using a model-driven deep learning architecture

J Bartlett, C E Davey, L A Johnston, J Duan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 10 pages, 7 figures, This work has been submitted to the IEEE for possible publication

Journal ref Magn Reson Med.2024;92:2193-2206

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11427 2025-04-16 cs.CV 79%

NormalCrafter: Learning Temporally Consistent Normals from Video Diffusion Priors

Yanrui Bin, Wenbo Hu, Haoyuan Wang, Xinya Chen, Bing Wang

机构 * The Hong Kong Polytechnic University(香港理工大学) Tencent PCG(腾讯平台与内容事业群) City University of Hong Kong(香港城市大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

Comments 9 pages, 6 figures, Project Page: https://normalcrafter.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏