arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86872 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2602.22610 2026-02-27 cs.LG cs.CV 79%

DP-aware AdaLN-Zero: Taming Conditioning-Induced Heavy-Tailed Gradients in Differentially Private Diffusion

DP-aware AdaLN-Zero: 降低差分隐私扩散中因条件诱导的重尾梯度

Tao Huang, Jiayang Meng, Xu Yang, Chen Hou, Hong Chen

机构 * School of Computer Science(计算机科学学院) Big Data, Minjiang University, Fuzhou, Fujian, China.(大数据,闽江大学,福州,福建,中国) School of Information, Renmin University of China, Beijing, China(信息学院,中国人民大学,北京,中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DP-aware AdaLN-Zero通过敏感性感知条件机制降低差分隐私扩散中因条件诱导的重尾梯度,提升隐私保护下的条件生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22594 2026-02-27 cs.CV 79%

Causal Motion Diffusion Models for Autoregressive Motion Generation

因果运动扩散模型用于自回归运动生成

Qing Yu, Akihisa Watanabe, Kent Fujiwara

机构 * LY Corporation(LY公司) Waseda University(早稻田大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出因果运动扩散模型,通过因果扩散变换器实现高质量运动生成,提升语义保真度与时间平滑度,同时减少推理延迟。

Comments Accepted to CVPR 2026, Project website: https://yu1ut.com/CMDM-HP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11025 2026-02-27 cs.CV 79%

Human-Guided Shade Artifact Suppression in CBCT-to-MDCT Translation via Schrödinger Bridge with Conditional Diffusion

基于Schrödinger Bridge的受人类指导的CBCT到MDCT翻译中的阴影伪影抑制

Sung Ho Kang, Hyun-Cheol Park

机构 * National Institute for Mathematical Sciences(国家信息科学研究院) Department of Computer Engineering, Korea National University of Transportation(计算机工程系,韩国交通国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于Schrödinger Bridge的框架,通过人类指导的条件扩散模型实现CBCT到MDCT的翻译,有效抑制阴影伪影并提升医学图像的解剖学准确性与感知可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.09861 2026-02-27 cs.CV 79%

BSDM: Background Suppression Diffusion Model for Hyperspectral Anomaly Detection

BSDM:超分辨率异常检测的背景抑制扩散模型

Jitao Ma, Weiying Xie, Yunsong Li, Leyuan Fang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 BSDM通过设计伪背景噪声和改进扩散模型推断过程,实现无需标注样本的超光谱异常检测背景抑制。

Journal ref IEEE Transactions on Circuits and Systems for Video Technology, 31, 1, 190-204, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21942 2026-02-26 cs.CV 79%

Directed Ordinal Diffusion Regularization for Progression-Aware Diabetic Retinopathy Grading

定向序扩散正则化用于进展感知的糖尿病视网膜病变分级

Huangwei Chen, Junhao Jia, Ruocheng Li, Cunyuan Yang, Wu Li, Xiaotao Pang, Yifei Chen, Haishuai Wang, Jiajun Bu, Lei Wu

机构 * Zhejiang Key Laboratory of Accessible Perception and Intelligent Systems(浙江可感知系统重点实验室) College of Computer Science and Technology(计算机科学与技术学院) Hangzhou Pujian Medical Technology Co., Ltd(杭州普健医疗科技有限公司) Hangzhou Dianzi University(杭州电子科技大学) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出D-ODR方法,通过构建有向图和多尺度扩散正则化,解决糖尿病视网膜病变分级中疾病进展方向性建模问题,提升分级性能和临床可靠性。

Comments 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21760 2026-02-26 cs.CV 79%

Accelerating Diffusion via Hybrid Data-Pipeline Parallelism Based on Conditional Guidance Scheduling

通过基于条件引导调度的混合数据-流水线并行加速扩散

Euisoo Jung, Byunghyun Kim, Hyunjin Kim, Seonghye Cho, Jae-Gil Lee

机构 * School of Computing, KAIST(计算机学院,韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种混合并行框架,通过条件引导调度和自适应流水线切换,提升扩散模型的生成效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01617 2026-02-26 cs.CV 79%

LLaDA-MedV: Exploring Large Language Diffusion Models for Biomedical Image Understanding

LLaDA-MedV:探索大规模语言扩散模型用于生物医学图像理解

Xuanzhao Dong, Wenhui Zhu, Xiwen Chen, Zhipeng Wang, Peijie Qiu, Shao Tang, Xin Li, Yalin Wang

机构 * Arizona State University(亚利桑那州立大学) Clemson University(克莱姆森大学) LinkedIn Corporation(领英公司) Washington University in St. Louis(圣路易斯华盛顿大学) Morgan Stanley(摩根大通)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 LLaDA-MedV通过视觉指令微调,首次在生物医学图像理解中应用大规模语言扩散模型,实现了在生物医学视觉对话任务中的性能提升,并在多个VQA基准测试中取得新高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08422 2026-02-26 cs.CV eess.IV 79%

Training-free Mixed-Resolution Latent Upsampling for Spatially Accelerated Diffusion Transformers

无需训练的混合分辨率潜在上采样用于空间加速的扩散变换器

Wongi Jeong, Kyungryeol Lee, Hoigi Seo, Se Young Chun

机构 * Dept. of Electrical and Computer Engineering(电气与计算机工程系) INMC & IPAI(INMC与IPAI) Seoul National University(首尔国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出无需训练的混合分辨率潜在上采样方法RALU,通过优化空间加速实现DiTs的高效生成,可在不同模型上实现高达15.9倍的加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21319 2026-02-26 cs.LG cs.CV cs.RO 79%

Uncertainty-Aware Diffusion Model for Multimodal Highway Trajectory Prediction via DDIM Sampling

面向多模态高速公路轨迹预测的不确定性感知扩散模型 via DDIM采样

Marion Neumeier, Niklas Roßberg, Michael Botsch, Wolfgang Utschick

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出cVMDx模型,通过DDIM采样提升效率和鲁棒性,实现高效多模态轨迹预测并增强不确定性估计能力。

Comments Accepted as a conference paper in IEEE Intelligent Vehicles Symposium (IV) 2026, Detroit, MI, United States

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17167 2026-02-26 cs.LG cs.AI cs.CV 79%

Improving Denoising Diffusion Models via Simultaneous Estimation of Image and Noise

通过同时估计图像和噪声改进去噪扩散模型

Zhenkai Zhang, Krista A. Ehinger, Tom Drummond

机构 * School of Computing and Information Systems The University of Melbourne(计算机与信息系统学院 澳大利亚墨尔本大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文通过重新参数化扩散过程和直接估计图像与噪声,改进了去噪扩散模型,实现了更快的生成速度和更高的图像质量。

Comments Published in Proceedings of the 15th Asian Conference on Machine Learning, PMLR 222:1638-1653, 2024

Journal ref Proceedings of the 15th Asian Conference on Machine Learning, PMLR 222:1638-1653, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20752 2026-02-25 cs.CV cs.AI 79%

OrthoDiffusion: A Generalizable Multi-Task Diffusion Foundation Model for Musculoskeletal MRI Interpretation

OrthoDiffusion:一种通用的多任务扩散基础模型用于骨科MRI解释

Tian Lan, Lei Xu, Zimu Yuan, Shanggui Liu, Jiajun Liu, Jiaxin Liu, Weilai Xiang, Hongyu Yang, Dong Jiang, Jianxin Yin, Dingyu Wang

机构 * Center for Applied Statistics and School of Statistics(应用统计中心和统计学院) Renmin University of China(中国人民大学) Institute of Sports Medicine of Peking University(北京大学运动医学研究所) Beijing Key Laboratory of Research and Translation for Drugs and Medical Devices in Precision Diagnosis and Treatment of Sports Injuries(北京体育损伤精准诊断与治疗药物与医疗设备研究翻译重点实验室) State Key Laboratory of Virtual Reality Technology and Systems(虚拟现实技术与系统国家重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 OrthoDiffusion是一种基于扩散的多任务基础模型,通过自监督学习在膝关节MRI上预训练,实现11种结构分割和8种异常检测,具有跨关节的高泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20583 2026-02-25 cs.CV 79%

PropFly: Learning to Propagate via On-the-Fly Supervision from Pre-trained Video Diffusion Models

PropFly: 通过预训练视频扩散模型的实时监督学习进行传播

Wonyong Seo, Jaeho Moon, Jaehyup Lee, Soo Ye Kim, Munchurl Kim

机构 * KAIST(韩国科学技术院) Kyungpook National University(庆北国立大学) Adobe Research(Adobe研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 PropFly通过预训练视频扩散模型的实时监督学习,实现基于传播的视频编辑,无需配对数据集,提升编辑质量和一致性。

Comments The first two authors contributed equally to this work (equal contribution)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20577 2026-02-25 cs.CV 79%

Efficient and Explainable End-to-End Autonomous Driving via Masked Vision-Language-Action Diffusion

高效的端到端自动驾驶:通过掩码视觉-语言-动作扩散

Jiaru Zhang, Manav Gagvani, Can Cui, Juntong Peng, Ruqi Zhang, Ziran Wang

机构 * Institute for Physical Artificial Intelligence (IPAI), Purdue University(物理人工智能研究所(IPAI)、普渡大学) College of Engineering, Purdue University(工程学院、普渡大学) Department of Computer Science, Purdue University(计算机科学系、普渡大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 MVLAD-AD通过掩码视觉-语言-动作扩散模型,提升自动驾驶的效率与规划精度,实现高效且可解释的端到端自动驾驶。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19931 2026-02-24 cs.LG cs.CV 79%

Expanding the Role of Diffusion Models for Robust Classifier Training

扩展扩散模型在鲁棒分类器训练中的作用

Pin-Han Huang, Shang-Tse Chen, Hsuan-Tien Lin

机构 * National Taiwan University(国立台湾大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本研究通过扩展扩散模型在对抗训练中的作用,发现其内部表示能提升鲁棒分类器的训练效果,并验证了扩散表示与合成数据的互补作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19512 2026-02-24 cs.LG cs.CV 79%

Variational Trajectory Optimization of Anisotropic Diffusion Schedules

变分轨迹优化非各向同性扩散计划

Pengxi Liu, Zeyu Michael Li, Xiang Cheng

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Duke University(杜克大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于变分轨迹优化的非各向同性扩散模型,通过矩阵值路径优化噪声计划,提升扩散模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19506 2026-02-24 cs.CV cs.LG 79%

Relational Feature Caching for Accelerating Diffusion Transformers

关系特征缓存用于加速扩散变换器

Byunggwan Son, Jeimin Jeon, Jeongwoo Choi, Bumsub Ham

机构 * Yonsei University(延世大学) Korea Institute of Science and Technology (KIST)(韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出关系特征缓存(RFC)方法,通过利用输入-输出关系提升特征预测准确性,有效减少扩散变换器的计算开销。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19180 2026-02-24 cs.CV 79%

VLM-Guided Group Preference Alignment for Diffusion-based Human Mesh Recovery

基于扩散模型的人体网格恢复中的群体偏好对齐

Wenhao Shen, Hao Wang, Wanqi Yin, Fayao Liu, Xulei Yang, Chao Liang, Zhongang Cai, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) HKUST(GZ)(香港科技大学(广州)) SenseTime Research(商汤科技研究院) A*STAR(新加坡科技研究局)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于群体偏好的扩散模型微调框架,通过双内存增强的批评代理生成质量评分,提升人体网格恢复的物理合理性和图像一致性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19064 2026-02-24 cs.CV 79%

L3DR: 3D-aware LiDAR Diffusion and Rectification

L3DR:基于3D感知的LiDAR扩散与校正

Quan Liu, Xiaoqin Zhang, Ling Shao, Shijian Lu

机构 * Nanyang Technological University(南洋理工大学) Zhejiang University of Technology(浙江工业大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 L3DR通过3D-aware的LiDAR扩散和校正框架,在3D空间中消除RV伪影并恢复局部几何结构,实现更真实的3D几何生成。

Comments In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15082 2026-02-24 cs.SD cs.AI cs.MM 79%

S-PRESSO: Ultra Low Bitrate Sound Effect Compression With Diffusion Autoencoders And Offline Quantization

S-PRESSO:基于扩散自编码器和离线量化的小 bitrate 声音效果压缩

Zineb Lahrichi, Gaëtan Hadjeres, Gaël Richard, Geoffroy Peeters

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

AI总结 S-PRESSO通过扩散自编码器和离线量化,在极低bitrate下实现高质量声音效果压缩。

Journal ref International Conference on Acoustics, Speech, and Signal Processing (ICASSP), May 2026, Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05571 2026-02-24 cs.CV 79%

MedDIFT: Multi-Scale Diffusion-Based Correspondence in 3D Medical Imaging

MedDIFT:3D医学影像中的多尺度扩散对应方法

Xingyu Zhang, Anna Reithmeir, Fryderyk Kögl, Rickmer Braren, Julia A. Schnabel, Daniel M. Lang

机构 * 1 School of Computation, Information Technology, Technical University of Munich 2 Institute of Machine Learning in Biomedical Imaging, Helmholtz Munich 3 Munich Center for Machine Learning (MCML) 4 Institute for Diagnostic Interventional Radiology, Klinkum Rechts der Isar 5 School of Biomedical Engineering \& Imaging Sciences, King’s College London

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 MedDIFT通过多尺度扩散特征融合实现无需训练的3D医学影像对应,有效提升解剖结构匹配精度。

Comments Updated results

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05016 2026-02-24 cs.CV 79%

Generative Neural Video Compression via Video Diffusion Prior

基于视频扩散先验的生成神经视频压缩

Qi Mao, Hao Cheng, Tinghan Yang, Libiao Jin, Siwei Ma

机构 * School of Information and Communication Engineering, Communication University of China(信息与通信工程学院,通信大学) School of Computer Science, Peking University(计算机学院,北京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 GNVC-VD通过结合视频扩散先验和序列级去噪,实现了高效的生成神经视频压缩,显著减少了闪烁伪影并提升了感知质量。

Comments accept by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19166 2026-02-24 cs.MM 79%

Step-Aware Residual-Guided Diffusion for EEG Spatial Super-Resolution

步感知残差引导扩散用于EEG空间超分辨率

Hongjun Liu, Leyu Zhou, Zijianghao Yang, Chao Yao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

AI总结 SRGDiff通过步感知残差引导扩散模型,提升EEG空间超分辨率的保真度与一致性,实现高达40%的性能提升。

Comments ICLR 2026 Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23377 2026-02-24 cs.CV cs.AI cs.SD eess.AS 79%

JavisDiT: Joint Audio-Video Diffusion Transformer with Hierarchical Spatio-Temporal Prior Synchronization

JavisDiT:具有层次化时空先验同步的联合音频视频扩散变换器

Kai Liu, Wei Li, Lai Chen, Shengqiong Wu, Yanhao Zheng, Jiayi Ji, Fan Zhou, Jiebo Luo, Ziwei Liu, Hao Fei, Tat-Seng Chua

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) University of Rochester(罗切斯特大学) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 JavisDiT通过层次化时空先验同步机制,实现了高质量的音频视频同步生成,解决了现实场景中的同步评估问题。

Comments Accepted by ICLR 2026. Homepage: https://javisverse.github.io/JavisDiT-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18874 2026-02-24 cs.CV cs.AI 79%

Structure-Level Disentangled Diffusion for Few-Shot Chinese Font Generation

结构层面解耦的扩散模型用于少样本中文字体生成

Jie Li, Suorong Yang, Jian Zhao, Furao Shen

机构 * State Key Laboratory for Novel Software Technology, Nanjing University, China(新型软件技术国家重点实验室) School of Artificial Intelligence, Nanjing University, China(人工智能学院) Department of Computer Science and Technology, Nanjing University, China(计算机科学与技术系) School of Electronic Science and Engineering, Nanjing University, China(电子科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 SLD-Font通过结构层面解耦和参数高效微调,实现少样本中文字体生成中更高的风格保真度和内容准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18428 2026-02-23 cs.LG cs.CV eess.IV 79%

The Geometry of Noise: Why Diffusion Models Don't Need Noise Conditioning

噪声的几何学:为什么扩散模型不需要噪声条件

Mojtaba Sahraee-Ardakan, Mauricio Delbracio, Peyman Milanfar

机构 * Google(谷歌)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究通过形式化边际能量,揭示了自主生成模型在噪声无关条件下的稳定生成机制,并证明其通过黎曼梯度流实现稳定吸引子。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11603 2026-02-20 cs.CV 79%

CoreEditor: Correspondence-constrained Diffusion for Consistent 3D Editing

CoreEditor: 基于对应关系的扩散模型用于一致的3D编辑

Zhe Zhu, Honghua Chen, Peng Li, Mingqiang Wei

机构 * School of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院) Shenzhen Research Institute, Nanjing University of Aeronautics and Astronautics(南京航空航天大学深圳研究院) School of Data Science, Lingnan University(岭南大学数据科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 CoreEditor通过引入对应关系约束的注意力机制,实现了高质量且一致的3D编辑,显著优于现有方法。

Comments Accepted by IEEE TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16968 2026-02-20 cs.CV cs.AI 79%

DDiT: Dynamic Patch Scheduling for Efficient Diffusion Transformers

DDiT: 动态补丁调度用于高效的扩散变换器

Dahye Kim, Deepti Ghadiyaram, Raghudeep Gadde

机构 * Boston University(波士顿大学) Amazon(亚马逊)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DDiT通过动态调整补丁大小,在保持生成质量的同时显著提升扩散变换器的推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07835 2026-02-20 cs.CV 79%

VFace: A Training-Free Approach for Diffusion-Based Video Face Swapping

VFace:一种无需训练的基于扩散模型的视频人脸交换方法

Sanoojan Baliah, Yohan Abeysinghe, Rusiru Thushara, Khan Muhammad, Abhinav Dhall, Karthik Nandakumar, Muhammad Haris Khan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 VFace提出一种无需训练的视频人脸交换方法,通过频率谱注意力插值、目标结构引导和流引导注意力时间平滑机制,提升时间一致性和视觉保真度。

Comments Accepted at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00191 2026-02-19 cs.LG cs.CV 79%

GEPC: Group-Equivariant Posterior Consistency for Out-of-Distribution Detection in Diffusion Models

GEPC: 组等变后验一致性用于扩散模型中的分布外检测

Yadang Alexis Rouzoumka, Jean Pinsolle, Eugénie Terreaux, Christèle Morisseau, Jean-Philippe Ovarlez, Chengfang Ren

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 GEPC通过测量分数在有限群下的变换一致性,实现扩散模型中分布外检测的后验一致性,提供轻量级且可解释的检测方法。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15030 2026-02-17 cs.CV 79%

Image Generation with a Sphere Encoder

基于球体编码器的图像生成

Kaiyu Yue, Menglin Jia, Ji Hou, Tom Goldstein

机构 * Meta University of Maryland(马里兰大学)

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

AI总结 Sphere Encoder通过球形潜在空间生成图像,以更少的步骤实现与多步扩散模型相当的性能,且推理成本更低。

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏