arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86872 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2603.13943 2026-03-17 cs.CV cs.LG 79%

Sat-JEPA-Diff: Bridging Self-Supervised Learning and Generative Diffusion for Remote Sensing

Sat-JEPA-Diff: 联合自监督学习与生成扩散模型以实现遥感图像预测

Kursat Komurcu, Linas Petkevicius

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Sat-JEPA-Diff,结合自监督学习与隐藏扩散模型,解决遥感图像预测中结构准确与纹理细节的平衡问题,实现高精度纹理生成与结构预测的结合。

Comments ICLR 2026 Workshop ML4RS Main Track: https://openreview.net/forum?id=WBHfQLbgZR

Journal ref 4th ICLR 2026 Workshop on Machine Learning for Remote Sensing (Main Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07234 2026-03-17 cs.CV 79%

Single Image Super-Resolution via Bivariate `A Trous Wavelet Diffusion

通过双变量A Trous小波扩散实现单图像超分辨率

Maryam Heidari, Nantheera Anantrasirichai, Alin Achim

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出BATDiff模型,通过双变量跨尺度模块提升超分辨率中高频细节的结构一致性和质量,实验表明其在标准基准上优于现有方法。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01478 2026-03-17 cs.CV cs.AI cs.LG 79%

Purrception: Variational Flow Matching for Vector-Quantized Image Generation

Purrception:基于向量量化图像生成的变分流匹配

Răzvan-Andrei Matişan, Vincent Tao Hu, Grigory Bartosh, Björn Ommer, Cees G. M. Snoek, Max Welling, Jan-Willem van de Meent, Mohammad Mahdi Derakhshani, Floor Eijkelboom

专题命中 扩散模型 :image generation(title,abstract);分类 cs.CV

AI总结 Purrception结合连续方法的几何意识与离散监督的分类监督,通过学习代码本索引的类别后验和连续嵌入空间中的速度场,实现对潜在代码的不确定性量化和温度控制生成。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14811 2026-03-17 cs.CV cs.AI 79%

SegQuant: A Semantics-Aware and Generalizable Quantization Framework for Diffusion Models

SegQuant: 一种语义感知且通用的扩散模型量化框架

Jiaji Zhang, Ruichao Sun, Hailiang Zhao, Jiaju Wu, Peng Chen, Hao Li, Yuying Liu, Kingsum Chow, Gang Xiong, Shuiguang Deng

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 SegQuant提出一种统一的量化框架,通过自适应结合互补技术提升跨模型通用性,采用结构感知图量化策略和双尺度量化方案,有效保持视觉保真度,适用于Transformer扩散模型及其他模型。

Comments 22 pages, 15 figures, to be published in The IEEE/CVF Conference on Computer Vision and Pattern Recognition 2026 (CVPR 2026), code is available at https://github.com/OptiSys-ZJU/segquant

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04446 2026-03-17 cs.CV 79%

DiCoDe: Diffusion-Compressed Deep Tokens for Autoregressive Video Generation with Language Models

DiCoDe:扩散压缩深度标记用于语言模型的自回归视频生成

Yizhuo Li, Yuying Ge, Yixiao Ge, Ying Shan, Ping Luo

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiCoDe利用扩散压缩深度标记,通过自回归语言模型生成视频,实现高效压缩与高质量输出,展示了在视频建模中的潜力。

Comments Project Page: https://liyz15.github.io/DiCoDe

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13435 2026-03-17 cs.CV cs.AI cs.CR 79%

CtrlAttack: A Unified Attack on World-Model Control in Diffusion Models

CtrlAttack:一种针对扩散模型世界模型控制的统一攻击

Shuhan Xu, Siyuan Liang, Hongling Zheng, Yong Luo, Han Hu, Lefei Zhang, Dacheng Tao

机构 * Wuhan University(武汉大学) Nanyang Technological University(南洋理工大学) Beijing Institute of Technology(北京理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出CtrlAttack攻击方法,针对扩散模型中的时间动态建模漏洞,通过低维速度场干扰状态转移,提升攻击成功率并揭示模型在状态动态层面的安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13405 2026-03-17 cs.CV eess.IV 79%

Anchor Forcing: Anchor Memory and Tri-Region RoPE for Interactive Streaming Video Diffusion

锚点强制:用于交互式流视频扩散的锚点记忆与三区域RoPE

Yang Yang, Tianyi Zhang, Wei Huang, Jinwei Chen, Boxi Wu, Xiaofei He, Deng Cai, Bo Li, Peng-Tao Jiang

机构 * Zhejiang University(浙江大学) vivo BlueImage Lab(vivo蓝影实验室) University of Hong Kong(香港大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出锚点强制框架,通过锚点引导重置缓存和三区域RoPE解决交互式流视频生成中的质量退化和运动动态减弱问题,提升感知质量和运动指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13330 2026-03-17 cs.LG cs.CV 79%

RBF-Solver: A Multistep Sampler for Diffusion Probabilistic Models via Radial Basis Functions

RBF-Solver: 通过径向基函数的多步采样器用于扩散概率模型

Soochul Park, Yeon Ju Lee, SeongJin Yoon, Jiyub Shin, Juhee Lee, Seongwoon Jo

机构 * SteAI Korea University(韩国大学) SoftAI Bogonet SBS MODULABS

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出RBF-Solver,通过径向基函数插值模型评估,实现多步扩散采样,提高采样效率和图像保真度,适用于高NFE和低NFE场景,优于多项式基采样器。

Comments 49 pages , 5 figures , Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13069 2026-03-16 cs.LG cs.CV cs.IT math.DS math.IT 79%

Fractals made Practical: Denoising Diffusion as Partitioned Iterated Function Systems

分形的实用化:去噪扩散作为分段迭代函数系统

Ann Dooms

机构 * Department of Mathematics & Data Science(数学与数据科学系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文通过分段迭代函数系统框架,揭示扩散模型的去噪动态,并提出三种可计算的几何量,解释了扩散模型的双阶段行为,同时推导出三个最优设计准则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13007 2026-03-16 eess.IV cs.CV cs.LG physics.med-ph 79%

Accelerating Stroke MRI with Diffusion Probabilistic Models through Large-Scale Pre-training and Target-Specific Fine-Tuning

通过大规模预训练和目标特定微调加速中风MRI

Yamin Arefeen, Sidharth Kumar, Steven Warach, Hamidreza Saber, Jonathan Tamir

机构 * Chandra Family Department of Electrical and Computer Engineering(查克拉家族电气与计算机工程系) Department of Imaging Physics(成像物理系) Dell Medical School Department of Neurology(德莱尔医学院神经学系) Dell Medical School Department of Neurosurgery(德莱尔医学院神经外科系) Dell Medical School Department of Diagnostic Medicine(德莱尔医学院诊断医学系) Oden Institute for Computational Engineering and Sciences(奥登计算工程与科学研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种高效策略,利用扩散概率生成模型在有限数据下加速MRI重建,通过大规模预训练和目标特定微调实现临床中风MRI的快速扫描。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19577 2026-03-16 cs.CV 79%

MaDiS: Taming Masked Diffusion Language Models for Sign Language Generation

MaDiS:驯服掩码扩散语言模型用于手语生成

Ronglai Zuo, Rolandos Alexandros Potamias, Qi Sun, Evangelos Ververas, Jiankang Deng, Stefanos Zafeiriou

机构 * Imperial College London(伦敦帝国学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MaDiS,一种基于掩码扩散的语言模型,用于手语生成,通过双向依赖捕捉和高效并行多令牌生成,提升生成效率和质量,同时引入三级交叉模态预训练方案和混合部分嵌入层,实现多层级手语表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12581 2026-03-16 eess.IV cs.AI cs.CV 79%

Multiscale Structure-Guided Latent Diffusion for Multimodal MRI Translation

多尺度结构引导的潜在扩散模型用于多模态MRI翻译

Jianqiang Lin, Zhiqiang Shen, Peng Cao, Jinzhu Yang, Osmar R. Zaiane, Xiaoli Liu

机构 * Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程系,沈阳,中国) Key Laboratory of Intelligent Computing in Medical Image of Ministry of Education, Northeastern University, Shenyang, China(教育部医学图像智能计算重点实验室,东北大学,沈阳,中国) National Frontiers Science Center for Industrial Intelligence and Systems Optimization, Shenyang, China(工业智能与系统优化国家级前沿科学中心,沈阳,中国) Amii, University of Alberta, Edmonton, Alberta, Canada(阿尔伯塔大学阿米人工智能研究所,埃德蒙顿,阿尔伯塔,加拿大) AiShiWeiLai AI Research, Beijing, China(人工智能研究(北京)有限公司,北京,中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MSG-LDM框架,通过多尺度特征空间分离风格与结构信息,提升多模态MRI翻译的结构一致性与纹理细节。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08820 2026-03-16 cs.CV 79%

Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing

Omni-Video 2:基于MLLM条件扩散模型的统一视频生成与编辑扩展

Hao Yang, Zhiyu Tan, Jia Gong, Luozheng Qin, Hesen Chen, Xiaomeng Yang, Yuqing Sun, Yuetan Lin, Mengping Yang, Hao Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Omni-Video 2,通过连接预训练多模态大语言模型与视频扩散模型,实现视频生成与编辑的统一。核心方法是利用MLLM生成明确的目标描述以指导生成过程,并通过轻量适配器高效注入多模态条件token,提升复杂编辑任务性能。

Comments Technical Report, Project: https://howellyoung-s.github.io/Omni-Video2-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07540 2026-03-16 cs.CV 79%

Enhancing Novel View Synthesis via Geometry Grounded Set Diffusion

通过几何引导的集扩散增强新视角合成

Farhad G. Zanjani, Hong Cai, Amirhossein Habibian

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出SetDiff框架,结合3D先验、坐标映射和姿态感知的Plucker射线嵌入,提升多视角扩散模型在处理可变参考和目标视角时的鲁棒性和视觉保真度。

Comments Paper and supplementary materials

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02267 2026-03-16 cs.CV 79%

DiffProxy: Multi-View Human Mesh Recovery via Diffusion-Generated Dense Proxies

DiffProxy:通过扩散生成的密集代理进行多视图人体网格恢复

Renke Wang, Zhenyu Zhang, Ying Tai, Jun Li, Jian Yang

机构 * PCA Lab(PCA实验室) Nanjing University of Science and Technology(南京理工大学) School of Intelligent Science and Technology(智能科学与技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffProxy利用预训练扩散模型生成密集像素到表面对应关系,通过多条件代理生成器和手部细化技术,实现高精度人体网格恢复,无需真实数据训练。

Comments Page: https://wrk226.github.io/DiffProxy.html, Code: https://github.com/wrk226/DiffProxy

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14327 2026-03-16 cs.CV 79%

MoVieDrive: Urban Scene Synthesis with Multi-Modal Multi-View Video Diffusion Transformer

MoVieDrive:基于多模态多视角视频扩散变换器的城市场景合成

Guile Wu, David Huang, Dongfeng Bai, Bingbing Liu

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University of Toronto(多伦多大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MoVieDrive,通过多模态多视角视频扩散变换器生成城市驾驶场景视频,实现多模态数据生成与可控生成。

Comments CVPR 2026 Findings Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12245 2026-03-13 cs.CV 79%

One Model, Many Budgets: Elastic Latent Interfaces for Diffusion Transformers

一个模型,多种预算:弹性潜在接口用于扩散变换器

Moayed Haji-Ali, Willi Menapace, Ivan Skorokhodov, Dogyun Park, Anil Kag, Michael Vasilkovsky, Sergey Tulyakov, Vicente Ordonez, Aliaksandr Siarohin

机构 * Rice University(里士大学) Snap Inc.(Snap公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ELIT通过引入弹性潜在接口,解耦输入图像大小与计算资源,优化生成质量与计算效率的平衡,实现多场景下的性能提升。

Comments Project page: https://snap-research.github.io/elit/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07504 2026-03-13 cs.CV 79%

High-Fidelity Medical Shape Generation via Skeletal Latent Diffusion

通过骨骼潜在扩散实现高保真的医学形状生成

Guoqing Zhang, Jingyun Yang, Siqi Chen, Anping Zhang, Yang Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种骨骼潜在扩散框架,通过结合结构先验实现高效高保真医学形状生成,并构建了大规模MedSDF数据集以提升生成质量与效率。

Comments 11 pages, 5 figures, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11509 2026-03-13 cs.CV 79%

Manifold-Optimal Guidance: A Unified Riemannian Control View of Diffusion Guidance

流形最优引导:扩散引导的黎曼控制视角统一观

Zexi Jia, Pengcheng Luo, Zhengyao Fang, Jinchao Zhang, Jie Zhou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出流形最优引导(MOG)和Auto-MOG,通过黎曼控制视角解决扩散引导中的几何不匹配问题,提升生成质量并减少计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10365 2026-03-13 cs.CV 79%

Geometric Autoencoder for Diffusion Models

几何自编码器用于扩散模型

Hangyu Liu, Jianyong Wang, Yutao Sun

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出几何自编码器GAE,通过优化低维语义监督目标和潜在规范化,提升扩散模型在生成质量、压缩与稳健重建之间的平衡,实现更高效的高分辨率视觉生成。

Comments Code and models are publicly available at https://github.com/sii-research/GAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24161 2026-03-13 cs.CV 79%

GeoDiff4D: Geometry-Aware Diffusion for 4D Head Avatar Reconstruction

GeoDiff4D: 基于几何的扩散模型用于4D头像重建

Chao Xu, Xiaochen Zhao, Xiang Deng, Jingxiang Sun, Donglin Di, Zhuo Su, Yebin Liu

机构 * Tsinghua University(清华大学) Li Auto(利亚自动)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 GeoDiff4D通过几何感知扩散模型,结合表面法线和表情编码器,实现了高保真的4D头像重建,提升了视觉质量和跨身份泛化能力。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26489 2026-03-13 cs.CV cs.LG eess.SP 79%

Contrastive Diffusion Guidance for Spatial Inverse Problems

对比扩散引导用于空间逆问题

Sattwik Basu, Chaitanya Amballa, Zhongweiyang Xu, Jorge Vančo Sampedro, Srihari Nelakuditi, Romit Roy Choudhury

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of South Carolina(南卡罗来纳大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出CoGuide模型,通过对比学习在平滑嵌入空间中近似似然分数,以解决空间逆问题中的非可微前向算子挑战,实现更稳定的去噪和更稳健的重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05662 2026-03-13 cs.CV 79%

InvAD: Inversion-based Reconstruction-Free Anomaly Detection with Diffusion Models

InvAD: 基于逆向的无重建异常检测方法与扩散模型

Shunsuke Sakai, Xiangteng He, Chunzhi Gu, Leonid Sigal, Tatsuhito Hasegawa

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 InvAD提出了一种基于逆向的无重建异常检测方法,通过DDIM逆向推断潜在变量并利用先验分布测量偏差,实现高效且准确的异常检测。

Comments Accepted to CVPR2026. Project page: https://invad-project.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10470 2026-03-12 cs.CV 79%

Fighting Hallucinations with Counterfactuals: Diffusion-Guided Perturbations for LVLM Hallucination Suppression

用反事实对抗幻觉:基于扩散引导的扰动用于LVLM幻觉抑制

Hamidreza Dastmalchi, Aijun An, Ali Cheraghian, Hamed Barzamini

机构 * York University(约克大学) Macquarie University(麦考瑞大学) Northern Illinois University(北伊利诺伊大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 CIPHER通过反事实图像扰动减少LVLM中的视觉幻觉,提升模型忠实性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10391 2026-03-12 cs.LG cs.CV 79%

Variance-Aware Adaptive Weighting for Diffusion Model Training

基于方差意识的扩散模型训练自适应加权

Nanlong Sun, Lei Shi

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种基于方差意识的自适应加权策略,用于改进扩散模型的训练稳定性与生成性能。

Comments 15 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10314 2026-03-12 cs.CR cs.MM cs.SD 79%

PRoADS: Provably Secure and Robust Audio Diffusion Steganography with latent optimization and backward Euler Inversion

PRoADS: 基于音频扩散模型的可证明安全且稳健的音频隐写框架:利用潜在优化和后向欧拉反演

YongPeng Yan, Yanan Li, Qiyang Xiao, Yanzhen Ren

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

AI总结 PRoADS通过正交矩阵投影和潜在优化技术,在音频扩散模型中实现可证明安全且稳健的隐写,达到0.15%的低比特错误率。

Comments This paper has been accepted for presentation at the 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09819 2026-03-11 cs.CV 79%

ConfCtrl: Enabling Precise Camera Control in Video Diffusion via Confidence-Aware Interpolation

ConfCtrl: 通过置信度感知插值实现视频扩散中的精确相机控制

Liudi Yang, George Eskandar, Fengyi Shen, Mohammad Altillawi, Yang Bai, Chi Zhang, Ziyuan Liu, Abhinav Valada

机构 * University of Freiburg(弗赖堡大学) Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) Technical University of Munich(慕尼黑技术大学) Huawei Heisenberg Research Center (Munich)(华为海森堡研究中心(慕尼黑))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ConfCtrl通过置信度感知插值实现视频扩散中的精确相机控制,解决大视角变化下新视角生成问题,提升几何一致性与视觉合理性。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09657 2026-03-11 cs.CV cs.AI cs.ET eess.IV 79%

When to Lock Attention: Training-Free KV Control in Video Diffusion

何时锁定注意力:视频扩散中的无训练KV控制

Tianyi Zeng, Jincheng Gao, Tianyi Wang, Zijie Meng, Miao Zhang, Jun Yin, Haoyuan Sun, Junfeng Jiao, Christian Claudel, Junbo Tan, Xueqian Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 KV-Lock通过动态调度KV融合比和CFG尺度,提升视频扩散模型中前景质量与背景一致性的平衡,实现无训练的高效视频编辑。

Comments 18 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09408 2026-03-11 cs.CV cs.AI cs.LG 79%

Reviving ConvNeXt for Efficient Convolutional Diffusion Models

复兴 ConvNeXt 以实现高效的卷积扩散模型

Taesung Kwon, Lorenzo Bianchi, Lennart Wittke, Felix Watine, Fabio Carrara, Jong Chul Ye, Romann Weber, Vinicius Azevedo

机构 * KAIST(韩国科学技术院) ETH Zürich(苏黎世联邦理工学院) ISTI-CNR(意大利国家研究理事会信息与自动化研究所) University of Pisa(比萨大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出全卷积扩散模型 FCDM-XL,通过使用 ConvNeXt 结构实现高效扩散模型,以更少的 FLOPs 和训练步骤达到与 DiT-XL 相当的性能。

Comments CVPR 2026. Official implementation: https://github.com/star-kwon/FCDM

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27602 2026-03-11 cs.CV 79%

Who Made This? Fake Detection and Source Attribution with Diffusion Features

谁制造了这个?通过扩散特征进行伪造检测和来源归因

Simone Bonechi, Paolo Andreini, Barbara Toniella Corradini

机构 * Department of Information Engineering and Mathematics, University of Siena(信息工程与数学系,锡耶纳大学) AIGO, Italian Institute of Technology(AIGO,意大利理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 FRIDA通过分析扩散特征,利用k-最近邻方法和紧凑神经分类器实现伪造图像检测与来源归因,达到跨生成器检测的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏