arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-21 至 2026-01-21 共收录 96 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 96 篇

2601.13683 2026-01-21 cs.CV 88%

Dynamic Differential Linear Attention: Enhancing Linear Diffusion Transformer for High-Quality Image Generation

动态微分线性注意力:增强线性扩散变换器以实现高质量图像生成

Boyuan Cao, Xingbo Yao, Chenhui Wang, Jiaxin Ye, Yujie Wei, Hongming Shan

机构 * Fudan University(复旦大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出动态微分线性注意力机制,通过缓解过度平滑问题提升线性扩散变换器的生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14866 2026-01-21 cs.CV 88%

Controllable Localized Face Anonymization Via Diffusion Inpainting

可控的局部化面部匿名化通过扩散修复

Ali Salar, Qing Liu, Guoying Zhao

机构 * Center for Machine Vision and Signal Analysis (CMVS)(机器视觉与信号分析中心) University of Oulu(奥卢大学) ELLIS Institute Finland(芬兰ELLIS研究所) The Machine Learning Group(机器学习小组) UiT The Arctic University of Norway(挪威北冰洋大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 本文提出了一种可控的局部化面部匿名化方法,利用扩散修复生成逼真的匿名图像,通过自适应属性引导模块实现精准控制,无需额外训练即可优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14833 2026-01-21 cs.CV cs.AI 88%

Paired Image Generation with Diffusion-Guided Diffusion Models

配对图像生成与扩散引导扩散模型

Haoxuan Zhang, Wenju Cui, Yuzhu Cao, Tao Tan, Jie Liu, Yunsong Peng, Jian Zheng

机构 * University of Science and Technology of China(科学技术大学) Suzhou Institute of Biomedical Engineering and Technology(生物医学工程与技术研究所) Macao Polytechnic University(澳门 polytechnic 大学) Suzhou Municipal Hospital(苏州 municipal 医院) Guizhou Provincial People's Hospital(贵州省人民医院)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种无需外部条件的配对图像生成方法,通过训练额外的扩散引导器提升生成质量并缓解标注数据不足问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12283 2026-01-21 cs.CV 85%

SDiT: Semantic Region-Adaptive for Diffusion Transformers

SDiT:语义区域自适应的扩散变换器

Bowen Lin, Fanjiang Ye, Yihua Liu, Zhenghui Guo, Boyuan Zhang, Weijian Zheng, Yufan Xu, Tiancheng Xing, Yuke Wang, Chengming Zhang

机构 * University of Houston(德克萨斯大学奥斯汀分校) Rice University(里奇大学) Indiana University Bloomington(印第安纳大学布卢明顿分校) Argonne National Laboratory(阿贡国家实验室) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

AI总结 SDiT通过语义区域自适应技术,在不重新训练模型的情况下,实现去噪加速,同时保持高质量的图像生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13416 2026-01-21 cs.CV 83%

Diffusion Representations for Fine-Grained Image Classification: A Marine Plankton Case Study

扩散表示用于细粒度图像分类:一个海洋浮游生物案例研究

A. Nieto Juscafresa, Á. Mazcuñán Herreros, J. Sullivan

机构 * KTH Royal Institute of Technology(皇家理工学院)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出利用冻结的扩散模型作为特征编码器,通过多层特征和时间步探测提升细粒度图像分类性能,在浮游生物监测中验证了其有效性。

Comments 21 pages, 6 figures, CVPR format

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11689 2026-01-21 eess.IV cs.CV 83%

Bridging Modalities: Joint Synthesis and Registration Framework for Aligning Diffusion MRI with T1-Weighted Images

弥合模态:联合合成与配准框架用于对齐扩散磁共振成像与T1加权图像

Xiaofan Wang, Junyi Wang, Yuqian Chen, Lauren J. O' Donnell, Fan Zhang

机构 * University of Electronic Science and Technology of China(电子科技大学) Brigham and Women’s Hospital(布里奇沃特医院) Harvard Medical School(哈佛医学院)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出一种基于生成配准网络的无监督框架,通过图像合成和变形场学习,提升扩散MRI与T1加权图像的配准精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14565 2026-01-21 cs.GR cs.CV 81%

ReflectanceFusion: Diffusion-based text to SVBRDF Generation

反射融合:基于扩散的文本到SVBRDF生成

Bowen Xue, Giuseppe Claudio Guarnera, Shuang Zhao, Zahra Montazeri

机构 * University of Manchester, UK(曼彻斯特大学) University of York, UK(约克大学) University of California, Irvine, USA(加州大学伊尔弗分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

AI总结 ReflectanceFusion通过双模块神经方法生成高保真SVBRDF地图,结合预训练扩散模型和ReflectanceUNet实现文本到材料的高精度生成与编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12257 2026-01-21 cs.CV cs.AI cs.CG cs.GR 81%

Soft Shadow Diffusion (SSD): Physics-inspired Learning for 3D Computational Periscopy

软阴影扩散(SSD):面向3D计算望远镜的物理启发学习

Fadlullah Raji, John Murray-Bruce

机构 * University of South Florida(佛罗里达州立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

AI总结 SSD通过物理启发的学习方法,实现了从普通NLOS照片中对隐藏场景的3D重建,具有良好的鲁棒性和泛化能力。

Journal ref European Conference on Computer Vision (ECCV 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14161 2026-01-21 cs.CV 79%

One-Shot Refiner: Boosting Feed-forward Novel View Synthesis via One-Step Diffusion

单步扩散提升馈送式新视角合成

Yitong Dong, Qi Zhang, Minchao Jiang, Zhiqiang Wu, Qingnan Fan, Ying Feng, Huaqi Zhang, Hujun Bao, Guofeng Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 通过单步扩散提升馈送式新视角合成,解决高分辨率图像处理与高频细节保留问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14030 2026-01-21 cs.CV 79%

Likelihood-Separable Diffusion Inference for Multi-Image MRI Super-Resolution

基于似然分离的扩散推理用于多图像MRI超分辨率

Samuel W. Remedios, Zhangxing Bian, Shuwen Wei, Aaron Carass, Jerry L. Prince, Blake E. Dewey

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于扩散模型的多图像MRI超分辨率方法,通过分离似然校正实现高效推理,显著提升了各向异性退化下的超分辨率性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13371 2026-01-21 cs.CV 79%

Spherical Geometry Diffusion: Generating High-quality 3D Face Geometry via Sphere-anchored Representations

球面几何扩散:通过球锚定表示生成高质量3D人脸几何

Junyi Zhang, Yiming Wang, Yunhong Lu, Qichao Wang, Wenzhe Qian, Xiaoyin Xu, David Gu, Min Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出球面几何扩散方法,通过球锚定表示生成高质量3D人脸几何,结合2D生成模型实现可控生成。

Comments Association for the Advancement of Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21498 2026-01-21 cs.LG cs.CV 79%

SlimDiff: Training-Free, Activation-Guided Hands-free Slimming of Diffusion Models

SlimDiff: 不需要训练的激活引导式扩散模型无手瘦身

Arani Roy, Shristi Das Biswas, Kaushik Roy

机构 * Purdue University(普渡大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 SlimDiff通过激活引导的结构压缩方法,无需训练即可显著提升扩散模型的效率,实现参数减少和加速,同时保持生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12761 2026-01-21 cs.CV 79%

Moaw: Unleashing Motion Awareness for Video Diffusion Models

Moaw:释放视频扩散模型中的运动感知

Tianqi Zhang, Ziyi Wang, Wenzhao Zheng, Weiliang Chen, Yuanhui Huang, Zhengyang Huang, Jie Zhou, Jiwen Lu

机构 * Tsinghua University(清华大学) Beihang University(北航)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Moaw通过训练视频扩散模型进行运动感知,实现零样本运动迁移,推动生成建模与运动理解的结合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09527 2026-01-21 cs.CV 79%

Generative Diffusion Contrastive Network for Multi-View Clustering

多视图聚类的生成扩散对比网络

Jian Zhu, Xin Zou, Xi Wang, Lei Liu, Chang Tang, Li-Rong Dai

机构 * Zhejiang Lab(浙江实验室) Hong Kong University of Science and Technology(香港科技大学) University of Science and Technology of China(中国科学技术大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出生成扩散对比网络GDCN,通过多重生成机制解决多视图聚类中的低质量数据问题,实现深度多视图聚类任务的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05685 2026-01-21 cs.GR 79%

DogFit: Domain-guided Fine-tuning for Efficient Transfer Learning of Diffusion Models

DogFit: 域引导微调用于扩散模型高效迁移学习

Yara Bahram, Mohammadhadi Shateri, Eric Granger

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

AI总结 DogFit通过域感知引导微调提升扩散模型在小目标领域迁移学习的效率与效果,减少计算开销并提高生成质量。

Comments Accepted for poster presentation at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12233 2026-01-21 cs.CV 79%

DiffusionQC: Artifact Detection in Histopathology via Diffusion Model

DiffusionQC:通过扩散模型在病理学中检测伪影

Zhenzhen Wang, Zhongliang Zhou, Zhuoyu Wen, Jeong Hwan Kook, John B Wojcik, John Kang

机构 * Johns Hopkins University Dept. of Biomedical Engineering(约翰霍普金斯大学生物医学工程系) Merck & Co., Inc. Biometrics Research(默克公司生物度量研究) Merck & Co., Inc. Translational Medicine(默克公司转化医学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffusionQC通过扩散模型检测病理学图像中的伪影,无需大量标注数据,实现高效且泛化的伪影识别。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12020 2026-01-21 cs.CV 79%

DIAMOND-SSS: Diffusion-Augmented Multi-View Optimization for Data-efficient SubSurface Scattering

DIAMOND-SSS: 用于数据高效次表面散射的扩散增强多视图优化

Guillermo Figueroa-Araneda, Iris Diana Jimenez, Florian Hofherr, Manny Ko, Hector Andrade-Loarca, Daniel Cremers

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DIAMOND-SSS通过扩散模型实现高保真透明重建,利用极稀疏监督生成逼真增强效果,将实际捕获需求降低90%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09609 2026-01-21 eess.IV cs.CV 79%

I2I-PR: Deep Iterative Refinement for Phase Retrieval using Image-to-Image Diffusion Models

I2I-PR: 基于图像到图像扩散模型的深度迭代细化用于相位恢复

Mehmet Onurcan Kaya, Figen S. Oktem

机构 * Department of Electrical Engineering, Middle East Technical University (METU)(电子工程系,中东技术大学) Department of Applied Mathematics and Computer Science, Technical University of Denmark(应用数学与计算机科学系,丹麦技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 I2I-PR利用图像到图像扩散模型实现深度迭代细化,通过物理一致的初始估计和学习的扩散过程提升相位恢复的鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18900 2026-01-21 quant-ph cs.NA math.NA 78%

Quantum algorithms for linear and non-linear fractional reaction-diffusion equations

量子算法用于线性和非线性分数反应扩散方程

Dong An, Konstantina Trivisa

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出量子算法用于求解线性和非线性分数反应扩散方程,通过哈密顿量模拟与相互作用图式结合,实现空间维度的最优缩放,并采用 Carleman 线性化方法处理非线性问题。

Journal ref Quantum 10, 1969 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14041 2026-01-21 cs.CL cs.AI 78%

Top 10 Open Challenges Steering the Future of Diffusion Language Model and Its Variants

推动扩散语言模型及其变体未来发展的十大开放挑战

Yunhe Wang, Kai Han, Huiling Zhen, Yuchuan Tian, Hanting Chen, Yongbing Huang, Yufei Cui, Yingte Shu, Shan Gao, Ismail Elezi, Roy Vaughan Miles, Songcen Xu, Feng Wen, Chao Xu, Sinan Zeng, Dacheng Tao

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) Peking University(北京大学) Huawei Technologies(华为技术有限公司) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出推动扩散语言模型及其变体发展的十大挑战,并提出以多尺度标记化、主动遮罩和潜在思考为核心的四支柱战略路线图,旨在突破因果瓶颈,实现复杂结构推理和多模态整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13965 2026-01-21 cond-mat.mtrl-sci 78%

Grain-Growth Stagnation from Vacancy-Diffusion-Limited Disconnection Climb

晶粒生长停滞源于空位扩散限制的断开爬行

Maik Punke, Abel H. G. Milor, Marco Salvalaglio

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究通过相场晶体框架揭示空位扩散限制的断开爬行是晶粒生长停滞的根本机制,并展示了其与晶粒尺寸的关系。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13274 2026-01-21 cond-mat.soft cond-mat.stat-mech 78%

Structure and Memory Control Self-Diffusion in Active Matter

活性物质中结构与记忆控制的自扩散

Akinlade Akintunde, Stewart A. Mallory

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究揭示了活性物质中自扩散的微观机制,通过碰撞力和时间相关性建立了自扩散系数的精确表达式,阐明了碰撞记忆的耗散作用。

Comments (8 pages, 6 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13250 2026-01-21 cs.RO 78%

Diffusion-based Inverse Model of a Distributed Tactile Sensor for Object Pose Estimation

基于扩散的分布式触觉传感器逆模型用于物体姿态估计

Ante Marić, Giammarco Caroleo, Alessandro Albini, Julius Jankowski, Perla Maiolino, Sylvain Calinon

机构 * Idiap Research Institute(Idiap研究机构) École Polytechnique Fédérale de Lausanne(瑞士联邦理工学院) Oxford Robotics Institute(牛津机器人研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出基于扩散模型的分布式触觉传感器逆模型,用于在无视觉数据情况下提高物体姿态估计的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06638 2026-01-21 cond-mat.stat-mech math-ph math.MP 78%

A Conservative Log-Size Master Equation for Fragmentation PBEs: Jump Transport, Drift--Diffusion Asymptotics, and PSD Inference

一种保守的对数尺寸主方程用于碎片化PBEs:跳跃运输、漂移-扩散渐近性及PSD推断

Juan J. Segura

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种保守的对数尺寸主方程用于碎片化PBEs,结合跳跃运输、漂移-扩散渐近性和PSD推断,通过结构保持算子表示和约束参数化实现反演建模。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02076 2026-01-21 cs.CL cs.AI 78%

Deferred Commitment Decoding for Diffusion Language Models

延迟承诺解码用于扩散语言模型

Yingte Shu, Yuchuan Tian, Chao Xu, Yunhe Wang, Hanting Chen

机构 * Peking University(北京大学) Huawei Technologies(华为技术)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出延迟承诺解码方法,通过基于不确定性的策略提升扩散语言模型解码质量和效率,实验显示在多个模型和基准测试中效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13228 2026-01-21 cs.CL cs.AI 78%

Autoregressive Models Rival Diffusion Models at ANY-ORDER Generation

自回归模型在任意阶生成中与扩散模型相媲美

Tianqi Du, Lizhe Fang, Weijie Yang, Chenheng Zhang, Zeming Wei, Yifei Wang, Yisen Wang

机构 * National Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(国家关键人工智能实验室,智能科学与技术学院,北京大学) School of Mathematical Sciences, Peking University(数学科学学院,北京大学) Amazon AGI SF Lab(亚马逊人工智能SF实验室) Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出A3框架,通过自回归建模实现任意阶生成,超越传统扩散模型,提升语言建模的灵活性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13226 2026-01-21 cond-mat.quant-gas physics.atom-ph quant-ph 78%

Anomalous diffusion and localization in a disorder-free atomic mixture

无序原子混合物中的异常扩散与局域化

Stefano Finelli, Beatrice Restivo, Alessio Ciamei, Andreas Trenkwalder, Massimo Inguscio, Dmitry S. Petrov, Sergey E. Skipetrov, Matteo Zaccanti

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究在无序原子混合物中观察到异常扩散与局域化现象,揭示了量子干涉在其中的关键作用。

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13149 2026-01-21 math.OC 78%

Classical Optimal Designs for Stationary Diffusion with Multiple Phases

经典最优设计用于多相稳态扩散

Matko Grbac, Ivan Ivec, Marko Vrdoljak

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了多相稳态扩散的最优设计问题,通过正交化放松框架提出了一种方法,用于识别经典最优解并提供数值方法的基准。

Comments 25 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13140 2026-01-21 eess.AS 78%

AMDM-SE: Attention-based Multichannel Diffusion Model for Speech Enhancement

基于注意力机制的多通道扩散模型用于语音增强

Renana Opochinsky, Sharon Gannot

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出AMDM-SE,一种基于注意力机制的多通道扩散模型,用于提升语音降噪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12965 2026-01-21 cs.LG 78%

Deterministic Dynamics of Sampling Processes in Score-Based Diffusion Models with Multiplicative Noise Conditioning

基于乘性噪声条件的分数扩散模型采样过程的确定性动力学

Doheon Kim

机构 * Department of Mathematical Data Science, Hanyang University, ERICA Campus(数学数据科学系,翰阳大学ERICA校区)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了基于乘性噪声条件的分数扩散模型采样过程的确定性动力学,揭示了模型在有限能力下仍能有效生成样本的理论原因。

详情

展开后加载摘要…

URL PDF HTML 收藏