arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86872 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2604.16552 2026-04-30 cs.CV cs.AI 79%

Co-generation of Layout and Shape from Text via Autoregressive 3D Diffusion

通过自回归3D扩散模型生成布局和形状

Zhenggang Tang, Yuehao Wang, Yuchen Fan, Jun-Kun Chen, Yu-Ying Yeh, Kihyuk Sohn, Zhangyang Wang, Qixing Huang, Alexander Schwing, Rakesh Ranjan, Dilin Wang, Zhicheng Yan

机构 * Meta Reality Labs(Meta现实实验室) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种新的文本到场景生成方法,通过自回归3D扩散模型生成布局和形状,解决文本描述与生成场景不一致的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10959 2026-04-30 cs.CV 79%

StereoSpace: Depth-Free Synthesis of Stereo Geometry via End-to-End Diffusion in a Canonical Space

StereoSpace:通过端到端扩散在规范空间中实现无深度的立体几何合成

Tjark Behrens, Anton Obukhov, Bingxin Ke, Fabio Tosi, Matteo Poggi, Konrad Schindler

机构 * ETH Zurich(苏黎世联邦理工学院) University of Bologna(博洛尼亚大学) HUAWEI Bayer Lab(华为贝加尔实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 StereoSpace通过端到端扩散模型在规范空间中实现无深度的立体几何合成,采用视角条件化方法,无需显式深度或变形,通过端到端生成对应关系和填补遮挡区域,提升立体生成的清晰度和鲁棒性。

Comments CVPR 2026 Findings. Project page: https://hf.co/spaces/prs-eth/stereospace

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26620 2026-04-30 cs.CV 79%

SnapPose3D: Diffusion-Based Single-Frame 2D-to-3D Lifting of Human Poses

SnapPose3D: 基于扩散模型的单帧2D到3D姿态提升

Alessandro Simoni, Riccardo Catalini, Davide Di Nucci, Guido Borghi, Davide Davoli, Lorenzo Garattoni, Gianpiero Francesca, Yuki Kawana, Roberto Vezzani

机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) Toyota Motor Europe(丰田欧洲公司) Woven by Toyota(丰田织造)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出SnapPose3D,通过扩散模型生成多个假设并聚合,解决2D到3D姿态提升中的深度模糊和关节不确定性问题,利用单帧输入提升计算效率。

Comments Accepted at ICPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26503 2026-04-30 cs.CV 79%

Delta Score Matters! Spatial Adaptive Multi Guidance in Diffusion Models

Delta Score Matters! 空间自适应多引导在扩散模型中

Haosen Li, Wenshuo Chen, Lei Wang, Shaofeng Liang, Bowen Tian, Soning Lai, Yutao Yue

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) Griffith University & Data61/CSIRO(格里菲斯大学及Data61/CSIRO)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出空间自适应多引导方法,通过几何分析解决扩散模型中细节与伪影的矛盾,提升语义对齐和结构完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26365 2026-04-30 cs.CV cs.LG 79%

Beyond Fixed Formulas: Data-Driven Linear Predictor for Efficient Diffusion Models

超越固定公式:用于高效扩散模型的数据驱动线性预测器

Zhirong Shen, Rui Huang, Jiacheng Liu, Chang Zou, Peiliang Cai, Shikang Zheng, Zhengyi Shi, Liang Feng, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) University of Electronic Science and Technology of China(电子科技大学) Shandong University(山东大学) Xiamen University(厦门大学) Fudan University(复旦大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出L2P数据驱动缓存框架,通过学习每时间步的权重替代固定系数,有效降低扩散模型采样成本,实现4.55倍FLOPs减少和4.15倍延迟加速。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26279 2026-04-30 cs.CV 79%

High-Dimensional Noise to Low-Dimensional Manifolds: A Manifold-Space Diffusion Framework for Degraded Hyperspectral Image Classification

高维噪声到低维流形:一种用于退化超光谱图像分类的流形空间扩散框架

Boxiang Yang, Ning Chen, Xia Yue, Yichang Luo, Yingbo Fan, Haoyuan Zhang, Haoyu Ma, Jun Yue, Shanjun Mao

机构 * Institute of Remote Sensing and Geographic Information System, Peking University(遥感与地理信息系统研究所,北京大学) Beijing Key Laboratory of Spatio-temporal Perception and Urban Resilience, Peking University(北京时空感知与城市韧性重点实验室,北京大学) School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所) Institute of energy, Peking University(北京大学能源研究所) School of Mechanics and Engineering Science, Peking University(北京大学力学与工程科学学院) School of Automation, Central South University(中南大学自动化学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种流形空间扩散框架,通过判别光谱-空间重建任务将高维退化数据映射到低维流形,利用扩散模型稳定潜在特征,提升复杂退化条件下的分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20714 2026-04-30 cs.CV cs.AI 79%

Inferix: A Block-Diffusion based Next-Generation Inference Engine for World Simulation

Inferix:基于块扩散的下一代世界模拟推理引擎

Inferix Team, Tianyu Feng, Yizeng Han, Jiahao He, Yuanyu He, Xi Lin, Teng Liu, Hanfeng Lu, Jiasheng Tang, Wei Wang, Zhiyuan Wang, Jichao Wu, Mingyang Yang, Yinghao Yu, Zeyu Zhang, Bohan Zhuang

机构 * Inferix Team(Inferix 团队)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Inferix 是一种基于块扩散的下一代推理引擎,通过优化半自回归解码过程实现沉浸式世界合成,支持交互式视频流和性能分析,结合 LV-Bench 提供高效评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23980 2026-04-30 cs.CV 79%

Towards Redundancy Reduction in Diffusion Models for Efficient Video Super-Resolution

向扩散模型的冗余减少迈进:为高效视频超分辨率而优化

Jinpei Guo, Yifei Ji, Shengwei Wang, Zheng Chen, Yufei Wang, Sizhuo Ma, Yong Guo, Baiang Li, Jusheng Zhang, Yulun Zhang, Jian Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) Shanghai Jiao Tong University(上海交通大学) Sun Yat-sen University(中山大学) Snap Inc.(Snap公司) South China University of Technology(华南理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出OASIS,一种针对真实世界视频超分辨率的高效单步扩散模型,通过注意力专业化路由减少冗余,提升性能与推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23323 2026-04-30 cs.CV 79%

FA-Seg: A Fast and Accurate Diffusion-Based Method for Open-Vocabulary Segmentation

FA-Seg: 一种基于扩散模型的快速且准确的开放词汇分割方法

Huy Che, Vinh-Tiep Nguyen

机构 * University of Information Technology(信息科技大学) Vietnam National University(越南国家大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 FA-Seg提出一种基于扩散模型的快速准确开放词汇分割框架,通过双提示机制、层次注意力细化方法和测试时翻转方案提升分割质量,实现高效且高精度的分割性能。

Journal ref Neurocomputing 660 (2026) 131844

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09923 2026-04-29 cs.CV 79%

Splatent: Splatting Diffusion Latents for Novel View Synthesis

Splatent: 基于扩散模型的潜在空间光场表示用于新视角合成

Or Hirschorn, Omer Sela, Inbar Huberman-Spiegelglas, Netalee Efrat, Eli Alshan, Ianir Ideses, Frederic Devernay, Yochai Zvik, Lior Fritz

机构 * Amazon Prime Video(亚马逊Prime视频) Tel-Aviv University(特拉维夫大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Splatent通过多视图注意力机制在2D中恢复细节,提升VAE潜在空间光场重建质量,实现高精度稀疏视角3D重建。

Comments CVPR 2026. Project's webpage at https://orhir.github.io/Splatent/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25319 2026-04-29 cs.CV 79%

Edge-Cloud Collaborative Reconstruction via Structure-Aware Latent Diffusion for Downstream Remote Sensing Perception

通过结构感知潜在扩散实现边缘-云协作重建以用于下游遥感感知

Yun Li, Xianju Li

机构 * School of Computer Science, China University of Geosciences, Wuhan, Hubei, China(中国地质大学(武汉)计算机科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出结构感知潜在扩散框架,通过边缘-云协作实现高效超分辨率重建,在极端带宽限制下提升遥感场景分类和小目标检测性能。

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25289 2026-04-29 cs.LG cs.CV 79%

Exploring Time Conditioning in Diffusion Generative Models from Disjoint Noisy Data Manifolds

探索扩散生成模型中的时间条件:从离散噪声数据流形的角度

Liuzhuozheng Li, Zhiyuan Zhan, Shuhong Liu, Dengyang Jiang, Zanyi Wang, Guang Dai, Jingdong Wang, Mengmeng Wang

机构 * SGIT AI Lab(SGIT人工智能实验室) UTokyo(东京大学) HKUST(香港科技大学) UCSD(加州大学圣地亚哥分校) ZJUT(浙江工业大学) Baidu(百度) RIKEN AIP(日本理化学研究所AIP)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文从几何视角重新审视扩散模型中的时间条件作用,发现高维空间中噪声分布集中在低维流形上,通过调整DDIM前向过程并结合流匹配方法,证明无需时间条件即可生成高质量内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26783 2026-04-29 cs.CV cs.AI 79%

Can We Change the Stroke Size for Easier Diffusion?

我们能否通过改变笔触大小来使扩散更简单?

Yunwei Bai, Ying Kiat Tan, Yao Shu, Tsuhan Chen

机构 * National University of Singapore(新加坡国立大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文研究通过控制笔触大小改变监督目标的粗糙度,以缓解低信噪比下的预测挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04682 2026-04-29 cs.CV 79%

HATIR: Heat-Aware Diffusion for Turbulent Infrared Video Super-Resolution

HATIR: 用于湍流红外视频超分辨率的热感知扩散

Yang Zou, Xingyue Zhu, Kaiqi Han, Jun Ma, Xingyuan Li, Zhiying Jiang, Jinyuan Liu

机构 * Northwestern Polytechnical University(西北工业大学) Dalian University of Technology(大连理工大学) Zhejiang University(浙江大学) Dalian Maritime University(大连海事大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 HATIR通过热感知变形先验联合建模湍流退化与结构细节损失,提出相位引导流估计器和湍流感知解码器,构建首个湍流红外视频超分辨率数据集FLIR-IVSR,提升非均匀退化下的结构恢复精度。

Journal ref Proceedings of the 40th Annual AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24719 2026-04-28 cs.CV 79%

DiffuSAM: Diffusion-Based Prompt-Free SAM2 for Few-Shot and Source-Free Medical Image Segmentation

DiffuSAM: 基于扩散的无提示SAM2用于少样本和源无关医学图像分割

Tal Grossman, Noa Cahan, Lev Ayzenberg, Hayit Greenspan

机构 * School of Electrical Engineering, Tel Aviv University, Israel(特拉维夫大学电气工程学院) School of Biomedical Engineering, Tel Aviv University, Israel(特拉维夫大学生物医学工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffuSAM通过轻量级扩散先验生成SAM2兼容的分割掩码嵌入,实现无提示医学图像分割,无需用户输入,在BTCV和CHAOS数据集上表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24407 2026-04-28 cs.CV 79%

AD-Relight: Training-Free Banner Relighting via Illumination Translation with Diffusion Priors

AD-Relight:通过扩散先验进行无训练横幅照明转换的免训练横幅重照明

Rameshwar Mishra, A V Subramanyam

机构 * Indraprastha Institute of Information Technology(印度理工学院信息技术研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出AD-Relight,一种无训练的多阶段框架,利用扩散模型在测试时适应重照明新插入的Photoshop横幅,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06166 2026-04-28 cs.CV 79%

B-FIRE: Binning-Free Diffusion Implicit Neural Representation for Hyper-Accelerated Motion-Resolved MRI

B-FIRE:无分组扩散隐式神经表示用于超加速运动分辨MRI

Di Xu, Hengjie Liu, Yang Yang, Mary Feng, Jin Ning, Xin Miao, Jessica E. Scholey, Alexandra E. Hotca-cho, William C. Chen, Michael Ohliger, Martina Descovich, Huiming Dong, Wensha Yang, Ke Sheng

机构 * Radiation Oncology, University of California, San Francisco, California(加州大学旧金山分校放射肿瘤学系) Radiology and Biomedical Imaging, University of California, San Francisco, California(加州大学旧金山分校放射学与生物医学成像系) Siemens Medical Solutions USA, Inc., Cleveland, Ohio(西门子医疗解决方案美国公司,克利夫兰,俄亥俄) Radiology at Children’s Hospital Los Angeles, Keck School of Medicine, University of Southern California, Los Angeles, California(洛杉矶儿童医院放射学,美国南加州大学凯克医学院,洛杉矶,加利福尼亚)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 B-FIRE通过扩散隐式神经表示框架实现超加速MRI重建,解决运动分辨信息模糊问题,提升3D腹部解剖的即时重建精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23709 2026-04-28 cs.CV eess.IV 79%

ZID-Net: Zero-Inference Diffusion Prior Decoupling Network for Single Image Dehazing

ZID-Net:零推理扩散先验解耦网络用于单图像去雾

Xinheng Li, Minghao Chen, Mengqing Wu, Yan Liu, Guanying Huo

机构 * College of Information Science and Engineering, Hohai University(河海大学信息科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ZID-Net通过解耦扩散监督与前馈推理,提出一种高效去雾框架,结合频率-空间解耦前馈骨干网络和物理先验,实现高PSNR和低延迟的去雾效果。

Comments Submitted to Neurocomputing. Includes 12 figures and 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23651 2026-04-28 cs.CV 79%

Geometry-Conditioned Diffusion for Occlusion-Robust In-Bed Pose Estimation

基于几何条件的扩散模型用于抗遮挡的卧床姿态估计

Navid Aslankhani Khameneh, Marco Carletti, Cigdem Beyan

机构 * Department of Computer Science, University of Verona(威尼斯大学计算机科学系) EVS - Embedded Vision Systems Srl(嵌入式视觉系统股份有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于几何条件的扩散模型,解决卧床姿态估计中遮挡问题,通过生成模型直接从骨骼关键点生成遮挡图像,提升遮挡鲁棒性。

Comments This is the preprint version of the paper. The final version has been accepted for publication in the Proceedings of the 20th IEEE International Conference on Automatic Face and Gesture Recognition (IEEE FG 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23636 2026-04-28 cs.CV 79%

Discriminator-Guided Adaptive Diffusion for Source-Free Test-Time Adaptation under Image Corruptions

判别器引导的自适应扩散用于无源测试时间适应下的图像损坏

Francesco Olivato, Cigdem Beyan, Vittorio Murino

机构 * Department of Computer Science, University of Verona(威尼斯大学计算机科学系) AI for Good (AIGO), Istituto Italiano di Tecnologia(意大利技术研究院人工智能与善部(AIGO))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种基于扩散的输入级适应框架,在测试时保持所有源训练模型冻结,通过判别器引导的自适应扩散策略动态控制每个测试样本的扰动量,以抑制特定域的损坏,提升鲁棒性。

Comments This is the preprint (submitted version) of the paper. The final version has been accepted for publication in the Proceedings of the 28th International Conference on Pattern Recognition (ICPR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04749 2026-04-28 cs.CV 79%

Mitigating Long-Tail Bias via Prompt-Controlled Diffusion Augmentation

通过提示控制的扩散增强缓解长尾偏差

Buddhi Wijenayake, Nichula Wasalathilake, Roshan Godaliyadda, Vijitha Herath, Parakrama Ekanayake, Vishal M. Patel

机构 * University of Peradeniya(珀德尼亚大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于提示控制的扩散增强框架,通过生成带标签的图像样本来增强少数类,提升遥感图像分割中长尾不平衡问题的处理效果。

Comments Accepted to Publication at 2026 IEEE International Geoscience and Remote Sensing Symposium (IGARSS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06904 2026-04-28 cs.CV 79%

BIR-Adapter: A parameter-efficient diffusion adapter for blind image restoration

BIR-Adapter:一种参数高效的扩散适配器用于盲图像恢复

Cem Eteke, Alexander Griessel, Wolfgang Kellerer, Eckehard Steinbach

机构 * Chair of Media Technology, Munich Institute of Robotics and Machine Intelligence(媒体技术教授会,慕尼黑机器人与机器智能研究所) School of Computation, Information and Technology, Technical University of Munich(计算、信息与技术学院,慕尼黑技术大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出BIR-Adapter,一种参数高效的扩散适配器,用于盲图像恢复。通过减少训练参数数量和引入采样引导机制,提升恢复可靠性,实验表明其在多个设置中性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22808 2026-04-28 cs.CV cs.AI eess.IV 79%

FreqFormer: Hierarchical Frequency-Domain Attention with Adaptive Spectral Routing for Long-Sequence Video Diffusion Transformers

FreqFormer:具有自适应频谱路由的分层频域注意力机制用于长序列视频扩散变换器

Haopeng Jin

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 FreqFormer通过分层频域注意力机制,利用视频特征的频谱结构,采用不同操作符处理不同频段,降低长序列视频扩散变换器的计算与内存开销。

Comments 24 pages, 17 figures, 14 tables, Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21066 2026-04-28 cs.CV cs.LG stat.ME 79%

Optimizing Diffusion Priors in Image Reconstruction from a Single Observation

从单个观测重建图像中优化扩散先验

Frederic Wang, Katherine L. Bouman

机构 * Caltech(加州理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出通过结合现有扩散先验生成单专家先验并优化指数,以提升单观测图像重建的可靠性,验证了在黑洞成像和文本条件去模糊中效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18836 2026-04-28 eess.IV cs.AI cs.CV 79%

Dual-domain Multi-path Self-supervised Diffusion Model for Accelerated MRI Reconstruction

双域多路径自监督扩散模型用于加速MRI重建

Yuxuan Zhang, Jinkui Hao, Bo Zhou

机构 * Department of Radiology, Northwestern University(放射科,西北大学) Department of Biomedical Engineering, Huazhong University of Science and Technology(生物医学工程系,华中科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出双域多路径自监督扩散模型,通过自监督训练方案、轻量混合注意力网络和多路径推理策略,提升MRI重建的准确性、效率和可解释性,克服传统模型依赖全采样数据的局限。

Comments Accepted at IEEE-TNNLS, 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22220 2026-04-27 cs.CV 79%

Breaking Watermarks in the Frequency Domain: A Modulated Diffusion Attack Framework

频域中破解水印:一种调制扩散攻击框架

Chunpeng Wang, Binyan Qu, Xiaoyu Wang, Zhiqiu Xia, Shanshan Zhang, Yunan Liu, Qi Li

机构 * Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东省科学院)) Dalian Maritime University(大连海事大学) Nanjing University of Science and Technology(南京理工大学) Shandong Jianzhu University(山东建筑大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出FMDiffWA框架,通过频域调制模块在正反扩散过程中实现水印信号的高效去除,同时保持图像视觉质量,改进了传统扩散模型的训练策略,实验显示其在视觉保真度和通用性方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22212 2026-04-27 eess.IV cs.CV cs.LG 79%

Multimodal Diffusion to Mutually Enhance Polarized Light and Low Resolution EBSD Data

多模态扩散用于互为增强的偏振光与低分辨率EBSD数据

Harry Dong, Timofey Efimov, Megna Shah, Jeff Simmons, Sean Donegan, Marc De Graef, Yuejie Chi

机构 * Carnegie Mellon University(卡内基梅隆大学) Air Force Research Laboratory(空军研究实验室) Yale University(耶鲁大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出多模态扩散模型,通过结合偏振光和低分辨率EBSD数据,提升数据收集效率,实现颗粒边界预测、超分辨率和去噪等任务的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20886 2026-04-27 cs.CV cs.LG eess.IV 79%

Nuclear Diffusion Models for Low-Rank Background Suppression in Videos

核扩散模型用于视频中低秩背景抑制

Tristan S. W. Stevens, Oisín Nolan, Jean-Luc Robert, Ruud J. G. van Sloun

机构 * Dept. of Electrical Engineering, Eindhoven University of Technology, the Netherlands(埃因霍温理工大学电气工程系,荷兰) Philips Research North America, Cambridge MA, USA(飞利浦北美研究部,马萨诸塞州剑桥)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出核扩散模型,结合低秩时间建模与扩散后验采样,提升视频去雾性能,尤其在对比度增强和信号保持方面优于传统RPCA。

Comments 5 pages, 4 figures, preprint

Journal ref 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21592 2026-04-24 cs.CV 79%

Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers

Sculpt4D:通过稀疏注意力扩散变换器生成4D形状

Minghao Yin, Wenbo Hu, Jiale Xu, Ying Shan, Kai Han

机构 * The University of Hong Kong(香港大学) ARC Lab, Tencent PCG(腾讯PCG实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Sculpt4D通过在预训练的3D扩散变换器中集成高效时间建模,解决4D生成中的时间伪影和计算需求问题,实现高保真4D合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21518 2026-04-24 eess.IV cs.CV 79%

DiffNR: Diffusion-Enhanced Neural Representation Optimization for Sparse-View 3D Tomographic Reconstruction

DiffNR: 用于稀疏视图3D断层成像重建的扩散增强神经表示优化

Shiyan Su, Ruyi Zha, Danli Shi, Hongdong Li, Xuelian Cheng

机构 * Monash University(莫纳什大学) The Australian National University(澳大利亚国立大学) Hong Kong Polytechnic University(香港理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffNR通过引入扩散先验改进神经表示优化,解决稀疏视图下CT成像的严重伪影问题,提升PSNR并保持高效优化。

Comments Accepted to AAAI 2026. Project page: https://ooonesevennn.github.io/DiffNR/

详情

展开后加载摘要…

URL PDF HTML 收藏