arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86872 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70277 篇

2603.26588 2026-04-09 cs.CV cs.LG 79%

From Synthetic Data to Real Restorations: Diffusion Model for Patient-specific Dental Crown Completion

从合成数据到真实修复:一种针对患者特定牙齿冠的扩散模型

Dávid Pukanec, Tibor Kubík, Michal Španěl

机构 * Department of Computer Graphics and Multimedia, Brno University of Technology, Czechia(捷克布尔诺科技大学计算机图形与多媒体系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出ToothCraft模型,通过合成数据生成患者特定的牙齿冠修复,解决训练数据不足问题,实验显示其在IoU和CD指标上的优异表现。

Comments VISAPP 2026 Conference / CVPR Workshop GenRecon3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26167 2026-04-09 cs.CV cs.CR 79%

Gaussian Shannon: High-Precision Diffusion Model Watermarking Based on Communication

高斯香农:基于通信的高精度扩散模型水印技术

Yi Zhang, Hongbo Huang, Liang-Jie Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Gaussian Shannon水印框架,通过将扩散过程视为噪声通信信道,实现鲁棒追踪和精确位恢复,适用于无损元数据应用。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03468 2026-04-09 cs.CV 79%

D-Garment: Physically Grounded Latent Diffusion for Dynamic Garment Deformations

D-Garment:基于物理的潜在扩散模型用于动态服装变形

Antoine Dumoulin, Adnane Boukhayma, Laurence Boissieux, Bharath Bhushan Damodaran, Pierre Hellier, Stefanie Wuhrer

机构 * Inria Centre at the University Grenoble Alpes(格勒诺布尔阿尔卑斯大学Inria研究中心) Inria, University of Rennes, CNRS, IRISA-UMR 6074(雷恩大学Inria、CNRS、IRISA-UMR 6074) InterDigital Inc.(InterDigital公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出D-Garment,通过基于物理的模拟器生成新数据,学习基于物理材料属性的3D生成模型,实现更准确的服装变形和动态皱纹模拟。

Comments 18 pages, 11 figures

Journal ref Transactions on Machine Learning Research (TMLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06113 2026-04-08 cs.CV 79%

SEM-ROVER: Semantic Voxel-Guided Diffusion for Large-Scale Driving Scene Generation

SEM-ROVER:语义体素引导的扩散模型用于大规模驾驶场景生成

Hiba Dahmani, Nathan Piasco, Moussab Bennehar, Luis Roldão, Dzmitry Tsishkou, Laurent Caraffa, Jean-Philippe Tarel, Roland Brémond

机构 * Noah's Ark, Huawei Paris Research Center, France(诺亚方舟实验室,华为巴黎研究中心,法国) COSYS, Gustave Eiffel University, France(COSYS,古斯塔夫·埃菲尔大学,法国) LASTIG, IGN-ENSG, Gustave Eiffel University, France(LASTIG,IGN-ENSG,古斯塔夫·埃菲尔大学,法国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于Σ-Voxfield网格的3D生成框架,通过语义条件扩散模型生成大规模一致驾驶场景,采用渐进空间外推和延迟渲染模块实现高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05961 2026-04-08 cs.CV 79%

HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation

HumANDiff: 关节化噪声扩散用于运动一致的人体视频生成

Tao Hu, Varun Jampani

机构 * Stability AI

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 HumANDiff通过关节化噪声采样、联合外观-运动学习和几何运动一致性学习,实现高保真人体视频生成,支持多样化的服装风格。

Comments Project page: https://taohuumd.github.io/projects/HumANDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05727 2026-04-08 cs.CV 79%

Single-Stage Signal Attenuation Diffusion Model for Low-Light Image Enhancement and Denoising

单阶段信号衰减扩散模型用于低光照图像增强与去噪

Ying Liu, Junchao Zhang, Caiyun Wu

机构 * School of Aeronautics and Astronautics, Central South University(中南大学航空航天学院) Hunan Provincial Key Laboratory of Optic-Electronic Intelligent Measurement and Control(湖南省光电智能测控重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出单阶段信号衰减扩散模型,通过整合信号衰减机制实现亮度调整与噪声抑制,避免了传统两阶段方法的优化不一致问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05497 2026-04-08 cs.AI cs.CV 79%

Thinking Diffusion: Penalize and Guide Visual-Grounded Reasoning in Diffusion Multimodal Language Models

Thinking Diffusion: 通过惩罚和引导在扩散多模态语言模型中抑制和引导视觉推理

Keuntae Kim, Mingyu Kang, Yong Suk Choi

机构 * Department of Computer Science, Hanyang University(汉阳大学计算机科学系) Department of Artificial Intelligence, Hanyang University(汉阳大学人工智能系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文针对扩散多模态语言模型在视觉推理中生成过早答案的问题,提出位置与步数惩罚和视觉推理引导方法,提升推理准确率并加快推理速度。

Comments CVPR 2026 - main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05110 2026-04-08 cs.CV cs.AI 79%

Simultaneous Dual-View Mammogram Synthesis Using Denoising Diffusion Probabilistic Models

同时双视角乳腺X线合成使用去噪扩散概率模型

Jorge Alberto Garza-Abdala, Gerardo A. Fumagal-González, Eduardo de Avila-Armenta, Sadam Hussain, Jasiel H. Toscano-Martínezb, Diana S. M. Rosales Gurmendi, Alma A. Pedro-Pérez, Jose G. Tamez-Pena

机构 * Tecnologico de Monterrey, School of Engineering and Sciences(蒙特雷科技大学工程与科学学院) School of Engineering, Pontificia Universidad Católica de Chile(智利天主教大学工程学院) Tecnologico de Monterrey, School of Medicine and Health Sciences(蒙特雷科技大学医学与健康科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种三通道去噪扩散概率模型,同时生成乳腺的CC和MLO视角,通过绝对差编码保持全局结构,用于乳腺影像数据增强和交叉视角AI应用。

Comments Accepted and presented at SPIE Medical Imaging 2025 (Vancouver, Canada)

Journal ref Proc. SPIE 13925, 139251C (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04576 2026-04-08 cs.CV 79%

PR-IQA: Partial-Reference Image Quality Assessment for Diffusion-Based Novel View Synthesis

PR-IQA:基于扩散模型的新型视角合成的部分参考图像质量评估

Inseong Choi, Siwoo Lee, Seung-Hun Nam, Soohwan Song

机构 * Dongguk University(东国大学) NAVER WEBTOON AI

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 PR-IQA通过部分参考图像评估扩散生成的视角合成图像质量,提升3D重建效果,无需真实地面真值。

Comments Accepted at CVPR 2026. Project Page: https://kakaomacao.github.io/pr-iqa-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04924 2026-04-07 cs.CV cs.AI 79%

Your Pre-trained Diffusion Model Secretly Knows Restoration

你的预训练扩散模型秘密知道修复

Sudarshan Rajagopalan, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文揭示预训练扩散模型固有修复能力,通过直接学习文本编码器输出的提示嵌入解锁,提出扩散桥框架解决训练与推理不一致问题,实现高效修复模型。

Comments Project page: https://sudraj2002.github.io/yptpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04451 2026-04-07 cs.CV 79%

Beyond Few-Step Inference: Accelerating Video Diffusion Transformer Model Serving with Inter-Request Caching Reuse

超越少量步骤推理:利用跨请求缓存重用加速视频扩散变换器模型服务

Hao Liu, Ye Huang, Chenghuan Huang, Zhenyi Zheng, Jiangsu Du, Ziyang Ma, Jing Lyu, Yutong Lu

机构 * Sun Yat-sen University, China(中山大学) Independent Researcher(独立研究者)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Chorus方法,通过跨请求缓存重用加速视频扩散模型服务,实现45%的速度提升,特别在中间去噪步骤中结合Token-Guided Attention Amplification提升语义对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00408 2026-04-07 cs.CV cs.AI 79%

Low-Bitrate Video Compression through Semantic-Conditioned Diffusion

基于语义的低比特率视频压缩

Lingdong Wang, Guan-Ming Su, Divya Kothandaraman, Tsung-Wei Huang, Mohammad Hajiesmaili, Ramesh K. Sitaraman

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Dolby Laboratories(杜比实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DiSCo框架,通过语义条件扩散模型在低比特率下实现高质量视频压缩,采用文本描述、空间时间退化视频和可选草图等模态,提升感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07435 2026-04-07 cs.CV 79%

DreamLifting: A Plug-in Module Lifting MV Diffusion Models for 3D Asset Generation

DreamLifting:一种插件模块用于提升MV扩散模型以生成3D资产

Ze-Xin Yin, Jiaxiong Qiu, Liu Liu, Xinjie Wang, Wei Sui, Zhizhong Su, Jian Yang, Jin Xie

机构 * PCA Lab, VCIP, College of Computer Science, Nankai University(南开大学计算机学院VCIP实验室PCA Lab) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Horizon Robotics(地平线机器人) D-Robotics

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出LGAA框架,通过多视角扩散先验统一几何与PBR材质建模,结合模块化设计和改进的VAE实现高效3D资产生成,实验表明其在文本和图像条件下均表现优异。

Comments 16 pages, 9 figures, TVCG 2026, project page: https://zx-yin.github.io/dreamlifting/

Journal ref IEEE Transactions on Visualization and Computer Graphics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03581 2026-04-07 cs.RO cs.CV 79%

HAD: Combining Hierarchical Diffusion with Metric-Decoupled RL for End-to-End Driving

HAD:结合分层扩散与度量解耦RL的端到端驾驶

Wenhao Yao, Xinglong Sun, Zhenxin Li, Shiyi Lan, Zi Wang, Jose M. Alvarez, Zuxuan Wu

机构 * Fudan University(复旦大学) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 HAD提出一种端到端规划框架,结合分层扩散策略与度量解耦RL,通过结构保持轨迹扩展生成真实轨迹并提升驾驶目标优化效果,实验表明在NAVSIM和HUGSIM上取得新突破。

Comments 17 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03552 2026-04-07 cs.RO cs.AI cs.CV cs.LG 79%

CRAFT: Video Diffusion for Bimanual Robot Data Generation

CRAFT:基于视频扩散的双臂机器人数据生成

Jason Chen, I-Chun Arthur Liu, Gaurav Sukhatme, Daniel Seita

机构 * University of Southern California(南加州大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 CRAFT通过视频扩散生成双臂机器人演示数据,利用边缘结构线索提升生成多样性与鲁棒性,提升多视角任务的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03448 2026-04-07 cs.CV cs.AI cs.HC cs.LG 79%

ExpressEdit: Fast Editing of Stylized Facial Expressions with Diffusion Models in Photoshop

ExpressEdit: 在Photoshop中使用扩散模型快速编辑风格化面部表情

Kenan Tang, Jiasheng Guo, Jeffrey Lin, Yao Qin

机构 * University of California, Santa Barbara(加州大学圣塔芭芭拉分校)

专题命中 扩散模型 :diffusion(title);image editing(abstract);分类 cs.CV

AI总结 ExpressEdit通过开放源代码的Photoshop插件,实现快速且无伪影的风格化面部表情编辑,结合Liquify等原生功能,提升编辑效率与艺术创作灵活性。

Comments Accepted to CVPR 2026 Workshop on Generative AI for Storytelling (AISTORY)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03353 2026-04-07 eess.IV cs.CV 79%

NeuralLVC: Neural Lossless Video Compression via Masked Diffusion with Temporal Conditioning

NeuralLVC:基于掩码扩散与时间条件的神经损失视频压缩

Tiberio Uricchio, Marco Bertini

机构 * Università di Pisa(比萨大学) Università degli Studi di Firenze(佛罗伦萨大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 NeuralLVC通过结合掩码扩散与I/P帧架构,实现损失视频压缩,利用时间冗余性,实验表明其在Xiph CIF序列中优于H.264和H.265无损压缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03310 2026-04-07 cs.CV 79%

Diffusion Path Alignment for Long-Range Motion Generation and Domain Transitions

扩散路径对齐用于长程运动生成与领域转换

Haichao Wang, Alexander Okupnik, Yuxing Han, Gene Wen, Johannes Schneider, Kyriakos Flouris

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Institute of Information Systems, Universität Liechtenstein(列支敦士登大学信息系统研究所) Department of Computer Science, New York University(纽约大学计算机科学系) MRC Biostatistics Unit, University of Cambridge(剑桥大学MRC生物统计单元)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于扩散的优化框架,通过控制能量目标实现运动领域间流畅过渡,提升长程人类运动生成的连贯性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26357 2026-04-07 cs.CV 79%

MPDiT: Multi-Patch Global-to-Local Transformer Architecture For Efficient Flow Matching and Diffusion Model

MPDiT:一种多块全局到局部变换器架构用于高效的流匹配和扩散模型

Quan Dao, Dimitris Metaxas

机构 * Rutgers University(罗格斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 MPDiT通过多块变换器架构在扩散和流匹配模型中实现高效计算,减少50%的GFLOPs消耗同时保持生成性能,改进时间与类别嵌入设计加速训练收敛。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.25073 2026-04-07 cs.CV 79%

GaMO: Geometry-aware Multi-view Diffusion Outpainting for Sparse-View 3D Reconstruction

GaMO:基于几何的多视角扩散补全用于稀疏视角3D重建

Yi-Chuan Huang, Hao-Jen Chien, Chin-Yang Lin, Ying-Huan Chen, Yu-Lun Liu

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出GaMO框架,通过多视角补全实现稀疏视角3D重建,无需训练即可在零样本条件下提升重建性能,实验表明其在稀疏视角下具有高效且准确的重建能力。

Comments Project page: https://yichuanh.github.io/GaMO/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23709 2026-04-07 cs.CV 79%

Stream-DiffVSR: Low-Latency Streamable Video Super-Resolution via Auto-Regressive Diffusion

Stream-DiffVSR: 通过自回归扩散实现低延迟可流式传输视频超分辨率

Hau-Shiang Shiu, Chin-Yang Lin, Zhixiang Wang, Chi-Wei Hsiao, Po-Fan Yu, Yu-Chih Chen, Yu-Lun Liu

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) Shanda AI Research Tokyo(盛大AI研究东京) MediaTek Inc.(联发科技股份有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Stream-DiffVSR提出一种因果条件扩散框架,通过四步蒸馏去噪器、自回归时间引导模块和轻量时间感知解码器,实现高效在线视频超分辨率,显著降低延迟并提升质量。

Comments Project page: https://jamichss.github.io/stream-diffvsr-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17634 2026-04-07 cs.CV 79%

Efficient Score Pre-computation for Diffusion Models via Cross-Matrix Krylov Projection

通过交叉矩阵Krylov投影实现扩散模型的高效分数预计算

Kaikwan Lau, Andrew S. Na, Justin W. L. Wan

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种加速基于分数的扩散模型的新框架,通过将标准稳定扩散模型转换为Fokker-Planck形式,利用交叉矩阵Krylov投影方法在共享子空间中快速求解后续矩阵,实现15.8%至43.7%的计算时间减少,并在去噪任务中表现出更高的效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03206 2026-04-07 cs.LG cs.CV math.ST stat.ML stat.TH 79%

An Analytical Theory of Spectral Bias in the Learning Dynamics of Diffusion Models

扩散模型学习动力学中频谱偏置的分析理论

Binxu Wang, Cengiz Pehlevan

机构 * Kempner Institute, Harvard University(哈佛大学肯普纳研究所) SEAS, Harvard University(哈佛大学工程与应用科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出分析框架,揭示生成分布在扩散模型训练中的演变规律,发现频谱定律揭示高方差结构学习速度快于低方差细节,且局部卷积改变学习动态。

Comments 96 pages, 29 figures. Published in Advances in Neural Information Processing Systems, NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02847 2026-04-06 cs.CV 79%

HiDiGen: Hierarchical Diffusion for B-Rep Generation with Explicit Topological Constraints

HiDiGen:基于显式拓扑约束的层次扩散用于B-Rep生成

Shurui Liu, Weide Chen, Ancong Wu

机构 * School of Computer Science and Engineering, Sun Yat-sen University, China(中山大学计算机科学与工程学院) School of Intelligent Systems Engineering, Shenzhen Campus of Sun Yat-sen University, China(中山大学深圳校区智能工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 HiDiGen通过分阶段的拓扑约束生成B-Rep结构,结合层次扩散模型提升几何生成的多样性和拓扑有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02787 2026-04-06 cs.CV cs.AI 79%

LumaFlux: Lifting 8-Bit Worlds to HDR Reality with Physically-Guided Diffusion Transformers

LumaFlux:通过物理引导的扩散变压器将8位世界提升到HDR现实

Shreshth Saini, Hakan Gedik, Neil Birkbeck, Yilin Wang, Balu Adsumilli, Alan C. Bovik

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Google, Inc.(谷歌公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 LumaFlux通过物理和感知引导的扩散变压器实现8位SDR到10位HDR的重建,引入PGA、PCM和HDR Residual Coupler模块,提升亮度和色彩保真度,同时构建大规模训练数据集和评估基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02168 2026-04-03 cs.CV 79%

Reflection Generation for Composite Image Using Diffusion Model

基于扩散模型的复合图像反射生成

Haonan Zhao, Qingyang Liu, Jiaxuan Chen, Li Niu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出通过扩散模型生成复合图像中反射的方法,引入反射位置和外观先验信息,构建首个大规模物体反射数据集DEROBA,实现物理一致且视觉真实的反射生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01709 2026-04-03 cs.CV 79%

Bias mitigation in graph diffusion models

图扩散模型中的偏差缓解

Meng Yu, Kun Zhan

机构 * School of Information Science & Engineering, Lanzhou University(兰州大学信息科学与工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出方法缓解图扩散模型中的反向起始偏差和暴露偏差,通过改进的Levin采样算法和新的得分修正机制,无需修改网络即可在多个模型和任务中取得最佳效果。

Comments Accepted to ICLR 2025!

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22652 2026-04-03 cs.RO cs.CV 79%

Pixel Motion Diffusion is What We Need for Robot Control

我们为机器人控制需要像素运动扩散

E-Ro Nguyen, Yichi Zhang, Kanchana Ranasinghe, Xiang Li, Michael S. Ryoo

机构 * Stony Brook University(石溪大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DAWN框架通过结构化像素运动表示连接高层运动意图与底层机器人动作,实现端到端可训练系统,展示多任务性能和现实迁移能力。

Comments Accepted to CVPR 2026. Project page: https://eronguyen.github.io/DAWN

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01053 2026-04-02 cs.CV 79%

PHASOR: Anatomy- and Phase-Consistent Volumetric Diffusion for CT Virtual Contrast Enhancement

PHASOR:基于解剖和相位一致的体积扩散用于CT虚拟对比增强

Zilong Li, Dongyang Li, Chenglong Ma, Zhan Feng, Dakai Jin, Junping Zhang, Hao Luo, Fan Wang, Hongming Shan

机构 * Shanghai Key Lab of Intelligent Information Processing, School of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院上海市智能信息处理重点实验室) Institute of Science and Technology for Brain-inspired Intelligence and MOE Frontiers Center for Brain Science, Fudan University(复旦大学类脑智能科学与技术研究院及教育部脑科学前沿中心) Shanghai Center for Brain Science and Brain-inspired Technology(上海脑科学与类脑研究中心) Department of Radiology, First Affiliated Hospital of College of Medical Science, Zhejiang University(浙江大学医学院附属第一医院放射科) Alibaba DAMO Academy(阿里巴巴达摩院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出PHASOR框架,通过体积扩散模型提升CT虚拟对比增强质量,引入解剖路由混合专家和强度-相位意识表示对齐模块,解决解剖异质性和空间偏移问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00985 2026-04-02 cs.CV 79%

Maximizing T2-Only Prostate Cancer Localization from Expected Diffusion Weighted Imaging

从预期扩散加权成像最大化T2-only前列腺癌定位

Weixi Yi, Yipei Wang, Wen Yan, Hanyuan Zhang, Natasha Thorley, Alexander Ng, Shonit Punwani, Fernando Bianco, Mark Emberton, Veeru Kasivisvanathan, Dean C. Barratt, Shaheer U. Saeed, Yipeng Hu

机构 * UCL Hawkes Institute and the Department of Medical Physics and Biomedical Engineering, University College London(伦敦大学学院霍克斯研究所与医学物理与生物医学工程系) Centre for Bioengineering, School of Engineering and Materials Science and Digital Environment Research Institute, Queen Mary University of London(伦敦玛丽女王大学工程与材料科学学院生物工程中心与数字环境研究所) Centre for Medical Imaging, University College London(伦敦大学学院医学影像中心) Division of Surgery & Interventional Science, University College London(伦敦大学学院外科与介入科学部) Urological Research Network(泌尿研究网络)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出利用T2加权图像和生成模型进行前列腺癌定位,通过期望最大化算法提升定位性能,相比传统方法在患者和区域层面表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏