arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-24 至 2026-08-24 共收录 55 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 55 篇

2608.20334 2026-08-24 cs.CV 版本更新 85%

Exploring the Performance Frontier of Compact Unified Image Generation Models

Swift-Image:探索紧凑统一图像生成模型的性能前沿

Taihang Hu, Zhao Wang, Zuan Gao, Tao Liu, Hao Yan, Zhengze Xu, Yuhang Yu, Yongchao Du, Xingjian Wang, Jun Zheng, Qinye Zhou, Yaqi Cai, Zhengrui Chen, Chao Lin, Yefeng Shen, Yuan Wang, Zhengtao Wu, Ge Wu, Xiaoli Xu, Denghui Yang, Huayu Zhang, Mingzhou Zhang, Mengting Chen

专题命中 扩散模型 :image generation(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

AI总结 本研究提出紧凑统一图像生成模型Swift-Image,采用6B单流DiT等技术,实现领先综合性能,压缩后3B模型无明显损失,还总结了相关实用经验。

Comments 28 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20515 2026-08-24 cs.CV 新提交 83%

DiffVC-ONE: Diffusion-based Generative Video Compression with One-Step Video Diffusion Transformer

DiffVC-ONE:基于扩散模型的生成式视频压缩,采用单步视频扩散Transformer

Wenzhuo Ma, Zhenzhong Chen

机构 * school of Remote Sensing and Information Engineering, Wuhan University(武汉大学遥感信息工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffVC-ONE是基于扩散模型的生成式视频压缩框架,采用单步视频扩散Transformer,通过三类组件实现低推理成本下的高感知质量与时间一致性,在多基准上达最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21229 2026-08-24 cs.CV 新提交 79%

Anchoring Instruction Outside Mask: Exact Reference Caching for Efficient In-Context Diffusion Transformers

在掩码外锚定指令:用于高效上下文扩散Transformer的精确引用缓存

Yangshuai Liu, Zheming Li, Jiaao Li, Kang He, Ziliang Lai, Zhitai Liu, Chengru Song

机构 * Harbin Institute of Technology(哈尔滨工业大学) KlingAI Research(KlingAI研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究针对上下文扩散Transformer中引用增多导致计算量过大的问题,提出掩码外锚定指令的精确引用缓存方法,通过静态文本锚点结合速度蒸馏实现高效图像编辑,在保持生成质量的同时大幅提升了去噪速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20818 2026-08-24 cs.LG cs.AI cs.CV 新提交 79%

Scaling Muon for Diffusion Transformers

针对扩散Transformer的Muon优化器的缩放研究

Chenghao Li, Xiao Han, Xinxin Huang, Wei Liu, Boyang Li, Bing Xiao, Heran Zhang, Juanma Perez Rua, Ke Xu, Kangning Liu, Linjun Kuang, Na Li, Tan Wang, Tian Xie, Wei Peng, Yang Pei, Yifan Xu, Yuanhao Zhai, Yuwei Lin, Zhe Wang, Zihao He, Daniel Li, Junbiao Tang, Ziyang Jiang, Dake Chen

机构 * University of Southern California(南加州大学) Meta

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究针对大型扩散Transformer的Muon优化器,提出周期性行级Muon,在保留其生成质量优势的同时,大幅降低训练的计算、通信开销与时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20759 2026-08-24 cs.CV 新提交 79%

DiGS-Avatar: Single-Image Animatable 3D Human Reconstruction via UV-Space Diffusion

DiGS-Avatar:基于UV空间扩散的单图像可动画三维人体重建

Jiakun Li, Li Fang, Hao Zhu, Fei Hu, Long Ye, Yuan Zhang, Jinyao Yan

机构 * Key Laboratory of Media Audio and Video (Communication University of China)(中国传媒大学媒体音频与视频重点实验室) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DiGS-Avatar,将单图像可动画三维人体重建转化为UV空间扩散的潜变量补全任务,通过师生框架优化后解码为三维高斯基元,实现了高效高质量的重建与零样本泛化。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19567 2026-08-24 cs.CV 版本更新 79%

Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion

Block3D:基于分块扩散的高效文本到3D生成

Bowen Cui, Weijie Wang, Zeyu Zhang, Yefei He, Mingda Lin, Haoyu Zhao, Yuanyu He, Donny Y. Chen, Feng Chen, Bohan Zhuang

机构 * ZipLab, Zhejiang University(浙江大学ZipLab) University of California, Berkeley(加州大学伯克利分校) Wuhan University(武汉大学) Monash University(莫纳什大学) University of Adelaide(阿德莱德大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对文本到3D生成成本高的问题,提出Block3D分块扩散框架,通过分块生成、联合去噪及置信度引导的块内修正,在保持几何保真度的同时实现5.15倍的速度提升。

Comments Code is not ready for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21188 2026-08-24 eess.AS 新提交 78%

SlimDiffuSE: Towards Efficient Diffusion-Based Speech Enhancement using Slimmable Networks

SlimDiffuSE:使用可瘦身网络实现高效的基于扩散模型的语音增强

Nagashree K. S. Rao, Shrishti Saha Shetu, Mohamed Elminshawi, Emanuël A. P. Habets, Andreas Brendel

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究提出SlimDiffuSE可瘦身扩散模型,采用贪心搜索算法优化网络宽度调度,在PESQ、SI-SDR指标无显著下降的情况下,将计算复杂度最高降低87.5%,实现高效语音增强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20635 2026-08-24 stat.ML cs.LG 新提交 78%

Minimax Optimality of Score-Entropy Discrete Diffusion

得分-熵离散扩散的极小极大最优性

Cholyeon Cho, Yuchen Wu

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究得分-熵离散扩散(SEDD)的统计极限,针对均匀和掩码离散扩散模型建立极小极大下界,提出匹配下界的MLE阈值估计器,证明SEDD经合适设置可达到接近最优的极小极大样本复杂度。

Comments 26 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20366 2026-08-24 q-bio.BM cs.LG 新提交 78%

Harmonic Torsional Diffusion for Protein-Ligand Flexible Docking

用于蛋白质-配体柔性对接的调和扭转扩散

Maksim Zhdanov, Pavel Strashnov, Vladislav Kurenkov

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出Harmony调和扭转扩散框架,通过对齐得分参数化与扩散过程几何,在PDBBind、PoseBusters基准及EBNA1、KRAS G12D案例中提升了蛋白质-配体柔性对接的精度与有效性。

Comments Accepted at the 2026 Workshop on Generative and Agentic AI for Biology (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21040 2026-08-24 cs.SI 新提交 78%

From Propagation to Protection: Risk-Aware Diffusion for Harm Minimization in Signed Social Networks

从传播到保护:用于符号社交网络中危害最小化的风险感知扩散模型

Aaqib Zahoor, Janibul Bashir, Iqra Altaf Gillani

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对符号社交网络中敌对关系传播的危害问题,提出风险感知扩散模型RASH,构建危害最小化模型HM,在六个网络上实现最高危害减少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20935 2026-08-24 cs.CE 新提交 78%

An Imaging-Informed Reaction-Diffusion Model of Infarct Growth

基于影像信息的梗死生长反应-扩散模型

Muhammad Hussnain Abbas, Michal Balcerak, Asif Ahmad, Bjoern Menze, Ezequiel de la Rosa

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对卒中梗死体积预测的临床痛点,提出首个从急性MRI参数化Fisher-KPP反应-扩散PDE的影像驱动框架,在ISLES 2017数据集上验证其性能优于传统rCBF阈值法,兼具生理可解释性,推动卒中预测从纯数据驱动转向患者特异性生物物理预测。

Comments Accepted at MICCAI 2026 Satellite Events (LNCS). 11 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20839 2026-08-24 cs.CL cs.CR cs.LG 新提交 78%

SAC-Copula: Quality-Preserving Watermarking for Diffusion Language Models via Smooth Correlated Gumbel Fields

SAC-Copula:基于平滑相关Gumbel场的扩散语言模型质量保留水印

Baixin Li, Haiyun He

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对扩散语言模型的水印方法与迭代并行去掩蔽不兼容的问题,提出SAC-Copula方法,通过高斯Copula构建平滑相关Gumbel扰动场实现质量保留水印,在LLaDA等数据集上验证了其质量-可检测性权衡优势。

Comments Accepted to Findings of EMNLP 2026. 24 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20804 2026-08-24 cs.CL cs.AI 新提交 78%

Denoising the Future: Context-Aware Spectral Diffusion for Temporal Knowledge Graph Extrapolation

去噪未来:用于时序知识图谱外推的上下文感知谱扩散

Yanglei Gan, Peng He, Run Lin, Peiyuan Jiang, Yifan Wang, Qiao Liu

机构 * Southwest Minzu University(西南民族大学) University of Electronic Science and Technology of China(电子科技大学) Zhejiang University(浙江大学) Tencent(腾讯)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对现有扩散式时序知识图谱外推方法的目标判别信号削弱问题,提出FreqDiff频率感知扩散框架,通过双流去噪器与频域正则化项提升性能,在四个公开基准上达最优表现。

Comments EMNLP 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20743 2026-08-24 cs.AI 新提交 78%

Is Multimodal Speculative Decoding Ready for Diffusion-Based Parallel Drafting? A Survey and Empirical Diagnosis

多模态推测解码是否适用于基于扩散的并行草稿生成?一项调查与实证诊断

Yantao Li, Huanlin Gao, Fang Zhao, Chao Tan, Qiang Hui, Shuting Liu, Fuyuan Shi, Ting Lu, Shaoan Zhao, Xueqiang Guo, Xinpei Su, Jianbing Zhang, Xinyu Dai, Kai Wang, Shiguo Lian

机构 * Data Science & Artificial Intelligence Research Institute, China Unicom(中国联通数据科学与人工智能研究院) Unicom Data Intelligence, China Unicom(中国联通数据智能)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过调查多模态模型并开展跨架构实证研究,探究多模态推测解码是否适用于基于扩散的并行草稿生成,提出统一分类法并分析现有方法的局限性与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20795 2026-08-24 math.AP 新提交 78%

Propagation Direction of Bistable Traveling Fronts in the Lotka--Volterra Competition--Diffusion System

两物种Lotka–Volterra竞争-扩散系统中双稳行波前的传播方向

Shizhao Ma, Dongyuan Xiao, Maolin Zhou

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对两物种Lotka–Volterra竞争-扩散系统强竞争下双稳行波前传播方向问题,结合麦克斯韦型恒等式与相平面刚性论证建立波速为零的全局充要判据,明确了该系统强竞争参数区域内的传播方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21061 2026-08-24 physics.chem-ph 新提交 78%

A differentiable photon-by-photon likelihood for continuous free-energy landscapes and diffusion coefficients from single-molecule FRET

用于从单分子FRET获取连续自由能景观和扩散系数的逐光子可微似然

Lars Dingeldein, Roberto Covino

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种逐光子可微似然,可从单分子FRET数据联合推断连续自由能景观、扩散系数等参数,该方法高效且支持不确定性评估,可扩展至大型数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20519 2026-08-24 physics.med-ph cs.AI 新提交 78%

An integrated diffusion-weighted imaging processing and interpretation platform for MR-guided radiotherapy

用于磁共振引导放疗的扩散加权成像处理与解释一体化平台

Yunxiang Li, Yan Dai, Yen-Peng Liao, Jie Deng, Jill B De Vis, You Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究开发了一体化网络平台,整合MR-Linac的DWI后处理与可追溯的RAG临床解释,经专家评分验证其在胶质母细胞瘤病例中具有高临床实用性。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15131 2026-08-24 cond-mat.stat-mech 版本更新 78%

Quasiparticle Diffusion for the Toda Fluid in Equilibrium

平衡态Toda流体中的准粒子扩散

Seema Chahal, Alberto Brollo, Indranil Mukherjee, Abhishek Dhar, Anupam Kundu, Herbert Spohn

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对Toda流体,提出基于Lax矩阵特征向量追踪准粒子轨迹的数值方案,数值验证了准粒子的布朗运动,并计算了扩散常数,与TBA预测吻合。

Comments 25 pages+ Appendices, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30748 2026-08-24 cs.SD cs.AI eess.AS 版本更新 78%

Chatterbox-Flash: Prior-Calibrated Block Diffusion for Streaming Zero-Shot TTS

Chatterbox-Flash: 用于流式零样本TTS的先验校准块扩散

Deokjin Seo, Gangin Park, Kihyun Nam

机构 * Resemble AI Seoul National University(首尔国立大学) KAIST(韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出Chatterbox-Flash,通过将预训练自回归TTS解码器微调为块扩散解码器,实现块内并行生成与块间流式推理,并引入先验校准评分和早期解码调度解决长尾分布导致的生成质量下降问题。

Comments 8 pages, 4 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08055 2026-08-24 cond-mat.mtrl-sci 版本更新 78%

Anisotropic Defect Diffusion in Layered CsPbBr$_\mathrm{x}$I$_\mathrm{3-x}$ Perovskites

层状CsPbBr$_\mathrm{x}$I$_\mathrm{3-x}$钙钛矿中各向异性缺陷扩散

Konrad Wilke, Mike Pols, Titus S. van Erp, Geert Brocks, Shuxia Tao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究通过分子动力学模拟探讨层状CsPbBr$_\mathrm{x}$I$_\mathrm{3-x}$钙钛矿中缺陷扩散的各向异性,揭示层状卤素排列对材料稳定性及缺陷迁移的调控作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02760 2026-08-24 cs.CL cs.AI 版本更新 78%

Efficient Self-Evaluation for Diffusion Language Models via Sequence Regeneration

通过序列再生实现扩散语言模型的高效自评

Linhao Zhong, Linyu Wu, Wen Wang, Yuling Xi, Chenchen Jing, Jiaheng Zhang, Hao Chen, Chunhua Shen

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Zhejiang University of Technology(浙江工业大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出DiSE方法,通过序列再生概率实现扩散语言模型的高效自评,提升质量评估的效率和可靠性。

Comments accepted to ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18787 2026-08-24 cond-mat.stat-mech math-ph q-bio.QM 版本更新 78%

The Global Diffusion Limit for the Space Dependent Variable-Order Time-Fractional Diffusion Equation

依赖空间的变阶时间分数阶扩散方程的全局扩散极限

Christopher N. Angstmann, Daniel S. Han, Bruce I. Henry, Boris Z. Huang, Zhuang Xu

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究提出了收敛到依赖空间的变阶时间分数阶扩散方程的连续与离散时间随机游走模型,为该方程提供了 underlying 随机游走及数值求解方法,助力空间非均匀介质扩散模型的开发与验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13922 2026-08-24 math.AP math-ph physics.plasm-ph 版本更新 71%

Existence and Smoothing for a Nondivergence-Form Degenerate Diffusion from Plasma-Wave Theory

等离子体不稳定性理论中退化扩散的存在性与光滑化效应

William Porteous, Irene M. Gamba, Kun Huang

专题命中 扩散模型 :diffusion(title)

AI总结 针对半线上由等离子体波准线性理论导出的退化抛物方程,在加权L^p初值和有界强迫项下证明弱解的存在性,并利用Bénilan-Crandall不等式揭示解的正时间光滑化机制,包括空间Hölder连续性和局部Lipschitz性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08319 2026-08-24 cs.CV cs.LG 版本更新 70%

A continually expandable foundation model for brain MRI

可持续扩展的脑MRI基础模型

Michail Mamalakis, Carmen Jimenez-Mesa, Yonghao Li, Hao Chen, Chao Li, Antonios Mamalakis, John Suckling, Richard Bethlehem, Stephen J. Price, Richard J. Gilbertson, Pietro Lio

机构 * University of Cambridge(剑桥大学) University of Málaga(马拉加大学)

专题命中 扩散模型 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出可扩展的Alcmaeon脑MRI基础模型,结合体积编码、潜在扩散生成与Graph-Blueprint Pruning,在跨临床领域扩展时遗忘程度更低,可支持多种任务,为持续发展的脑MRI基础模型提供了可行方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20489 2026-08-24 cond-mat.quant-gas physics.atm-clus physics.atom-ph 新提交 67%

Self-limiting electrostriction of a single ion in an ultracold polar gas: From mesoscopic ions to crystalline molecular rings

超冷极性气体中单个离子的自限电致伸缩:从介观离子到结晶分子环

Ruiren Shi, Saajid Chowdhury, Leon Karpa, Jesús Pérez-Ríos

专题命中 扩散模型 :diffusion(abstract,abstract_cn)

AI总结 该研究探究超冷极性气体中单个离子周围极性分子的自组装,结合全局优化与扩散蒙特卡洛方法,揭示了离子结合极性分子团簇的特殊结构与稳定性,为研究量子浴中带电杂质提供新途径。

Comments 18 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23489 2026-08-24 cs.GR cs.CV 版本更新 62%

MeshFlow: Mesh Generation with Equivariant Flow Matching

MeshFlow: 基于等变流匹配的网格生成

Qi Sun, Kiyohiro Nakayama, Jing Nathan Yan, Qixing Huang, Alexander Rush, Leonidas Guibas, Gordon Wetzstein, Jing Liao, Guandao Yang

机构 * City University of Hong Kong(香港城市大学) Stanford University(斯坦福大学) The University of Texas, Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 提出MeshFlow,利用等变最优传输流匹配模型直接生成三角网格,避免序列化,通过改进扩散变压器架构实现等变性,推理速度提升约18倍。

Comments SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20621 2026-08-24 cs.CV 新提交 57%

RECOUNT: Reference-guided Counting with Synthetic Visual Exemplars

RECOUNT:基于合成视觉示例的参考引导计数

Adriano D'Alessandro, Ali Mahdavi-Amiri, Ghassan Hamarneh

机构 * Simon Fraser University(西蒙菲莎大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 RECOUNT是基于合成视觉示例的图像引导零样本计数即插即用框架,通过扩散模型扩展参考图像生成示例库,在两个基准上实现最优零样本计数准确率,大幅降低计数误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20534 2026-08-24 cs.CV 新提交 57%

Grounded-Exo2Ego: Structured Semantic Grounding for Robust Exocentric-to-Egocentric Video Generation

Grounded-Exo2Ego:用于鲁棒外部视角到自我视角视频生成的结构化语义 grounding

Shengze Wang, Michael Stengel, Tianye Li, Seonwook Park, Amrita Mazumdar, Koki Nagano, Alex Trevithick, Shalini De Mello

机构 * NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出Grounded-Exo2Ego框架,通过双分支视频扩散模型、相机重定位算法和自动合成数据引擎,在EgoExo4D数据集上大幅提升了外部视角到自我视角视频生成的性能。

Comments website url: this https URL (https://research.nvidia.com/labs/amri/projects/grounded-exo2ego/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20561 2026-08-24 eess.IV cs.AI cs.CV cs.LG physics.med-ph 新提交 57%

Consistency Models for Fast MRI Reconstruction Using Regularization by Denoising

基于去噪正则化的快速MRI重建一致性模型

Merve Gülle, Junno Yun, Yaşar Utku Alçalar, Mehmet Akçakaya

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本研究提出CM-RED方法,将一致性模型整合到去噪正则化框架中,仅用4次网络函数评估,在fastMRI数据集上实现优于现有方法的快速高质量MRI重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01479 2026-08-24 cs.CV 版本更新 57%

RecGen3D: Reconstruction-Guided 3D Generation in a Shared Canonical Space

UniRecGen:统一多视图3D重建与生成

Zhisheng Huang, Jiahao Chen, Cheng Lin, Chenyu Hu, Hanzhuo Huang, Zhengming Yu, Mengfei Li, Yuheng Liu, Zekai Gu, Zibo Zhao, Yuan Liu, Xin Li, Wenping Wang

机构 * Macau University of Science and Technology(澳门科技大学) Xidian University(西安电子科技大学) ShanghaiTech University(上海科技大学) Hong Kong University of Science and Technology(香港科技大学) University of California, Irvine(加利福尼亚大学尔湾分校)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 UniRecGen融合了高效重建与生成模型,通过共享空间协作学习提升多视图3D模型的完整性和一致性,实验显示其在稀疏观测下生成更精确稳定的3D模型。

Comments Accepted to SIGGRAPH Asia 2026 (Conference Papers). 21 pages including supplementary material. Code: this https URL (https://github.com/zsh523/RecGen3D)

详情

展开后加载摘要…

URL PDF HTML 收藏