arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-25 至 2025-11-25 共收录 93 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 93 篇

2511.18673 2025-11-25 cs.CV 89%

Edit2Perceive: Image Editing Diffusion Models Are Strong Dense Perceivers

Edit2Perceive: 图像编辑扩散模型是强大的密集感知器

Yiqing Shi, Yiren Song, Mike Zheng Shou

机构 * Peking University(北京大学) Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 扩散模型 :diffusion(title,abstract);image editing(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 Edit2Perceive通过统一的扩散框架,利用图像编辑模型实现更高效的密集感知任务,展示了在深度、法线和磨边任务上的最新成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18262 2025-11-25 cs.CV 85%

MammothModa2: A Unified AR-Diffusion Framework for Multimodal Understanding and Generation

MammothModa2: 一种用于多模态理解和生成的统一AR-扩散框架

Tao Shen, Xin Wan, Taicai Chen, Rui Zhang, Junwen Pan, Dawei Lu, Fanding Lei, Zhilin Lu, Yunfei Yang, Chen Cheng, Qi She, Chang Liu, Zhenbang Sun

机构 * ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

AI总结 MammothModa2通过统一的AR-扩散框架实现多模态理解和生成,结合自回归语义规划与扩散生成,取得文本到图像和指令编辑的优异表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16986 2025-11-25 cs.CV 85%

VCE: Safe Autoregressive Image Generation via Visual Contrast Exploitation

VCE:通过视觉对比利用实现安全的自回归图像生成

Feng Han, Chao Gong, Zhipeng Wei, Jingjing Chen, Yu-Gang Jiang

专题命中 扩散模型 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 VCE通过视觉对比利用方法,有效保护自回归图像生成模型,实现对不安全内容的精确擦除并保持安全内容的完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19434 2025-11-25 cs.CV cs.LG stat.ML 83%

Breaking the Likelihood-Quality Trade-off in Diffusion Models by Merging Pretrained Experts

通过合并预训练专家打破扩散模型中似然-质量权衡

Yasin Esfandiari, Stefan Bauer, Sebastian U. Stich, Andrea Dittadi

机构 * Saarland University(萨尔兰大学) Helmholtz AI(亥姆霍兹人工智能研究所) Technical University of Munich(慕尼黑技术大学) CISPA Helmholtz Center for Information Security(亥姆霍兹信息安全部分研究所) MPI for Intelligent Systems, Tübingen(图宾根智能系统研究所)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 通过在去噪过程中切换预训练专家,该方法有效打破扩散模型中似然与质量的权衡,提升图像生成质量和似然

Comments ICLR 2025 DeLTa workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01421 2025-11-25 cs.CV 83%

InfoScale: Unleashing Training-free Variable-scaled Image Generation via Effective Utilization of Information

InfoScale: 通过有效利用信息实现免训练可变尺度图像生成

Guohui Zhang, Jiangtong Tan, Linjiang Huang, Zhonghang Yuan, Mingde Yao, Jie Huang, Feng Zhao

机构 * USTC(中国科学技术大学) Beihang University(北京航空航天大学) CUHK MMLab(香港中文大学多媒体实验室) Kuaishou Technology(快手科技)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 InfoScale通过有效利用信息解决扩散模型在可变尺度图像生成中的信息丢失、聚合不灵活和分布不匹配问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19379 2025-11-25 cs.LG 82%

Efficiency vs. Fidelity: A Comparative Analysis of Diffusion Probabilistic Models and Flow Matching on Low-Resource Hardware

效率与保真度:扩散概率模型与流匹配在低资源硬件上的比较分析

Srishti Gupta, Yashasvee Taiwade

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract)

AI总结 本研究通过比较流匹配与扩散模型在低资源硬件上的性能,发现流匹配在效率和保真度上更优,适合实时生成任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18900 2025-11-25 cs.GR cs.CV 81%

MatMart: Material Reconstruction of 3D Objects via Diffusion

通过扩散模型进行3D物体的材质重建

Xiuchao Wu, Pengfei Zhu, Jiangjing Lyu, Xinguo Liu, Jie Guo, Yanwen Guo, Weiwei Xu, Chengfei Lyu

机构 * Zhejiang University(浙江大学) Nanjing University(南京大学) Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

AI总结 本文提出了一种基于扩散模型的3D物体材质重建框架,通过两阶段重建和视图-材质交叉注意力机制,实现高保真材质预测与生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19274 2025-11-25 cs.CV 79%

Diffusion Reconstruction-based Data Likelihood Estimation for Core-Set Selection

基于扩散重建的数据似然估计的核心集选择

Mingyang Chen, Jiawei Du, Bo Huang, Yi Wang, Xiaobo Zhang, Wei Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于扩散重建的数据似然估计方法,通过重建偏差作为评分标准,有效提升核心集选择性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19049 2025-11-25 cs.CV 79%

Beyond Reward Margin: Rethinking and Resolving Likelihood Displacement in Diffusion Models via Video Generation

超越奖励边际:通过视频生成重新思考和解决扩散模型中的似然位移

Ruojun Xu, Yu Kai, Xuhua Ren, Jiaxiang Cheng, Bing Ma, Tianxiang Zheng, Qinhlin Lu

机构 * Zhejiang University(浙江大学) Tencent(腾讯)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出PG-DPO方法,通过结合ARS和IPR缓解扩散模型中的似然位移问题,提升视频生成任务的偏好对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18991 2025-11-25 cs.CV 79%

View-Consistent Diffusion Representations for 3D-Consistent Video Generation

用于3D一致视频生成的视图一致扩散表示

Duolikun Danier, Ge Gao, Steven McDonagh, Changjian Li, Hakan Bilen, Oisin Mac Aodha

机构 * University of Edinburgh(爱丁堡大学) University of Bristol(布里斯托大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ViCoDR通过学习多视图一致的扩散表示,提升视频生成的3D一致性,适用于图像到视频、文本到视频和多视图生成任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18786 2025-11-25 cs.CV 79%

STCDiT: Spatio-Temporally Consistent Diffusion Transformer for High-Quality Video Super-Resolution

STCDiT:一种时空一致的扩散变换器用于高质量视频超分辨率

Junyang Chen, Jiangxin Dong, Long Sun, Yixin Yang, Jinshan Pan

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(计算机科学与工程学院,南京理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 STCDiT通过结合运动感知的VAE重建和锚帧指导方法,实现了高质量视频超分辨率,提升了结构保真度和时间一致性。

Comments Project page: https://jychen9811.github.io/STCDiT_page

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18516 2025-11-25 cs.CV 79%

Breaking Forgetting: Training-Free Few-Shot Class-Incremental Learning via Conditional Diffusion

打破遗忘:通过条件扩散实现无训练的少样本类增量学习

Haidong Kang, Ketong Qian, Yi Lu

机构 * Northeastern University(东北大学) School of Information and Intelligent Science(信息与智能科学学院) Whiting School of Engineering(工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出无训练的少样本类增量学习方法,通过条件扩散过程替代梯度优化,缓解灾难性遗忘并提升泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01047 2025-11-25 cs.CV cs.AI cs.CL cs.LG 79%

In-Situ Tweedie Discrete Diffusion Models

原位 Tweedie 离散扩散模型

Xiao Li, Jiaqi Zhang, Shuxiang Zhang, Tianshui Chen, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Big Data Analysis and Processing(广东大数据分析与处理重点实验室) X-Era AI Lab(X-Era人工智能实验室) Guangdong University of Technology(广东工业大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本研究提出原位 Tweedie 离散扩散模型,通过在离散一热空间中直接执行扩散过程,实现对离散任务的有效建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00062 2025-11-25 cs.CV cs.AI cs.LG 79%

Scaffold Diffusion: Sparse Multi-Category Voxel Structure Generation with Discrete Diffusion

Scaffold Diffusion: 通过离散扩散模型生成稀疏多类体素结构

Justin Jung

机构 * Biohub Redwood City, USA(Biohub 红木城,美国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Scaffold Diffusion通过离散扩散模型生成稀疏多类3D体素结构,克服稀疏性带来的挑战,生成逼真且连贯的结构。

Comments Accepted at NeurIPS 2025 Structured Probabilistic Inference & Generative Modeling Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.03177 2025-11-25 cs.CV 79%

PanoDiffusion: 360-degree Panorama Outpainting via Diffusion

PanoDiffusion:通过扩散模型实现360度全景补全

Tianhao Wu, Chuanxia Zheng, Tat-Jen Cham

机构 * Nanyang Technological University(南洋理工大学) University of Oxford(牛津大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 PanoDiffusion通过双模潜在扩散模型实现360度全景补全,提升全景环绕一致性并生成高质量深度全景图。

Comments Project Page: https://sm0kywu.github.io/panodiffusion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18473 2025-11-25 cs.CV 79%

Uncertainty Quantification in HSI Reconstruction using Physics-Aware Diffusion Priors and Optics-Encoded Measurements

利用物理感知扩散先验和光学编码测量的超光谱图像重建不确定性量化

Juan Romero, Qiang Fu, Matteo Ravasi, Wolfgang Heidrich

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒·阿齐兹大学科学与技术学院) Shearwater Geoservices(Shearwater地服务公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出HSDiff框架,利用物理感知扩散先验和光学编码测量,提升超光谱图像重建的不确定性校准能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18104 2025-11-25 cs.CV 79%

Consolidating Diffusion-Generated Video Detection with Unified Multimodal Forgery Learning

通过统一多模态伪造学习巩固扩散生成视频检测

Xiaohong Liu, Xiufeng Song, Huayu Zheng, Lei Bai, Xiaoming Liu, Guangtao Zhai

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(上海交通大学信息科学与电子工程学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of Computer Science and Engineering, Michigan State University(密歇根州立大学计算机科学与工程系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MM-Det++算法,通过统一多模态学习检测扩散生成视频,结合时空分支和多模态分支,提升视频伪造检测的准确性和泛化能力。

Comments Code and dataset are available at https://github.com/SparkleXFantasy/MM-Det-Plus

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17839 2025-11-25 cs.CV 79%

Show Me: Unifying Instructional Image and Video Generation with Diffusion Models

Show Me: 用扩散模型统一指令图像和视频生成

Yujiang Pu, Zhanbo Huang, Vishnu Boddeti, Yu Kong

机构 * Michigan State University(密歇根州立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ShowMe通过统一视频扩散模型的空间和时间组件,提升指令图像和视频生成的性能与一致性。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13848 2025-11-25 cs.CV cs.LG 79%

SpecDiff: Accelerating Diffusion Model Inference with Self-Speculation

SpecDiff: 通过自推测加速扩散模型推理

Jiayi Pan, Jiaming Xu, Yongkang Zhou, Guohao Dai

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 SpecDiff通过自推测引入未来信息,提出无需训练的多级特征缓存策略,实现扩散模型推理的高效加速。

Comments Accepted by AAAI 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12953 2025-11-25 cs.CV 79%

Frame-wise Conditioning Adaptation for Fine-Tuning Diffusion Models in Text-to-Video Prediction

基于帧级条件的微调扩散模型用于文本到视频预测

Zheyuan Liu, Junyan Wang, Zicheng Duan, Cristian Rodriguez-Opazo, Anton van den Hengel

专题命中 扩散模型 :diffusion(title);text-to-image(abstract);分类 cs.CV

AI总结 本文提出帧级条件适应方法,通过引入帧级文本嵌入提升文本到视频预测的连续性与生成质量。

Comments Accepted by TMLR, 11/2025. 29 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03931 2025-11-25 cs.CV 79%

MagicMirror: ID-Preserved Video Generation in Video Diffusion Transformers

MagicMirror: 视频扩散变换器中的身份保留视频生成

Yuechen Zhang, Yaoyang Liu, Bin Xia, Bohao Peng, Zexin Yan, Eric Lo, Jiaya Jia

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 MagicMirror通过双分支特征提取器和两阶段训练策略,在视频扩散变换器中实现高质量身份保留视频生成,优于现有方法。

Comments ICCV 2025, It is best viewed in Acrobat. Project Page: https://julianjuaner.github.io/projects/MagicMirror/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13930 2025-11-25 eess.IV cs.CV 79%

RN-SDEs: Limited-Angle CT Reconstruction with Residual Null-Space Diffusion Stochastic Differential Equations

RN-SDEs: 有限角度CT重建与残差零空间扩散随机微分方程

Jiaqi Guo, Santiago Lopez-Tapia, Wing Shun Li, Yunan Wu, Marcelo Carignano, Martin Kröger, Vinayak P. Dravid, Igal Szleifer, Vadim Backman, Aggelos K. Katsaggelos

机构 * Department of Electrical and Computer Engineering, Northwestern University(电气与计算机工程系,西北大学) Department of Materials Science and Engineering, Northwestern University(材料科学与工程系,西北大学) Applied Physics Program, Northwestern University(应用物理项目,西北大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出RN-SDEs方法,通过均值回复随机微分方程和范围-零空间分解技术,实现有限角度CT重建中的高质量图像恢复和优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19390 2025-11-25 cs.LG astro-ph.SR cs.AI stat.ML 78%

Predicting partially observable dynamical systems via diffusion models with a multiscale inference scheme

通过多尺度推理方案利用扩散模型预测部分可观测的动力系统

Rudy Morel, Francesco Pio Ramunno, Jeff Shen, Alberto Bietti, Kyunghyun Cho, Miles Cranmer, Siavash Golkar, Olexandr Gugnin, Geraud Krawezik, Tanya Marwah, Michael McCabe, Lucas Meyer, Payel Mukhopadhyay, Ruben Ohana, Liam Parker, Helen Qu, François Rozet, K. D. Leka, François Lanusse, David Fouhey, Shirley Ho

机构 * The Polymathic AI Collaboration(多学科人工智能协作) Flatiron Institute(Flatiron研究所) University of Geneva(日内瓦大学) FHNW(FHNW大学) Princeton University(普林斯顿大学) New York University(纽约大学) University of Cambridge(剑桥大学) University of Kyiv(基辅大学) University of California, Berkeley(加州大学伯克利分校) University of Liège(列日大学) NorthWest Research Associates(北威州研究协会) Nagoya University(名古屋大学) Université Paris-Saclay, Université Paris Cité, CEA, CNRS, AIM(巴黎萨克雷大学、巴黎cité大学、CEA、CNRS、AIM)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种多尺度推理方案,利用扩散模型有效预测部分可观测的长记忆动力系统,应用于太阳动态和活跃区域演化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19363 2025-11-25 hep-ph nucl-th 78%

Numerical solution of the nonlinear boson diffusion equation for gluons

玻色扩散方程非线性解法用于胶子的热化过程

J. Rössler, G. Wolschin

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过数值方法求解非线性玻色扩散方程,研究胶子在重离子碰撞中的热化过程及能量依赖输运系数的影响。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19256 2025-11-25 cs.AI cs.LG 78%

SimDiff: Simpler Yet Better Diffusion Model for Time Series Point Forecasting

SimDiff: 更简单却更优的扩散模型用于时间序列点预测

Hang Ding, Xue Wang, Tian Zhou, Tao Yao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 SimDiff通过单一Transformer网络实现端到端时间序列点预测,利用内在输出多样性和多次推理集成,提升点估计性能和稳定性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19184 2025-11-25 q-bio.BM cs.AI 78%

Torsion-Space Diffusion for Protein Backbone Generation with Geometric Refinement

扭转空间扩散用于蛋白质主链生成与几何细化

Lakshaditya Singh, Adwait Shelke, Divyansh Agrawal

机构 * Dept. of Mechanical Engineering(机械工程系) Indian Institute of Technology Bombay(印度班加罗尔理工学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出扭转空间扩散模型,通过去噪扭转角生成物理有效的蛋白质主链,结合几何细化优化结构紧凑性,提升蛋白质生成的准确性与合理性。

Comments 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19152 2025-11-25 cs.LG stat.ML 78%

Masked Diffusion Models are Secretly Learned-Order Autoregressive Models

被掩盖的扩散模型实际上是秘密学习的顺序自回归模型

Prateek Garg, Bhavya Kohli, Sunita Sarawagi

机构 * Aalto University(奥卢大学) NUS, Singapore(新加坡国立大学) IIT Bombay(印度理工学院班加罗尔)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文揭示被掩盖的扩散模型实际上是一种具有可学习顺序的自回归模型,通过优化解码顺序提升生成性能。

Comments Accepted at EurIPS 2025 Workshop on Principles of Generative Modeling (PriGM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19143 2025-11-25 eess.SY cs.SY 78%

Optimal policy design for innovation diffusion: shaping today's incentives for transforming the future

创新扩散最优政策设计:塑造今日激励以变革未来

Lisa Piccinin, Valentina Breschi, Chiara Ravazzi, Fabrizio Dabbene, Mara Tanelli

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种基于模型预测控制的框架,用于设计促进创新扩散的激励措施,通过平衡大规模采用与资源分配来提升社会影响网络中的创新扩散效果。

Comments Submitted to IFAC World Congress 2026 and Control Engineering Practice

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19082 2025-11-25 cond-mat.stat-mech 78%

Phase Diagrams of the YK Surface-Reaction Model on 2D lattices with Exchange Diffusion

二维晶格上具有交换扩散的YK表面反应模型的相图

Henrique A. Fernandes, Roberto da Silva, Paulo F. Gomes

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究通过稳态蒙特卡洛模拟,探讨了二维晶格上YK表面反应模型在不同解离率和交换扩散率下的相图特性。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18798 2025-11-25 math.DS 78%

On the Stability of Discrete Reaction-Diffusion System of Networked Dynamical Systems

关于网络化动力系统离散反应-扩散系统的稳定性

Dinesh Kumar

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了网络化动力系统中反应-扩散系统的稳定性问题,通过捕食者-猎物系统生态网络验证了局部稳定性条件。

详情

展开后加载摘要…

URL PDF HTML 收藏