arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-06 至 2026-01-06 共收录 81 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 60 篇

2601.01462 2026-01-06 math.NA cs.NA 78%

Convergence Analysis of PINNs for Fractional Diffusion Equations in Bounded Domains

在有限域内分数扩散方程中PINNs的收敛性分析

Elie Abdo, Lihui Chai, Ruimeng Hu, Xu Yang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种谱定义的平滑策略,用于在有限域内解决分数扩散方程的PINNs收敛性问题,通过严谨的能量估计证明了PINN在非局部方程中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01448 2026-01-06 cs.IR 78%

Adaptive Diffusion-based Augmentation for Recommendation

自适应扩散增强的推荐方法

Na Li, Fanghui Sun, Yan Zou, Yangfu Zhu, Xiatian Zhu, Ying Ma

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 ADAR通过生成可控的负样本提升推荐系统性能,无需修改架构,有效优化决策边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01381 2026-01-06 cond-mat.dis-nn physics.ed-ph 78%

Simulating diffusion and disorder-induced localization in random walks and transmission lines

模拟扩散和由无序引起的局域化现象在随机游走和传输线中

Jake S. Bobowski

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过两种模拟研究了随机游走和传输线中扩散与无序诱导局域化现象,揭示了从正常扩散到粒子局域化及波能指数限制的转变过程。

Comments Main text: 11 pages, 6 figures. Supplementary material: 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01194 2026-01-06 cs.IT eess.SP math.IT 78%

On the Structure of the Optimal Detector for Sub-THz Multi-Hop Relays with Unknown Prior: Over-the-Air Diffusion

关于子太赫兹多跳中继最优检测器结构:空中扩散

Ozgur Ercetin, Mohaned Chraiti

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种基于DDIMs的最优检测器框架,将子太赫兹多跳中继视为方差保持的扩散过程,通过端到端统计量实现近最优解码,无需中间节点CSI。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01109 2026-01-06 cs.CR 78%

NADD: Amplifying Noise for Effective Diffusion-based Adversarial Purification

NADD: 通过放大噪声实现有效的基于扩散的对抗净化

David D. Nguyen, The-Anh Ta, Yansong Gao, Alsharif Abuadbba

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 NADD通过放大噪声提升基于扩散的对抗净化鲁棒性,实现44.23%的准确率并大幅降低推理时间。

Comments 18

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00986 2026-01-06 math.NA cs.NA 78%

A Simple Weak Galerkin Finite Element Method for Convection-Diffusion-Reaction Equations on Nonconvex Polytopal Meshes

一种简单的弱伽辽金有限元方法用于非凸多边形网格上的对流-扩散-反应方程

Chunmei Wang, Shangyou Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种适用于非凸多边形网格的简单弱伽辽金有限元方法,用于高效求解对流-扩散-反应方程,并通过实验验证了其理论收敛性和计算效率。

Comments 24 pages, 16 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19044 2026-01-06 cs.NI 78%

Diffusion Model-Enhanced Environment Reconstruction in ISAC

基于扩散模型的ISAC环境重建

Nguyen Duc Minh Quang, Chang Liu, Shuangyang Li, Hoai-Nam Vu, Derrick Wing Kwan Ng, Wei Xiang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种基于扩散模型的ISAC环境重建方法,通过增强点云密度和去噪来提升环境感知精度。

Comments 6 pages, 5 figures, submitted to IEEE WCL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19991 2026-01-06 cs.SD cs.LG 78%

SAMUeL: Efficient Vocal-Conditioned Music Generation via Soft Alignment Attention and Latent Diffusion

SAMUeL:通过软对齐注意力和潜在扩散实现高效的语音条件音乐生成

Hei Shing Cheung, Boya Zhang, Jonathan H. Chan

机构 * Division of Engineering Science University of Toronto(工程科学系 马尼托瓦大学) Innovative Cognitive Computing Center King Mongkut's University of Technology Thonburi(创新认知计算中心 王后大学技术吞武里)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 SAMUeL通过软对齐注意力和潜在扩散技术,实现高效的语音条件音乐生成,参数减少220倍,推理速度提升52倍,性能优于OpenAI Jukebox。

Comments 7 pages, 3 figures, accepted to IEEE/WIC WI-IAT

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03280 2026-01-06 cs.IR 78%

Modeling Item-Level Dynamic Variability with Residual Diffusion for Bundle Recommendation

基于残差扩散的捆绑推荐中项目级动态变异建模

Dong Zhang, Lin Li, Ming Li, Amran Bhuiyan, Meng Sun, Xiaohui Tao, Jimmy Xiangji Huang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出RDiffBR模型,通过残差扩散方法提升捆绑推荐中项目级动态变异适应能力,使Recall和NDCG指标提升达23%。

Comments Extended version for AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18700 2026-01-06 cond-mat.stat-mech 78%

Generalized diffusion process with nonlocal interactions: Continuous time random walk model and stochastic resetting

非局部相互作用的广义扩散过程:连续时间随机游走模型与随机重置

Pece Trajanovski, Irina Petreska, Katarzyna Gorska, Ljupco Kocarev, Trifce Sandev

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种考虑非局部相互作用的广义扩散过程模型,结合连续时间随机游走和随机重置机制,揭示了系统在长时间尺度下的非平衡稳态行为。

Journal ref Reports on Mathematical Physics 96, 385 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.08419 2026-01-06 stat.ME 78%

High-Dimensional Time-Varying Coefficient Estimation in Diffusion Models

扩散模型中高维时间变化系数估计

Donggyu Kim, Minseog Oh, Minseok Shin

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出TED方法,通过去偏和阈值化技术实现高维时间变化系数的估计,实验证明其在资产回报解释中具有更高的R²值。

Comments 66 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04888 2026-01-06 cs.CV 70%

Training-Free Video Editing via Optical Flow-Enhanced Score Distillation

无需训练的视频编辑 via 光流增强的分数蒸馏

Lianghan Zhu, Yanqi Bao, Jing Huo, Jing Wu, Yu-Kun Lai, Wenbin Li, Yang Gao

专题命中 扩散模型 :text-to-image(abstract);image editing(abstract);分类 cs.CV

AI总结 本研究提出基于预训练文本到视频模型的分数蒸馏方法,通过迭代优化和光流增强技术,解决无需训练视频编辑中的内容保留与时间连续性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02256 2026-01-06 cs.CV cs.LG 57%

VAR RL Done Right: Tackling Asynchronous Policy Conflicts in Visual Autoregressive Generation

VAR RL Done Right: 解决视觉自回归生成中的异步策略冲突

Shikun Sun, Liao Qu, Huichao Zhang, Yiheng Liu, Yangyang Song, Xian Li, Xu Wang, Yi Jiang, Daniel K. Du, Xinglong Wu, Jia Jia

机构 * Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出了一种新的框架,通过显式管理异步策略冲突来增强组相对策略优化,从而提升视觉自回归生成模型的样本质量和目标对齐。

Comments Project page: https://github.com/ByteVisionLab/NextFlow

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02038 2026-01-06 cs.CV 57%

AlignVTOFF: Texture-Spatial Feature Alignment for High-Fidelity Virtual Try-Off

AlignVTOFF: 基于纹理-空间特征对齐的高保真虚拟试穿

Yihan Zhu, Mengying Ge

机构 * Sino-European School of Technology, Shanghai University(上海大学 sino-欧洲技术学院) National Demonstration Center for Experimental Engineering Training Education, Shanghai University(上海大学国家级实验工程培训教育示范中心)

专题命中 扩散模型 :image generation(abstract);分类 cs.CV

AI总结 AlignVTOFF通过纹理-空间特征对齐提升虚拟试穿的高保真生成效果

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01963 2026-01-06 cs.CV cs.LG 57%

Forget Less by Learning Together through Concept Consolidation

通过概念整合实现学习共存以减少遗忘

Arjun Ramesh Kaushik, Naresh Kumar Devulapally, Vishnu Suresh Lokhande, Nalini Ratha, Venu Govindaraju

机构 * University at Buffalo, SUNY(布法罗大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出FL2T框架,通过跨概念学习模块减少灾难性遗忘,提升概念保留与迁移效果。

Comments Accepted at WACV-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01892 2026-01-06 cs.CV cs.LG 57%

Forget Less by Learning from Parents Through Hierarchical Relationships

通过层级关系从父母学习来减少遗忘

Arjun Ramesh Kaushik, Naresh Kumar Devulapally, Vishnu Suresh Lokhande, Nalini K. Ratha, Venu Govindaraju

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 FLLP通过在超几何空间中引入父-子跨概念学习机制,减少生成模型在连续学习中的遗忘问题,提升模型的鲁棒性和泛化能力。

Comments Accepted at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11480 2026-01-06 cs.CV 57%

CADMorph: Geometry-Driven Parametric CAD Editing via a Plan-Generate-Verify Loop

CADMorph: 通过计划-生成-验证循环实现几何驱动的参数化CAD编辑

Weijian Ma, Shizhao Sun, Ruiyu Wang, Jiang Bian

机构 * Fudan University(复旦大学) Microsoft Research, Asia(微软亚洲研究院) University of Toronto(多伦多大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 CADMorph通过计划-生成-验证循环实现几何驱动的参数化CAD编辑,利用预训练模型在数据稀少情况下保持结构、语义和形状保真度,超越现有方法并支持下游应用。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01749 2026-01-06 cs.CV 57%

MANGO:Natural Multi-speaker 3D Talking Head Generation via 2D-Lifted Enhancement

MANGO:通过2D提升增强实现自然多说话者3D说话头生成

Lei Zhu, Lijian Lin, Ye Zhu, Jiahao Wu, Xuehan Hou, Yu Li, Yunfei Liu, Jie Chen

机构 * International Digital Economy Academy(国际数字经济学院) School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 MANGO通过两阶段框架和2D提升增强,实现自然多说话者3D说话头生成,提升对话行为的真实感和可控性。

Comments 20 pages, 11i figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01085 2026-01-06 cs.CV cs.AI 57%

Luminark: Training-free, Probabilistically-Certified Watermarking for General Vision Generative Models

Luminark:无需训练的、基于概率认证的通用视觉生成模型水印技术

Jiayi Xu, Zhang Zhang, Yuanrui Zhang, Ruitao Chen, Yixian Xu, Tianyu He, Di He

机构 * pku(北京大学) msra(微软亚洲研究院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 Luminark通过基于补丁亮度统计的水印定义,实现无需训练且具有概率认证的通用视觉生成模型水印技术,具备高检测精度和强鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02132 2026-01-06 physics.chem-ph 50%

Simulation of Radiation Chemistry by a One-Shot Hybrid Continuum / Monte Carlo Method

通过一次混合连续/蒙特卡洛方法模拟辐射化学

Charlie Fynn Perkins, Marcus Webb, Fred J. Currell

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过一次混合连续/蒙特卡洛方法高效模拟辐射化学过程,实现高精度快速计算。

Comments 9 pages, 7 figures, 6 pages supplementary info

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01916 2026-01-06 cs.NE 50%

Toward Thermodynamic Reservoir Computing: Exploring SHA-256 ASICs as Potential Physical Substrates

迈向热力学共振计算:探索SHA-256 ASICs作为潜在物理基质

Francisco Angulo de Lafuente, Vladimir Veselov, Richard Goodman

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出利用废弃的SHA-256 ASICs作为热力学共振计算的物理基质,通过分析其热力学噪声和定时动态,探索其在神经形态计算中的潜在应用。

Comments 8 pages, 7 tables, Position Paper / Hypothesis with Preliminary Observations

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01907 2026-01-06 cond-mat.soft 50%

Dense granular rheology from fluctuations

从波动角度研究密实颗粒流的流变学

Benjamin M. Alessio, Matthew R. Edwards, Ching-Yao Lai

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过分析颗粒温度方程和直接数值模拟,提出了一种统一框架来描述密实颗粒流动,并解释了模型非普遍性的原因。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01889 2026-01-06 math.NA cs.NA 50%

Approximation for stochastic time-space fractional cable equations driven by rough noise

由粗糙噪声驱动的随机时间-空间分数电缆方程的近似

Jiawei He, Jianhua Huang, Fang Su

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种由粗糙噪声驱动的随机时间-空间分数电缆方程的数值近似方法,通过算子理论和Wong-Zakai近似分析了解的正则性和收敛性,并采用谱伽辽金和后向欧拉卷积四阶方法进行数值计算。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24639 2026-01-06 cs.LG cs.AI 50%

Causal Ordering for Structure Learning from Time Series

时间序列中结构学习的因果顺序

Pedro P. Sanchez, Damian Machlanski, Steven McDonagh, Sotirios A. Tsaftaris

专题命中 扩散模型 :diffusion(abstract)

AI总结 DOTS通过整合多个因果顺序,提高了时间序列中因果结构学习的准确性和效率。

Comments 32 pages. Published in Transactions on Machine Learning Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15795 2026-01-06 math.AP 50%

Propagation of chaos for the Landau equation with very soft and Coulomb potentials

Landau方程中非常软和库仑势的混沌传播

Côme Tabary

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了Landau方程中非常软和库仑势的混沌传播问题,通过高可积性估计和熵耗散的亲和性证明了经验测度的收敛性。

Comments version 1 was submitted on June 18th 2025, covering very soft potentials only. version 2 was submitted on June 30th to cover Coulomb potentials, and to acknowledge the preprint by Feng and Wang submitted on June 17th

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12777 2026-01-06 nlin.AO 50%

Phase autoencoder for rapid data-driven synchronization of rhythmic spatiotemporal patterns

相自编码器用于快速数据驱动的节律空间时间模式同步

Koichiro Yawata, Ryo Sakuma, Kai Fukami, Kunihiko Taira, Hiroya Nakao

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种基于相自编码器的方法,用于实现反应扩散系统中节律空间时间模式的快速数据驱动同步。

Comments 11 pates, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02117 2026-01-06 math.NA cs.CE cs.MS cs.NA 50%

Vectorized Parallel in Time methods for low-order discretizations with application to Porous Media problems

向量并行时间方法用于低阶离散化及其在多孔介质问题中的应用

Christian Engwer, Alexander Schell, Nils-Arne Dreier

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种向量并行时间方法,用于缓解低阶离散化在多孔介质问题中的性能问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19857 2026-01-06 cond-mat.soft 50%

Dynamics of a Bottom-Heavy Janus Particle Near a Wall Under Shear Flow

靠近壁面的剪切流中底部重Janus粒子的动力学

Zohreh Jalilvand, Daniele Notarmuzi, Ubaldo M. Córdova-Figueroa, Emanuela Bianchi, Ilona Kretzschmar

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究了剪切流中靠近壁面的底部重Janus粒子的动力学,澄清了Peclet数定义和白噪声应用条件。

Journal ref Soft Matter, 2025, 21 5773-5784

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01667 2026-01-06 physics.optics physics.med-ph 50%

An Ingestible Light Source for Deep Photoacoustic Imaging

用于深层光电声成像的可吞食光源

David C. Garrett, Lihong V. Wang

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究提出一种可吞食的声能驱动光源,实现深层组织光电声成像,突破传统光学限制,用于胃肠道等深层区域的成像。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01585 2026-01-06 math.NA cs.NA 50%

A Unified Equilibrated Flux Recovery Framework with Robust A Posteriori Error Estimation

一种统一的平衡通量恢复框架与鲁棒的后验误差估计

Cuiyu He

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种统一的平衡通量恢复框架EARM,适用于不同有限元离散化,并通过正交空-消去方法确保唯一性,同时建立了鲁棒的后验误差估计器。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏