arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3080 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 2359 篇

2607.13778 2026-07-16 math.AP 新提交 71%

Recovery of coefficients for a convection-diffusion equation from partial data

从部分数据中恢复对流扩散方程的系数

Liam Buisson

专题命中 扩散模型 :diffusion(title)

AI总结 研究从部分边界测量中恢复抛物型方程中依赖时空变量的零阶和一阶系数的反问题,通过开发特殊解、引入非线性权重卡尔曼估计并结合X射线变换部分数据结果来实现,还建立了新的卡尔曼估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08757 2026-07-10 stat.ML cs.LG cs.NA math.NA math.PR 新提交 71%

Score Accuracy Along the Forward Diffusion Does Not Certify Numerical Stability in Diffusion Sampling

正向扩散过程中的得分准确性并不能保证扩散采样中的数值稳定性

Yiwei Zhou

专题命中 扩散模型 :diffusion(title)

AI总结 研究正向扩散得分准确性与数值稳定性关系,构造特殊得分场及去噪器族揭示小正向边缘误差不能保证稳定性,对紧支集数据有肯定结果,实验展示数值轨迹增长及投影抑制效果。

Comments 27 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07327 2026-07-09 math.NA cs.NA 新提交 71%

Iterative finite element approximation of non-monotone semilinear diffusion-reaction equations

非单调半线性扩散反应方程的迭代有限元逼近

Florian Spicher, Thomas P. Wihler

专题命中 扩散模型 :diffusion(title)

AI总结 研究非单调半线性扩散反应方程数值逼近的迭代线性化有限元法,采用稳定的IMEX迭代结合分级网格上的一阶有限元离散化,在角加权Sobolev空间建立正则性估计,得出离散伽辽金极限的最优先验收敛估计,数值实验验证了理论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04739 2026-07-07 cs.RO 新提交 71%

Spatial Attention: Adapting Execution Horizons for Diffusion Policies via Observation Sensitivity

空间注意力:通过观测敏感度调整扩散策略的执行范围

Che-Sang Park, Junsu Ha, Jianlong Fu, Frank C. Park

机构 * Robotics Laboratory, Seoul National University(首尔国立大学机器人实验室) Microsoft Research Asia(微软亚洲研究院)

专题命中 扩散模型 :diffusion(title)

AI总结 研究如何在机器人学习中自适应调整采样动作块的执行范围以平衡响应性和计算成本,引入空间注意力概念,通过预测未来值动态分配执行范围,实验表明该方法可提高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02349 2026-07-03 math.NA cs.NA math.PR 新提交 71%

A PDE-Based Framework for Generative Modeling Beyond Classical Score-Based Diffusion

超越经典得分扩散的基于PDE的生成建模框架

Horacio Tettamanti, Michael Herty

专题命中 扩散模型 :diffusion(title)

AI总结 提出基于非线性Ornstein-Uhlenbeck动力学的生成框架,通过粒子系统和非线性Fokker-Planck方程描述,证明前向动力学中的凝聚现象,并推导稳定化的反向PDE以重建初始分布,扩展了生成范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31268 2026-07-01 cs.LG cs.AI 新提交 71%

TDGT: A Tabular Data Generation Toolkit supporting adaptive GPU-accelerated Bayesian mixture models, diffusion-based models, and latent-space generative modeling

TDGT:一种支持自适应GPU加速贝叶斯混合模型、扩散模型和潜在空间生成建模的表格数据生成工具包

Vasileios C. Pezoulas, Nikolaos S. Tachos, Eleni Georga, Kostas Marias, Manolis Tsiknakis, Dimitrios I. Fotiadis

机构 * SYNTHAINA AI

专题命中 扩散模型 :diffusion(title)

AI总结 提出TDGT工具包,集成自适应贝叶斯混合合成器(ABMS)及其变体VAE-ABMS,支持GPU加速,通过11项统计保真度指标评估,在医疗、社会经济和网络安全数据集上验证了生成质量。

Comments 47 pages (33 main body, 14 pages supplementary material), 30 figures (12 figures in the main body, 18 supplementary figures), 9 tables (3 tables in the main body, 6 supplementary tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31604 2026-07-01 cond-mat.dis-nn cond-mat.mes-hall 新提交 71%

Eigenstate Transitions, Duality, and Anomalous Diffusion in a Quasiperiodic Qi-Wu-Zhang Chern Insulator

准周期Qi-Wu-Zhang陈绝缘体中的本征态转变、对偶性和反常扩散

Tengming Lou, Haiyang Wang, Haijiao Ji, Haiwen Liu

专题命中 扩散模型 :diffusion(title)

AI总结 研究准周期调制下磁性Qi-Wu-Zhang陈绝缘体模型,发现当|m+2|≤t_y时系统从扩展相直接进入临界相并保持临界性,通过有限尺寸标度和对偶变换解释相图,区分弹道、反常扩散和局域化动力学。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27924 2026-06-29 econ.GN q-fin.EC 新提交 71%

Heterogeneous Diffusion of Electric Vehicles in China: Demand, Learning, Product Entry, and the Incidence of Industrial Policy

中国电动汽车的异质性扩散:需求、学习、产品进入及产业政策的影响

Yu, Hao, Jinge Li

专题命中 扩散模型 :diffusion(title)

AI总结 通过均衡差异化产品模型量化中国电动汽车市场转型,发现补贴每元带来3.38元私人剩余,但收益分布不均;历史增长主因产品质量提升和品种扩大,补贴直接贡献为负但取消补贴将大幅降低份额。

Comments appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28075 2026-06-29 physics.bio-ph 新提交 71%

Active diffusion enhances plankton carbon capture and phycosphere radius

主动扩散增强浮游植物碳捕获与藻际圈半径

Maggie Liu, Arnold J. T. M. Mathijssen

专题命中 扩散模型 :diffusion(title)

AI总结 通过解析模型和随机模拟,发现浮游生物主动混合周围流体可显著增加碳通量,并扩大藻际圈半径,为海洋微生物生态和全球碳捕获提供新见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24254 2026-06-24 physics.optics 新提交 71%

Enhancing Speckle Metrology with Diffusion Denoising in Photon-Starved Regimes

在光子匮乏条件下利用扩散去噪增强散斑计量

Admir Bajraktarevic, Alexander C. Trowbridge, Saba N. Khan, Anton van den Hengel, Graham D. Bruce, Kishan Dholakia

专题命中 扩散模型 :diffusion(title)

AI总结 提出一种扩散去噪框架,通过混合预训练和实验微调策略,在低信号条件下分离测量噪声与散斑结构,应用于积分球波长传感时均方根误差降低72%。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23625 2026-06-23 cs.RO 新提交 71%

Learning to See While Learning to Act: Diffusion Models for Active Perception in Robot Imitation

学习行动的同时学习观察:机器人模仿中的主动感知扩散模型

Kuancheng Wang, Vaibhav Saxena, Shuo Cheng, Yotto Koga, Danfei Xu

机构 * Georgia Institute of Technology(佐治亚理工学院) Autodesk Research(欧特克研究院) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(title)

AI总结 提出See2Act模仿学习方法,通过耦合动作去噪与视角优化,在测试时基于主动推断的视角序列预测动作,解决遮挡下的部分可观测问题,在Ravens和RLBench任务上性能提升达34%。

Comments Project website: see2act.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20846 2026-06-23 cs.SI 新提交 71%

Adverse Online Social Interactions: A Multi-Level Evolutionary Analysis of Local Patterns, Diffusion, and Community Disruption

不良在线社交互动:局部模式、扩散与社区破坏的多层次进化分析

Xueqi Cheng, Qinwen Ge, Hamid Karimi, Yushun Dong, Tyler Derr

专题命中 扩散模型 :diffusion(title)

AI总结 提出多层次框架,从微观、中观、宏观分析不良社交互动如何局部出现、传播并破坏社区,发现结构断开与有毒沟通互补影响社区演化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23648 2026-06-23 math.PR math.OC 新提交 71%

Optimal Stopping for a Diffusion with Unobserved Bernoulli Drift

具有未观测伯努利漂移的扩散过程的最优停止

Georgy Gaitsgori, Ioannis Karatzas

专题命中 扩散模型 :diffusion(title)

AI总结 针对带未观测伯努利漂移的维纳过程,在对称且随距离增加的终端成本及正单位时间成本下,通过叶状结构将问题提升到二维空间,显式求解最优停止问题,并刻画停止区域。

Comments 47 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22254 2026-06-23 physics.soc-ph econ.EM 新提交 71%

Professional networks and the diffusion of clinical guidelines in opioid prescribing

专业网络与阿片类药物处方临床指南的扩散

Yi-Ning Weng, Hsuan-Wei Lee

专题命中 扩散模型 :diffusion(title)

AI总结 利用2013-2020年Medicare Part D数据,研究专业网络如何影响阿片类药物处方及CDC指南的传播,发现网络中心性高的医生对政策响应更大。

Comments 34 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20807 2026-06-23 cond-mat.stat-mech 新提交 71%

Tuning ergodicity breaking: Anomalous diffusion under asymptotic power-law forcing

调节遍历性破缺:渐近幂律强迫下的反常扩散

Raul V. B. Morás, M. Florencia Carusela, Luciano C. Lapas

专题命中 扩散模型 :diffusion(title)

AI总结 研究通过广义朗之万方程中的标度参数η,揭示了渐近幂律外力驱动下系统的热化、遍历性破缺和失控增长三种动力学相,并发现涨落-耗散定理与外力无关。

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17999 2026-06-23 cs.CL 新提交 71%

VoidPadding: Let [VOID] Handle Padding in Masked Diffusion Language Models so that [EOS] Can Focus on Semantic Termination

VoidPadding: 让 [VOID] 处理掩码扩散语言模型中的填充,以便 [EOS] 专注于语义终止

Chunyu Liu, Zhengyang Fan, Kaisen Yang, Alex Lamb

机构 * Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title)

AI总结 提出VoidPadding方法,通过引入[VOID]令牌处理填充,将[EOS]从双重角色中解放,实现大块解码下的早期停止和自适应响应扩展,在数学推理和代码生成任务上平均提升17.84分,并减少55.7%的NFE。

Comments Minor related-work revisions; results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19656 2026-06-19 cs.RO cs.LG 新提交 71%

DF-ExpEnse: Diffusion Filtered Exploration for Sample Efficient Finetuning

DF-ExpEnse: 扩散滤波探索用于高效样本微调

Calvin Luo, Chen Sun, Shuran Song

机构 * Stanford University(斯坦福大学) Brown University(布朗大学)

专题命中 扩散模型 :diffusion(title)

AI总结 提出DF-ExpEnse探索技术,利用生成控制策略的多模态建模能力和评论家集成,在微调中高效收集在线经验,提升样本效率。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19070 2026-06-18 math.AP 新提交 71%

A Measure-Valued Obstacle Problem for an Obliquely Reflected Diffusion with a Max-Type Payoff

具有最大值型收益的斜反射扩散的测度值障碍问题

Louis Shuo Wang, Jiguang Yu, Ye Liang

专题命中 扩散模型 :diffusion(title)

AI总结 针对非负象限中具有非光滑最大值型收益的斜反射最优停止问题,提出测度值势论形式的障碍问题公式,推导反射Itô-Tanaka恒等式,并证明验证定理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18183 2026-06-17 stat.ML cs.LG math.PR 新提交 71%

A Diffusion Approximation for Temporal-Difference Learning with Linear Features under Markovian Noise

马尔可夫噪声下线性特征时序差分学习的扩散近似

M. Forzo, E. Monzio Compagnoni, A. Russo, A. Pacchiano

机构 * Technical University of Munich (TUM), Munich, Germany(慕尼黑技术大学) University of Basel, Basel, Switzerland(巴塞尔大学) Boston University, Boston, USA(波士顿大学)

专题命中 扩散模型 :diffusion(title)

AI总结 针对线性TD(0)在马尔可夫噪声下的随机波动,提出随机微分方程近似模型,揭示投影Bellman算子收缩动力学与马尔可夫采样影响的区别,解释常数步长误差下限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13433 2026-06-12 stat.ME 新提交 71%

Smoothed-KL Reweighting: A Principled Account and Matching Rule for SNR-Based Diffusion Training

平滑KL重加权:基于信噪比的扩散训练的原则性解释与匹配规则

Lei Li

专题命中 扩散模型 :diffusion(title)

AI总结 提出平滑KL重加权方法,从扩散散度推导出闭式权重,建立与Min-SNR家族的匹配规则,在CIFAR-10和CelebA-64上验证,最终FID相当但迭代效率因数据集而异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10368 2026-06-10 cs.SD cs.AI 新提交 71%

Speech Meets ELF: Audio Conditional Continuous-Target Diffusion for Speech Recognition and Translation

语音遇见ELF:用于语音识别和翻译的音频条件连续目标扩散

Xuanchen Li, Tianrui Wang, Yuheng Lu, Zikang Huang, Yu Jiang, Chenghan Lin, Chenrui Cui, Ziyang Ma, Xingyu Ma, Chunyu Qiang, Guochen Yu, Xie Chen, Longbiao Wang, Jianwu Dang

机构 * Tianjin University(天津大学) Shanghai Jiao Tong University(上海交通大学) Nankai University(南开大学)

专题命中 扩散模型 :diffusion(title)

AI总结 提出ELF-S2T,一种基于预训练ELF骨干的音频条件连续目标生成模型,通过音频强制训练和分类器自由引导,在LibriSpeech和CoVoST2上实现竞争性ASR和S2TT性能,并揭示识别与翻译错误均源于连续潜空间中的近距离混淆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14043 2026-08-17 cs.CV 新提交 70%

Beyond Text Conditioning: A Systematic Study of MLLM-DiT Fusion for Video Generation

超越文本条件:面向视频生成的MLLM-DiT融合系统研究

Yanbo Ding, Yijia Fan, Caihua Shan, Yifan Yang, Yifei Shen, Weijie Wang, Xirui Hu, Dongsheng Li, Lili Qiu, Yuqing Yang, Yali Wang

机构 * Chinese Academy of Sciences(中国科学院) Microsoft Research(微软研究院) Sun Yat-sen University(中山大学) Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学)

专题命中 扩散模型 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 该研究针对视频生成中MLLM与DiT融合问题,提出BiVidGen框架,通过MLLM生成语义视觉标记辅助DiT渲染,提升了视频的语义对齐度与时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13729 2026-08-17 cs.CV 新提交 70%

Limitations of Synthetic Data Generation in Specialized Data-Scarce Domains

合成数据生成在数据稀缺的专业领域中的局限性

Edward Zhang, Marcel Hussing, Tanay Tandon, Shenbagaraj Kannapiran, Jason Hughes, Youkang Wang, Joshua Caswell, Agelos Kratimenos, Yi Fan Li, Milan Manoj, Ethan Sanchez, Sumukh Shrote, Camillo Jose Taylor, Daniel A. Hashimoto, Eric Eaton

机构 * University of Pennsylvania(宾夕法尼亚大学) The Hong Kong Polytechnic University (PolyU)(香港理工大学)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 该研究针对数据稀缺的专业视觉领域,评估两类生成式稀疏数据扩展方法的分类性能,发现其无法持续优于非生成式基线,且存在记忆坍缩等失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11643 2026-08-13 cs.CV cs.LG 新提交 70%

Robustness of AI-Art Detectors under Generator Shift

生成器偏移下AI生成艺术检测器的鲁棒性

Shivank Singh Thakur, Meien Li, Mark Stamp

机构 * San Jose State University(圣何塞州立大学)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 该研究针对生成器偏移问题,在SD3.5m数据集上评估了五个AI艺术检测器的鲁棒性,发现模型在跨生成器场景下泛化能力不足,CLIP ViT-L/14表现最优,为分层防御检测器的开发提供了依据。

Comments To appear as a chapter in the book "Artificial Intelligence for Cyber Defense in Emerging Threats", to be published by Springer by early 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10985 2026-08-12 cs.CV 新提交 70%

PEAK: Precise and Persistent Concept Erasure via k-Sparse Autoencoders

PEAK:基于k稀疏自编码器(kSAEs)的精确且持久的概念擦除

Man Jiang, Ouxiang Li, Weibao Xue, Zhenhua Tang, Yuan Wang, Shuo Wang, Yanbin Hao

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本研究针对文本到图像扩散模型的概念擦除难题,提出基于k稀疏自编码器的PEAK框架,实现了精确持久的概念擦除,在I2P基准上大幅降低了冒犯性内容检测量与攻击成功率,同时保留了生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09373 2026-08-11 cs.CV 新提交 70%

Preserve More Details: Mitigating Content Drift in Real-World Image Super-Resolution

保留更多细节:缓解真实世界图像超分辨率中的内容漂移

Chunxiao Liu, Wei Liu, Anbin Xiong, Erli Meng

机构 * Xiaomi Corporation(小米公司)

专题命中 扩散模型 :diffusion(abstract,abstract_cn);分类 cs.CV

AI总结 针对真实世界图像超分辨率中因低质量输入导致的内容漂移问题,提出双路径架构的新型单步扩散模型FSP-Diff,在标准基准上优于现有单步扩散方法。

Comments Accepted to ACM MM 2026. This is the author's accepted version. The definitive version is published in the Proceedings of ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03135 2026-08-05 cs.CV cs.AI 新提交 70%

Rectify Then Diffuse: Disentangling Concepts Before Denoising Trajectory Unfolds

先校正再扩散:去噪轨迹展开前解耦概念

Ning Zhu, An Chen, Mengfei Zhao, Juntao Xu, Jingze Liang, Boyuan Gu, Liang-Jian Deng

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 针对文本到图像扩散模型多概念生成时的遗漏或合并错误,提出无训练框架RTD,通过SOD和IGR校正初始概念分配,在AE-Bench上实现组合保真度与效率的显著提升

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29180 2026-08-03 cs.CV cs.AI 新提交 70%

MoRAE: Flow-Friendly Self-Supervised Latents for Text-to-Motion Generation

MoRAE:面向文本到动作生成的流友好型自监督隐变量

Yifei Zhu, Mingyi Shi, Yangyang Cai, Miao Cheng, Yoshifumi Kitamura, Taku Komura

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 MoRAE针对文本到动作生成中直接采用图像生成RAE范式的失败,解决了动作空间的两个特有瓶颈,使Flow-Matching DiT实现了最先进的文本到动作生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26108 2026-07-30 cs.GR cs.LG 新提交 70%

Two2Four: Generative Quadruped Puppeteering from Human Motion

Two2Four:基于人类动作的生成式四足动物操控

Fatemeh Zargarbashi, Zehong Qiu, Dhruv Agrawal, Stelian Coros, Robert W. Sumner, Martin Guay, Jakob Buhmann

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.GR

AI总结 该研究提出Two2Four框架,采用两阶段生成扩散模型,可从人类动作生成可控逼真四足动物动作,用于动画和虚拟制作,效果优于现有重定向方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25894 2026-07-29 cs.CV 新提交 70%

TIGA: Trajectory-Injected Generative Attack against Black-box AIGC Detectors

TIGA:针对黑盒AIGC检测器的轨迹注入生成攻击

Xia Du, Zhuosen Bao, Zheng Lin, Jizhe Zhou, Jiawei Lian, Chi-man Pun, Jun Luo, Wei Ni, Symeon Chatzinotas

机构 * School of Computer and Information Engineering, Xiamen University of Technology(厦门理工学院计算机与信息工程学院) Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(卢森堡大学安全、可靠性和信任跨学科中心) School of Computer Science, Engineering Research Center of Machine Learning and Industry Intelligence, Sichuan University(四川大学计算机学院机器学习与工业智能工程研究中心) PCA Laboratory, Key Laboratory of Intelligent Perception and Systems for High-Dimensional Information of Ministry of Education, School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院高维信息智能感知与系统教育部重点实验室PCA实验室) Department of Computer and Information Science, Faculty of Science and Technology, University of Macau(澳门大学科技学院计算机与信息科学系) School of Engineering, Edith Cowan University(伊迪斯科文大学工程学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 扩散模型 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 针对黑盒AIGC检测器,TIGA提出无需源图像和训练的框架,通过操纵DDIM轨迹、聚合梯度及方向搜索估计目标响应,实现强大黑盒攻击性能、可转移性及高鲁棒性,且无需源图像或扩散模型再训练。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏