A Dynamic Likelihood Approach to Filtering for Advection-Diffusion Dynamics
平流-扩散动力学滤波的动态似然方法
专题命中 扩散模型 :diffusion(title,abstract)
AI总结 本文将专为双曲型问题开发的动态似然(DLF)方法扩展为处理平流-扩散问题的贝叶斯数据同化方案,实验表明其在平流主导且观测稀疏低不确定性场景下估计效果优于其他方法,计算开销可通过策略缓解。
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
平流-扩散动力学滤波的动态似然方法
专题命中 扩散模型 :diffusion(title,abstract)
AI总结 本文将专为双曲型问题开发的动态似然(DLF)方法扩展为处理平流-扩散问题的贝叶斯数据同化方案,实验表明其在平流主导且观测稀疏低不确定性场景下估计效果优于其他方法,计算开销可通过策略缓解。
手术视频生成:从扩散模型到世界模型:综述
专题命中 扩散模型 :diffusion(title);分类 cs.CV
AI总结 该综述梳理2024-2026年手术视频生成领域文献,分三类总结方法,指出生成任务从合成帧转向建模场景因果动态,分析瓶颈并提供实验参考,为相关交叉领域研究者提供参考。
Comments 4 pages, 1 figures, 3 tables. Accepted for oral presentation at the 2026 3rd International Conference on Intelligent Perception and Pattern Recognition (IPPR 2026)
基于扩散后验采样的阵列无关 Ambisonics 编码
专题命中 扩散模型 :diffusion(title)
AI总结 针对现有 Ambisonics 编码方案受固定阵列限制的问题,提出生成框架 ADEPS,将物理采集模型嵌入推理过程,可补偿阵列失真并实现任意阵列零样本编码,性能优于传统基线。
复杂场景下的多人人体运动预测
机构 * University of Bonn(波恩大学) ; Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究所)
专题命中 扩散模型 :diffusion(abstract,abstract_cn);分类 cs.CV
AI总结 针对复杂场景下多人运动预测中物体信息与社会交互整合的挑战,提出OCSD模型,在HiK和HOI-M3基准上实现最优路径误差降低,生成更逼真长期预测。
Comments Accepted to GCPR 2026
CounterVid: 通过生成反事实视频缓解视频-语言模型中动作和时间幻觉
机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) ; University of Pisa(帕尔马大学) ; Amazon Prime Video(亚马逊Prime视频)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.MM
AI总结 CounterVid通过生成反事实视频缓解视频-语言模型中动作和时间幻觉问题,提出反事实视频生成框架和MixDPO方法,提升时间推理和动作识别性能。
Comments EMNLP 2026
面向城市语义分割的低代价训练数据生成框架
机构 * Computer Vision and Learning Lab, IWR, Heidelberg University, Germany(海德堡大学计算机视觉与学习实验室) ; AIMMO, Republic of Korea(韩国AIMMO) ; Department of Computer Science, TU Darmstadt, Germany(图宾根大学计算机科学系) ; Zuse School ELIZA, Germany(德国Zuse学校ELIZA) ; Hessian Center for AI (hessian.AI), Germany(黑森人工智能中心)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.GR
AI总结 本文提出一种仅用不完美伪标签适配扩散模型的框架,可从低代价合成数据生成目标域对齐图像,经实验其分割性能较最优方法提升8.0个百分点,使快速构建的合成数据集达到高代价合成数据集的效果。
Comments Updated to match the published ICPR 2026 version; updated author order, affiliations, acknowledgements, and minor textual corrections
SpatialCrafter:基于生成式3D代理的单图像世界建模
机构 * Hong Kong University of Science and Technology(香港科技大学) ; Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) ; ManyCore Tech Inc.(ManyCore科技公司) ; Jilin University(吉林大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 SpatialCrafter是解决图像到场景生成问题的两阶段框架,通过3D代理及相关策略提升3D一致性,构建了115K场景的新数据集,性能优于现有方法且鲁棒性强。
Comments 12 pages
LiveVVT:高保真实时视频虚拟试穿
机构 * Tsinghua University(清华大学) ; Zhongguancun Academy(中关村学院) ; South China University of Technology(华南理工大学) ; Beijing Jiaotong University(北京交通大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 LiveVVT是一种滚动式流式扩散框架,通过保留双向建模与互补内存维持一致性,结合渐进式蒸馏优化,实现了比同等规模模型延迟降26倍、吞吐量提11倍的高保真实时视频虚拟试穿。
Comments 16 pages, 13 figures,
分层通道堆叠:一种用于AI生成图像检测的结构化决策框架
机构 * Missouri University of Science & Technology(密苏里科学技术大学) ; University of Houston(休斯顿大学) ; Cranium AI, Inc.(颅人工智能公司)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 本文提出分层通道堆叠(HCS)框架,将CNN中间激活转为结构化60维表示,在涵盖GAN和扩散生成器的基准测试中获86.7%准确率,可用于AI生成图像检测及相关证据整合机制研究。
Comments 12 pages, 4 figures. Accepted for publication at ICANN 2026
卷积神经网络图像空间中信息力学的统一框架
机构 * École de technologie supérieure(蒙特魁北克大学工程学院(École de technologie supérieure))
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 本文提出CNN图像空间信息力学的统一数学框架,建立离散滤波器对称性与相对论能量-动量关系的对应,经3D图像验证可在多尺度图像中生成尺度不变莫尔斯临界点。
保留还是丢弃?用于紧凑视频表示的自适应分词器
机构 * Kakao Corp.(Kakao公司)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 针对传统VAE固定压缩率无法适配视频时空内容复杂度的问题,提出基于Transformer的自适应令牌分词器KATok,结合两种位置预测策略缓解空间错位,在先进压缩率下实现出色的视频重构与生成质量。
视频世界模型的潜在空间记忆
机构 * Zhejiang University(浙江大学) ; Microsoft Research(微软研究院) ; Adelaide University(阿德莱德大学) ; Monash University(莫纳什大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 提出潜在空间记忆框架Mirage,通过在扩散潜在空间中直接构建和查询3D缓存,避免像素空间重建,实现高效视频生成,速度提升10.57倍,内存减少55倍。
Comments Project Page: this https URL (https://aka.ms/latent-spatial-memory), Code: this https URL (https://github.com/microsoft/LatentSpatialMemory)
EgoSurg:基于环境相机的手术室工作流程自我中心视角回放的任意视角合成
机构 * Johns Hopkins University(约翰霍普金斯大学) ; Johns Hopkins Medical Institutions(约翰霍普金斯医学机构)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 EgoSurg框架基于环境相机的立体视频重建手术室场景,渲染角色特定的自我中心视角,经评估可实现高质量重建,支持手术安全审查、培训等应用。
关于一类具有两个种群密度的反应扩散系统空间分离数值算法收敛性的研究
专题命中 扩散模型 :diffusion(abstract,comments)
AI总结 本文研究了具有两个种群密度的反应扩散系统空间分离的数值算法收敛性,证明了非负内部动态下的算法收敛性,并进行了计算测试。
Comments 16 pages, 8 figures, Keywords: Free boundary, Two-phase membrane problem, Reaction-diffusion systems, Finite difference
气候物理动态匹配
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究针对深度生成模型忽略物理结构、物理模型不完善的问题,提出ClimPhyDM框架,在ERA5基准上优于对比模型,可在单12GB消费级GPU训练,提升了天气预报的长时稳定性。
基于学习到的任务图的分散式多任务学习
机构 * Imperial College London(帝国理工学院)
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文针对任务关系未知的网络场景,提出从分布式数据学习任务图的分散式两阶段策略,实现合作式多任务扩散学习,性能优于非合作学习且逼近真实图基线。
用于可扩展强化学习的简单演员与深度评论家
机构 * Sungkyunkwan University(成均馆大学) ; Soongsil University(崇实大学)
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出LAC算法,将容量分配给深度评论家而非简单演员,解决离线RL中加深评论家的三种失效模式,在OGBench上实现与强基线相当性能且推理延迟最高降4倍。
Comments Accepted at CIKM 2026
信息引导的前沿解码:扩散多模态语言模型(dMLLMs)中上下文效用驱动的提交
机构 * Fuzhou University(福州大学) ; Jilin University(吉林大学) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 扩散模型 :diffusion(abstract)
AI总结 针对扩散多模态语言模型解码时结构令牌过早提交削弱上下文传播的问题,提出无需训练的信息引导前沿解码策略,通过多维度排序优化候选选择,在多类基准上实现了优于现有方法的性能。
Comments Accepted to Findings of EMNLP 2026
结合谱分解的微视频推荐偏好流匹配方法
专题命中 扩散模型 :diffusion(abstract)
AI总结 本研究针对微视频推荐中主流方法的语义动态纠缠与流匹配模型忽略时间结构的问题,提出PrismRec框架,通过谱语义分解和上下文校准偏好匹配,在四个数据集上较SOTA提升最高22.65%且效率更优。
基于排名依赖的进出机制的股票市场中的行波
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究通过带排名依赖进出机制的几何布朗运动粒子模型,结合CRSP数据校准,证明股票市场长期资本分布为行波,且换手率稳定市场,该行波可拟合经验分布并确定多元化投资组合的资本增长。
Comments 43 pages, 9 figures, 3 tables
专题命中 扩散模型 :diffusion(abstract)
Comments 22 pages
从一般更新-跳跃动力学推导亚扩散方程
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究开发通用更新-跳跃框架,经拉普拉斯变换推导得亚扩散方程,阐明微观性质、反常指数与初始分布对亚扩散的作用。
谱Barron空间中的热方程
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文基于谱Barron空间与椭圆型偏微分方程的关联,研究该框架下热方程的适定性、后向热方程的对数型稳定性估计,还扩展到时间分数阶热方程,刻画热核并推导相关性质,丰富了演化PDE理论。
非等温相场系统的广义耗散解:存在性、弱-强唯一性与长时间行为
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究针对耦合序参数与逆温度的非等温相场系统,通过完全离散逼近构造广义耗散弱解,证明其弱-强唯一性与平稳ω极限态存在性,为相关热力学系统分析提供理论基础。
Comments 33 pages
多体偶极-偶极相互作用对稠密气体中激发转移的影响
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究揭示稠密Rb蒸气中激发转移的密度依赖特性,发现高Rb密度下激发扩散特征时间的密度依赖从线性转为非线性,可通过替换特征扩散长度的定义定性描述。
自由表面边界层中浮粒的湍流扩散率与有效上升速度
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究针对海洋表面浮粒输运模型的偏差问题,通过实验测量浮粒扩散率与上升速度,验证了轨迹交叉理论,修正了湍流施密特数的取值,为浮粒输运模型提供了实验依据。
发动机相关条件下湍流稀薄预混氢-空气火焰中NOx生成的直接数值模拟
专题命中 扩散模型 :diffusion(abstract)
AI总结 本研究采用DNS,探究发动机相关条件下湍流稀薄预混氢-空气火焰的NOx生成,明确湍流强度等因素的竞争效应,提出预测NOx增强的概念模型,强调湍流-化学相互作用的关键作用。
将TG-43形式化方法适配用于扩散α粒子发射体放射治疗
专题命中 扩散模型 :diffusion(abstract)
AI总结 本研究将TG-43形式化方法适配Alpha DaRT模型,定义有效剂量率与活度转换因子,通过数值计算生成相关表格,使商用软件可用于Alpha DaRT治疗计划制定,但表格需按病例生成。
多尺度表面重力波的随机输运与波相互作用:第二部分——动理学理论及海洋波应用
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文基于随机变分框架,针对深水区域表面重力波发展动理学理论,揭示随机输运在宽谱范围常超过经典四波相互作用,为业务波模型纳入输运源项提供依据。
自组织原子晶体中戈德斯通模的随机输运
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文在光学环形腔中追踪自组织原子晶体的戈德斯通模随机输运,发现扩散常数随$1/N$减小,归一化后呈普适曲线,拓展了连续对称性破缺的研究范畴。