Toward Richer Material Generation via Procedural Data Enhancement
通过程序化数据增强实现更丰富的材质生成
专题命中 扩散模型 :diffusion(abstract);分类 cs.GR
AI总结 提出一种程序化数据增强方法,将简单PBR材质的单瓣GGX镜面反射扩展为多层模型,以捕获更丰富的非漫反射效果,并通过神经材质编码和扩散模型生成实现更丰富的材质生成。
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
通过程序化数据增强实现更丰富的材质生成
专题命中 扩散模型 :diffusion(abstract);分类 cs.GR
AI总结 提出一种程序化数据增强方法,将简单PBR材质的单瓣GGX镜面反射扩展为多层模型,以捕获更丰富的非漫反射效果,并通过神经材质编码和扩散模型生成实现更丰富的材质生成。
ReGenHuman: 重新生成人体外观以实现逼真的全身视频匿名化
机构 * Stanford University(斯坦福大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 提出ReGenHuman,首个同时实现逼真、时间一致且天生匿名的全身视频匿名化流水线,采用“重新生成而非编辑”范式,利用结构条件微调视频扩散模型合成人体区域。
基于潜在空间运动建模的二维电影心脏磁共振时序一致且可控视频生成
机构 * Suzhou Institute of Biomedical Engineering and Technology, Chinese Academy of Sciences(苏州生物医学工程与技术研究所,中国科学院) ; SyCoIA, IMT Mines Ales(SyCoIA,IMT Mines Ales)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 提出一种文本到视频生成方法,通过解耦心脏空间结构与时间运动,利用微调扩散模型合成初始帧,再以心脏相位嵌入条件化潜在流模型生成完整运动,实现高时序一致性和解剖可控性。
Journal ref ISBI 2026 - IEEE International Symposium on Biomedical Imaging, Apr 2026, London, United Kingdom. pp.1-4
Ultra Flash: 将实时流式视频生成扩展到高分辨率
机构 * JD Explore Academy(京东探索研究院) ; USTC(中国科学技术大学) ; PKU(北京大学) ; THU(清华大学) ; BUAA(北京航空航天大学) ; FDU(复旦大学) ; HKUST(香港科技大学) ; HKU(香港大学) ; CUHK(香港中文大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 提出Ultra Flash级联框架,通过架构保持的超分辨率训练、因果流式潜在上采样器和高分辨率解码器、以及级联优化方案,在单GPU上实现1K分辨率约30 FPS和2K分辨率约18 FPS的实时高分辨率流式视频生成。
KGEdit: 面向无训练精确视频生成与编辑的歧义感知知识图谱
机构 * Waseda University, Japan(日本早稻田大学) ; College of Computer Engineering, Jimei University(集美大学计算机工程学院) ; Department of Language Science and Technology, The Hong Kong Polytechnic University(香港理工大学语言科学与技术系) ; College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 提出KGEdit框架,通过构建歧义感知知识图谱和结构化语义注入模块,解决文本到视频扩散模型中的语义歧义、概念绑定错误和跨帧不一致问题,实现无需额外训练的精确视频生成与编辑。
基于结构能量的视图一致文本到3D生成
机构 * Australian National University(澳大利亚国立大学) ; CSIRO(澳大利亚国家科学委员会) ; The University of Hong Kong(香港大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 本文针对基于扩散模型的文本到3D生成中视图不一致问题,提出无需训练的SEGS框架,通过在U-Net特征的PCA子空间中构建结构能量并注入去噪过程,提升多视图一致性,实验表明有效降低Janus率并提升视图一致性评分。
Comments arXiv admin note: substantial text overlap with arXiv:2508.16917
PhyloSDF: 基于系统发育条件的残差流匹配神经生成3D颅骨形态
机构 * Department of Mathematics(数学系)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 提出PhyloSDF模型,结合系统发育一致性损失和残差条件流匹配,从少量样本生成符合系统发育关系的3D颅骨形态,在达尔文雀数据集上优于扩散模型和标准流匹配。
Akasha 2: 哈密顿状态空间对偶与视觉-语言联合嵌入预测架构
机构 * Independent AI Researcher(独立AI研究员) ; Québec (QC), Canada(魁北克(QC),加拿大)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 提出 Akasha 2 多模态架构,结合哈密顿状态空间对偶与视觉-语言联合嵌入预测,通过稀疏混合哈密顿专家和哈密顿流匹配实现超低延迟视频预测与合成,在保持能量守恒下取得 SOTA 性能。
Comments No supporting claims were validated in this automated agentic R&D research run
双分支提示用于多模态机器翻译
机构 * School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院) ; School of Computer and Software Engineering, Xihua University(西华大学计算机与软件工程学院) ; School of Intelligent Medicine, Chengdu University of Traditional Chinese Medicine(成都中医药大学针灸推拿学院)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 提出基于扩散模型的双分支提示框架D2P-MMT,利用重建图像过滤视觉噪声,通过分布对齐损失提升鲁棒翻译性能。
Comments This manuscript has been fully accepted and published by ACM Transactions on Multimedia Computing, Communications, and Applications (ACM TOMM)
面向早期野火检测的穿透植被地表温度重建
机构 * Department of Computer Science, Johannes Kepler University(计算机科学系,约翰尼斯·开普勒大学) ; Fire Brigade St. Agatha(圣阿加塔消防队) ; Upper Austria Fire Brigade Headquarter(上奥地利消防队总部)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 结合信号处理与机器学习,通过合成孔径传感和视觉状态空间模型从模糊数据中恢复热信号,实现无人机自动野火监测,在模拟和实地实验中显著降低温度重建误差。
使用潜在变量的高效流匹配
机构 * Argonne National Laboratory(阿贡国家实验室) ; KTH Royal Institute of Technology(皇家理工学院)
专题命中 扩散模型 :image generation(abstract);分类 cs.CV
AI总结 提出Latent-CFM方法,利用预训练深度潜在变量模型提取数据特征作为条件,提升流匹配模型的训练效率和生成质量,在图像和物理场生成任务中优于现有方法。
Hölder空间上的深度Q学习
机构 * Peking University(北京大学)
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究连续时间随机控制中Q学习的算子核心,通过分析扩散设置下Bellman最优性目标的正则性和逼近复杂度,提出适应混合正则性的张量积DeepONet架构,并给出显式逼近和资源界限。
原子薄层CrCl3中局域配体场激子的激活迁移
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究CrCl3中配体场激子的迁移机制,发现其有效面外扩散率为4.5×10⁻⁶ cm²/s,激活能130 meV,且与晶格弛豫耦合。
植物物联网中的声学、VOC和多模态胁迫源定位
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出一种两阶段粗到细定位流程,结合声学到达时间差多边定位和VOC弥散格林函数模型,实现植物网络中胁迫源的空间定位。
将生成式强化学习引导至稳定机器人控制器
机构 * ShanghaiTech University(上海科技大学)
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出SteerGenPO框架,通过潜在空间强化学习将训练好的生成式策略转化为鲁棒的确定性机器人控制器,在Isaac Lab和Unitree G1任务上优于基线方法,实现更稳定的推理行为。
一维线性格子玻尔兹曼方法的全量子算法
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出一维线性对流扩散方程的格子玻尔兹曼方法全量子算法,仅需算法结束时一次测量,相比混合量子经典算法减少了测量次数,并在量子模拟器和133量子比特系统上验证。
Journal ref In: Barbaresco, F., Gerin, F. (eds) Quantum Engineering Sciences and Technologies for Industry and Services. QUEST-IS 2025. Communications in Computer and Information Science, vol 2744. Springer, Cham
具有快速增长空间依赖吸收的退化抛物方程的自相似收敛性
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究吸收-扩散方程在m>1且σ>σ0时非负解的大时间行为,证明所有解在自相似变量下收敛到唯一稳态解,并给出通用上界。
非线性动力学Fokker-Planck方程作为自由能的梯度流
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究非齐次动力学方程,通过自由能泛函的梯度流解释,并推广JKO格式到非线性动力学方程族。
拓扑谱隙、多尺度Weyl律及高对比PDE中的均匀化
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出统一抽象变分与拓扑框架,刻画高对比多尺度PDE的谱隙与特征值分布,证明谱隙位置由高对比夹杂局部零空间维数决定,并建立多尺度Weyl律。
Comments 27 pages
受限氧空位迁移驱动铁电开关
专题命中 扩散模型 :diffusion(abstract)
AI总结 本研究通过第一性原理计算发现,Bi2SeO5中的氧空位在SeO3单元内受限迁移,产生可开关的极化,解释了其反常铁电性。
Comments 5 pages, 4 figures
高灵敏度氢气渗透:系统开发、样品制备及测试变量的影响
专题命中 扩散模型 :diffusion(abstract)
AI总结 开发高灵敏度氢气渗透系统,研究表面状态、压力、温度等变量对氢渗透的影响,揭示表面氧化物在室温下主导控制氢渗透,优化条件下氢传输遵循体扩散控制行为。
基于表面的多模态框架用于阿尔茨海默病的多任务分析
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出一种增强的球形数据驱动多模态框架,通过球形扩散模型生成配对皮层厚度和Tau PET SUVR数据,结合对比学习和上下文学习,实现多任务分类与回归,在ADNI数据集上优于六种基线模型。
Comments 11 pages, 3 figures
HAPI-EP:迈向混合、自适应和预测性的心脏电生理数字孪生
机构 * Rochester Institute of Technology(罗切斯特理工学院)
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出HAPI框架,通过物理集成灰盒模型、元学习快速自适应和条件生成模型,构建可识别、强预测性的心脏电生理数字孪生。
生物入侵自由边界模型的三分动力学
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究一类新型自由边界反应扩散方程,其中入侵前沿可进退,完全分类了单稳、双稳和燃烧型非线性下的长期动力学,揭示了三种情景:成功扩散、有限时间消失和过渡态。
时间依赖偏微分方程的液体随机特征方法
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出液体随机特征方法(L-RFM),通过将静态时间激活替换为闭式液体时间常数响应,引入采样松弛尺度,在保持线性最小二乘求解器简单性的同时,提高对刚性、色散或多尺度时间依赖PDE的有限特征逼近精度。
Ricci-Filtration:通过离散Ricci流提升检索增强生成重排序器在查询-答案任务中的性能
机构 * Tian Qin(田琴) ; Wei-Min Huang(黄伟民)
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出基于离散曲率和Ricci流的几何重排序增强方法Ricci-Filtration,通过建模查询与检索块为网络并利用曲率过滤噪声块,显著提升RAG生成性能。
PHINN: 基于持久同构的稀有事件时间序列生成神经网络
机构 * Defense.Codes (a DBA of CapaCloud Corp)(Defense.Codes(CapaCloud Corp 的商用名))
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出PHINN框架,利用动态Betti曲线作为条件信号和持久景观损失保持同调一致性,在金融、流行病和多模态基准上拓扑保真度优于统计和扩散基线。
Comments 15 pages, 4 figures
正定矩阵的反向望远镜坐标系:几何、计算与生成建模
机构 * Purdue University(普渡大学)
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出一种新的无约束坐标系,通过反向望远镜映射表示对称正定矩阵,实现雅可比仅依赖对数行列式、矩阵与逆矩阵的符号表示,并设计分裂体积-形状流模型用于生成建模。
Parisi PDE 的凹性定理
专题命中 扩散模型 :diffusion(abstract)
AI总结 证明将扩散剖面映射到时间-空间(0,0)处时间变换Parisi PDE解的泛函是凹的,强化了射线凹性结果,并应用于平衡多物种Ising自旋玻璃,使上下界匹配。
Comments 29 pages
连接子介导的胶体聚集中的动力学临界性
专题命中 扩散模型 :diffusion(abstract)
AI总结 通过理论与DNA连接金纳米颗粒实验,揭示连接子介导的聚集因团簇反应性演化而偏离经典Smoluchowski动力学,发现由连接子丰度控制的动力学临界点,并验证了停滞、加速生长和标度塌缩。
Comments 5 pages, 3 figures