arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-14 至 2026-08-14 共收录 96 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 72 篇

2607.28166 2026-08-14 cs.CL cs.AI 版本更新 78%

Commit Locally, Exit Globally: Coordinating Adaptive Sampling and Early Exit in Diffusion Language Models

提交时机与位置:扩散语言模型的候选感知解码

Chia-Ming Lee, Shao-Kai Liu, Ming-Ching Chang, Xin Li, Yu-Lun Liu, Chih-Chung Hsu

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) University at Albany, SUNY(纽约州立大学奥尔巴尼分校)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对扩散语言模型解码过早终止问题,提出无训练的候选感知提前退出框架LATCH,结合CVC与BWEC,在零样本11项任务上,以准确率损失极小的代价实现多倍解码速度提升。

Comments Code is available at https://github.com/ming053l/C4-dLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02143 2026-08-14 physics.flu-dyn 版本更新 78%

Turbulence generation and data assimilation in wall-bounded flows with a latent diffusion model

基于潜扩散模型的壁面湍流生成与数据同化

Fabian Steinbrenner, Baris Turan, Hao Teng, Heng Xiao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出一种结合β-VAE与基于Transformer的扩散模型的生成框架,用于壁面湍流的数据同化,在雷诺数Re_h=1300的平面库埃特流中实现了O(10^5)的压缩比,并揭示了条件扩散模型在保持物理保真度与样本多样性之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10006 2026-08-14 math.AP nlin.PS 版本更新 78%

Geometry-induced pulse dynamics in a bulk-surface reaction-diffusion system for cell polarization

几何诱导的脉冲动力学在细胞极化的大体积-表面反应扩散系统中

Riku Watanabe

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了二维域中细胞极化的大体积-表面反应扩散系统,通过波固定机制形成局部模式,结合细胞形状效应,利用奇异性扰动方法推导了描述波固定动力学的常微分方程,并分析了由域几何引起的现象,如非平凡脉冲位置和超临界及亚临界分岔。

Comments 35 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05197 2026-08-14 cs.CL 版本更新 78%

Masked diffusion LLMs can use EoS tokens for hidden reasoning

扩散语言模型可以按EoS进行思考

Sarah Breckner, Sebastian Schuster

机构 * Faculty of Computer Science, University of Vienna(维也纳大学计算机科学系) UniVie Doctoral School Computer Science, University of Vienna(维也纳大学计算机科学博士学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究发现扩散语言模型通过EoS标记进行推理,通过实验验证EoS标记作为隐藏计算空间的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12455 2026-08-14 physics.flu-dyn 78%

Generative Reconstruction of Spatiotemporal Wall-Pressure in Turbulent Boundary Layers via Patchwise Latent Diffusion

Xiantao Fan, Meet Hemant Parikh, Yi Liu, Xin-Yang Liu, Junyi Guo, Meng Wang, Jian-Xun Wang

专题命中 扩散模型 :diffusion(title,abstract)

Comments 57 pages, 38 figures

Journal ref Phys. Rev. Fluids 11, 084607, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21805 2026-08-14 cs.IR cs.AI cs.LG 版本更新 78%

DiffGRM: Diffusion-based Generative Recommendation Model

DiffGRM:基于扩散的生成式推荐模型

Zhao Liu, Yichen Zhu, Yiqing Yang, Xiao Lv, Guoping Tang, Rui Huang, Qiang Luo, Ruiming Tang, Kun Gai, Guorui Zhou

机构 * Kuaishou Technology(快手科技)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对生成式推荐中SID的结构问题,提出DiffGRM模型,通过MDM、PSE、OCN、CPD等技术优化,在多数据集上使NDCG@10提升6.9%-15.5%。

Comments 12 pages, 6 figures. Accepted at The ACM Web Conference 2026. Camera-ready version; author list updated to match the published version; presentation revised, results unchanged

Journal ref Proceedings of the ACM Web Conference 2026 (WWW '26), pp. 5853-5864, ACM, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09151 2026-08-14 cs.LG math.ST stat.ML stat.TH 版本更新 78%

Regularization can make diffusion models more efficient

正则化可提升扩散模型的效率

Mahsa Taheri, Johannes Lederer

机构 * University of Hamburg(汉堡大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对扩散模型计算成本高的问题,提出利用统计学中的稀疏性概念,通过数学证明和实验验证表明,引入稀疏性可降低计算复杂度并提升样本质量,从而实现更高效的扩散模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11692 2026-08-14 math.AP 版本更新 78%

Asymptotic large time behavior of singular entire solutions of the fast diffusion equation

快扩散方程奇异整体解的渐近大时间行为

Kin Ming Hui, Jongmyeong Kim

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对快扩散方程,采用不动点方法证明了一类满足特定条件的奇异径向对称前向自相似解的存在性,得到解在原点附近的渐近展开,并分析了满足对应初值条件的奇异解的渐近大时间行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21783 2026-08-14 cs.CV 版本更新 77%

SHARP: Spectrum-aware Highly-dynamic Adaptation for Resolution Promotion in Remote Sensing Synthesis

SHARP: 为遥感合成促进分辨率提升的频谱感知高动态适应

Bingxuan Zhao, Qing Zhou, Chuang Yang, Junyu Gao, Qi Wang

机构 * School of Computer Science, Northwestern Polytechnical University, Xi'an, China(计算机科学学院,西北工业大学,西安,中国) School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University, Xi'an, China(人工智能学院,光学与电子学(iOPEN),西北工业大学,西安,中国)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出SHARP方法,通过频谱感知的高动态适应策略,在无需训练的情况下提升遥感图像分辨率,优于现有无训练基线,在CLIP分数、审美分数和HPSv2上表现更优。

Comments Accepted by the 34th ACM International Conference on Multimedia (ACM MM 2026)

Journal ref Proceedings of the 34th ACM International Conference on Multimedia (ACM MM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13205 2026-08-14 cs.CV 新提交 74%

HPSD: Hybrid-Policy Self-Distillation for Text-Image-to-Video Diffusion Models

HPSD:用于文本-图像转视频扩散模型的混合策略自蒸馏

Jiazi Bu, Pengyang Ling, Yujie Zhou, Yibin Wang, Yuhang Zang, Xuanlang Dai, Shengyuan Ding, Tianyi Wei, Xiaohang Zhan, Jiaqi Wang, Tong Wu, Dahua Lin, Xingang Pan

机构 * Shanghai Jiao Tong University(上海交通大学) S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab实验室) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Adobe Research(奥多比研究院) The Chinese University of Hong Kong(香港中文大学) CPII under InnoHK(InnoHK下属CPII机构)

专题命中 扩散模型 :diffusion(title);分类 cs.CV

AI总结 本研究提出HPSD混合策略自蒸馏框架,通过让同一TI2V模型在不同条件下分别充当教师与学生,解决现有自蒸馏方法的缺陷,显著提升T2V及TI2V生成性能,强化模型基础生成能力。

Comments Project Website: https://bujiazi.github.io/hpsd.github.io/ Code: https://github.com/Bujiazi/HPSD

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12344 2026-08-14 cs.CL cs.CY stat.AP 新提交 71%

Predicting consumer-technology ownership without a diffusion history

基于扩散历史预测消费技术拥有情况

Irina Vartanova, Niels Selling, Jennifer Viberg Johansson, Pontus Strimling

专题命中 扩散模型 :diffusion(title)

AI总结 该研究利用人类及Anthropic Claude Opus 4.7、OpenAI GPT-5.5两款语言模型对消费技术的属性评分,通过符号约束惩罚回归预测技术拥有率,其效果优于上市年限基准模型,还对2025-2026年新品做了2027年拥有率预测。

Comments 31 pages, 4 figures, supplementary material included (Tables S1-S6, Figure S1), data and code at https://osf.io/dr5ct

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02711 2026-08-14 cs.CV 版本更新 70%

Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing

Hunyuan3D-Buffalo 1.0:用于可扩展3D生成、理解与编辑的统一多模态模型

Junliang Ye, Kenkun Liu, Guocun Wang, Yang Li, Yansong Qu, Chunshi Wang, Jingwei Xu, Yunhan Yang, Zibo Zhao, Jiachen Xu, Jiaao Yu, Lifu Wang, Zhihao Liang, Xin Huang, Zhuo Chen, Chunchao Guo

机构 * Tencent Hunyuan(腾讯混元)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 Hunyuan3D-Buffalo 1.0是支持3D理解、文本到3D生成等功能的统一多模态模型,构建87M规模语料库训练,在相关基准上达SOTA或领先性能,验证了统一训练的有效性。

Comments Project Page: https://tencent-hunyuan.github.io/Hunyuan3D-Buffalo1.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12416 2026-08-14 cs.RO 新提交 67%

RoboSynChallenge: Mastering Real-World Dexterity via Generalizing Synthesized Manipulation Skills

RoboSynChallenge:通过泛化合成操作技能掌握真实世界灵巧操作

Runyi Zhao, Ruixin Wu, Chengkun Li, Hongrui Zhang, Ang Li, Ruixing Jin, Yueci Deng, Yingying Guo, Lihe Ding, Shaocong Dong, Tianfan Xue, Yanjun Gao, Yudong Luo, Pascal Poupart, Simo Wu, Kui Jia, Wei-shi Zheng, Guiliang Liu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) DexForce(德克斯力公司) The Chinese University of Hong Kong(香港中文大学) The Hong Kong University of Science and Technology(香港科技大学) University of Colorado Anschutz(科罗拉多大学安舒茨医学中心) Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) Vector Institute(向量研究所) University of Waterloo(滑铁卢大学) Fudan University(复旦大学) Sun Yat-sen University(中山大学) Shenzhen Loop Area Institute (SLAI)(深圳环区研究所)

专题命中 扩散模型 :diffusion(abstract,abstract_cn)

AI总结 RoboSynChallenge竞赛推出统一基准,结合合成数据与真实评估,提供多类基准策略,旨在推动开发泛化性强、数据高效的机器人操作系统,助力通用机器人智能发展。

Comments NeurIPS 2026 Competition Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14614 2026-08-14 q-fin.MF 版本更新 67%

Pricing options on the cryptocurrency futures contracts

加密货币期货合约上的期权定价

Julia Kończal

专题命中 扩散模型 :diffusion(abstract,abstract_cn)

AI总结 本研究针对加密货币期权市场特性,校准评估多种期权定价模型,发现Kou模型对BTC期权、Bates模型对ETH期权定价误差最低,凸显纳入跳跃与随机波动率的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13460 2026-08-14 cs.CV 新提交 57%

SNM-VFI: Symmetric Nonlinear Motion-Guided Generative Video Frame Interpolation

SNM-VFI:对称非线性运动引导的生成式视频帧插值

Jisoo Jeong, Hong Cai, Jamie Menjay Lin, Hanno Ackermann, Hyeonjun Sim, Yinhao Zhu, Yunxiao Shi, Fatih Porikli

机构 * Qualcomm(高通公司)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出无需训练的SNM-VFI框架,结合预训练光流与视频扩散模型,用对称非线性运动模型引导生成过程,经多基准评估实现了优质视频帧插值效果。

Comments ECCVW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13028 2026-08-14 cs.CV cs.RO 新提交 57%

RGB-D Video Generation for Improving Human-to-Robot Object Handover Prediction

用于改进人机物体交接预测的RGB-D视频生成

Tianyu Sun, Zhoujie Fu, Zihui Gao, Bang Zhang, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) College of Computing and Data Science(计算与数据科学学院) Zhejiang University(浙江大学) College of Computer Science and Technology(计算机科学与技术学院) Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对人机物体交接数据集稀缺及现实-模拟差距问题,提出Hand2Bot数据集与PassGen生成流水线,实现高意图识别准确率与低误触发率,支持机器人稳健零样本迁移与早期意图预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12997 2026-08-14 cs.CV 新提交 57%

PixSDS: Why Latent SDS Makes Noisy Pixels

PixSDS:潜在SDS为何会产生带噪像素

Vsevolod Skorokhodov

机构 * EPFL(洛桑联邦理工学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对潜在SDS生成3D时的像素漂移问题,提出轻量级VAE一致性梯度修复方法PixSDS,减少结构化伪影并保留语义内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12780 2026-08-14 cs.CV 新提交 57%

SCOPE: Subspace Clustering with Online Per-Head Top-K Estimation for Sparse Video Attention

SCOPE:用于稀疏视频注意力的在线分头Top-K估计的子空间聚类

Qi Zhao, Qirui Li, Hanlin Tang, Yiduo Li, Zhen Guo, Cuifeng Shen, Chao Xu, Zhaosheng Chi, Xiaojin Lu, Kan Liu, Tao Lan, Lin Qu, Xi Li

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 SCOPE是一种无训练稀疏注意力框架,通过子空间聚类与在线分头Top-k估计解决视频DiTs的高成本问题,在6种配置中优于基线,实现1.99倍加速且保持28.46 dB PSNR。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11745 2026-08-14 cs.CV 版本更新 57%

LiveAnimate: Stable Long-Form Streaming Human Animation in Real-Time

LiveAnimate:稳定的长时长流驱动人体动画实时生成系统

Yuxuan Zhang, Haozhong Xiong, Yubo Huang, Jiayi Song, Jinpeng Yu, Haofan Wang, Jiaming Liu, Ruihua Huang, Liwei Wang

机构 * The Chinese University of Hong Kong(香港中文大学) Qwen Applications Business Group of Alibaba(阿里巴巴通义千问应用业务组) Liblib AI

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 LiveAnimate基于14B参数视频DiT,经两阶段训练结合PR-Sink等设计,实现19.63 FPS长时长流人体动画生成,兼顾实时性、质量与稳定性,优于现有系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30045 2026-08-14 cs.CV 版本更新 57%

DualEraser: Joint Video Object and Effect Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver

GenEraser:通过平衡文本-掩码引导和解耦定位器-保持器实现可泛化的视频对象移除

Yuqing Chen, Lin Liu, Haisu Wu, Xiaopeng Zhang, Yaowei Wang, Yujiu Yang, Qi Tian

机构 * Tsinghua University(清华大学) Pengcheng National Laboratory(鹏城实验室) Huawei(华为) Southeast University(东南大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出GenEraser框架,通过多条件混合专家、可学习深度CFG融合机制和解耦专家架构,解决视频对象移除中目标与物理效应同时消除的泛化难题,在ROSE和VOR-Eval上分别提升2.16 dB和1.44 dB。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01296 2026-08-14 cs.CV 版本更新 57%

SIFT-VTON: Geometric Correspondence Supervision on Cross-Attention for Virtual Try-On

SIFT-VTON:跨注意力中的几何对应监督用于虚拟试穿

Kosuke Takemoto, Takafumi Koshinaka

机构 * The Graduate School of Data Science, Yokohama City University, Kanagawa, Japan(数据科学研究生院, Yokohama 市立大学,神奈川县,日本)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出SIFT-VTON方法,利用SIFT关键点匹配提供显式几何指导,提升扩散模型在虚拟试穿中的细节保留能力。

Comments Accepted at ICPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17897 2026-08-14 cs.CV cs.AI cs.LG cs.RO 版本更新 57%

RadarGen: Automotive Radar Point Cloud Generation from Cameras

RadarGen:从摄像头生成汽车雷达点云

Tomer Borreda, Fangqiang Ding, Sanja Fidler, Shengyu Huang, Or Litany

机构 * Technion(技术学院) MIT(麻省理工学院) NVIDIA(英伟达) University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 RadarGen通过扩散模型从摄像头图像生成逼真的雷达点云,结合BEV对齐的深度、语义和运动线索,提升雷达生成的物理合理性与多模态模拟能力。

Comments ECCV 2026. Project page: https://radargen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05967 2026-08-14 cs.CV cs.AI 57%

Adapted Foundation Models for Breast MRI Triaging in Contrast-Enhanced and Non-Contrast Enhanced Protocols

Tri-Thien Nguyen, Lorenz A. Kapsner, Tobias Hepp, Shirin Heidarikahkesh, Hannes Schreiter, Luise Brock, Dominika Skwierawska, Dominique Hadler, Julian Hossbach, Evelyn Wenkel, Sabine Ohlmeyer, Frederik B. Laun, Andrzej Liebert, Andreas Maier, Michael Uder, Sebastian Bickelhaupt

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

Comments 23 pages, 6 figures, 4 tables. Originally submitted to Radiology (RAD-25-2541); under consideration for transfer to Radiology: Artificial Intelligence (RSNA Portfolio Journal)

Journal ref European Radiology (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13418 2026-08-14 stat.ML cs.LG 新提交 50%

Wasserstein Filtering: A Sample Selection Method for Robust Distribution Learning

Wasserstein滤波:一种用于鲁棒分布学习的样本选择方法

Yikai Xu, Zhao Chen, Jian Huang

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对存在部分样本被污染的数据集,提出Wasserstein滤波样本选择框架,引入三种算法,在FELP污染模型下证明其估计量的极小极大最优性,经实验验证其为实用的模型无关预处理工具,兼具良好异常检测性能与生成建模下游效益。

Comments 48 pages, 3 figures, and 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12398 2026-08-14 q-bio.NC cs.AI 新提交 50%

A Hierarchical Energy-Based Model for Multimodal Cognition

面向多模态认知的分层能量基模型

Subir Varma

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究提出IM-LEPP多模态能量基模型,扩展单模态LEPP整合视觉与语言,能解释注意现象、复现心理语言学发现,还与Transformer模型形成可证伪对比并提出实验预测。

Comments 48 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13096 2026-08-14 cs.LG cs.CE q-fin.CP q-fin.TR 新提交 50%

FlowLOB: Efficient and Controllable Limit Order Book Generation with Flow Matching

FlowLOB:基于流匹配的高效可控限价订单簿生成模型

Zhuohan Wang, Andreea Bacalum, Ollie Olby, Carmine Ventre, Namid Stillman

机构 * Simudyne(思慕迪恩) King’s College London(伦敦国王学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出FlowLOB,一种基于流匹配的LOB轨迹生成模型,经HKEX数据训练可泛化至未见过的交易品种,采样效率与可控性优于基准模型,且能零样本泛化。

Comments 8 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12932 2026-08-14 cs.AI 新提交 50%

FlashDrive: Flash Vision-Language-Action Inference for Autonomous Driving

FlashDrive:面向自动驾驶的Flash视觉-语言-动作推理

Zekai Li, Yihao Liang, Hongfei Zhang, Jian Chen, Yesheng Liang, Zhijian Liu

机构 * Princeton(普林斯顿大学) UC San Diego(加州大学圣迭戈分校)

专题命中 扩散模型 :diffusion(abstract)

AI总结 FlashDrive通过算法-系统协同设计解决VLA推理的四个级联瓶颈,使Alpamayo 1.5-10B的端到端自动驾驶延迟降4.7倍,推理频率提升至6.6Hz,逼近实时部署。

Comments 15 pages; 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12768 2026-08-14 cs.CY 新提交 50%

A Generative Framework for the Creation of Multi-Attribute Geographically-Explicit Synthetic Population

用于创建多属性地理显式合成种群的生成框架

Jinlin Wu, Si Qiao, Yi Liu, Fuzhen Yin, Na Jiang

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出一种分层扩散生成框架,可从汇总数据重建多属性区域联合分布,生成含3.32亿个体的地理显式合成种群,效果优于IPF等基线方法,能提升地理模拟的真实性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12715 2026-08-14 cs.SD cs.AI 新提交 50%

HybridSB-MoE: Dual-Domain Schrödinger Bridges with Scene-Adaptive Expert Routing for Speech Enhancement

HybridSB-MoE:用于语音增强的双域薛定谔桥与场景自适应专家路由

Zhengyi Lu, Aswini Sivakumar, Jie Hu, Yao Qiang

机构 * Oakland University(奥克兰大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 HybridSB-MoE是一种双域语音增强框架,通过非对称不确定性融合、异构MoE路由及离散化界保证,在VoiceBank+DEMAND数据集上实现了优于扩散与SB基线的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12879 2026-08-14 cs.LG math.DS 新提交 50%

Robust data-driven discovery of fractional differential equations via weak formulations and Pareto-based subset selection

基于弱形式与帕累托子集选择的鲁棒数据驱动分数阶微分方程发现

Pongpisit Thanasutives, Yoshinobu Kawahara

机构 * Center for Advanced Intelligence Project (AIP), RIKEN(理化学研究所先进智能项目中心(AIP)) Graduate School of Information Science and Technology, The University of Osaka(大阪大学信息科学与技术研究生院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 Weak-Pareto方法结合弱形式与帕累托子集选择,可从含噪数据中鲁棒发现分数阶微分方程,在多基准测试中表现优于无正则化方法及同期神经基线。

Comments 47 pages

详情

展开后加载摘要…

URL PDF HTML 收藏