arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-26 至 2026-08-26 共收录 76 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 4 篇

2608.24563 2026-08-26 cs.CV cs.RO 新提交 83%

X-MULTI: VLM-based Imaging Factor Disentanglement for Factor-Aware Image Synthesis

X-MULTI:基于VLM的成像因子解耦用于因子感知图像合成

Sonali Godavarthy, Matthias Neuwirth-Trapp, Tim-Felix Faasch, Maarten Bieshaar, Michael Moeller, Kristof Van Laerhoven, Danda Pani Paudel

机构 * University of Siegen(锡根大学) ETH Zürich(苏黎世联邦理工学院) Bosch Research(博世研究中心) INSAIT(INSAIT(保加利亚的智能与数据科学研究所)) Sofia University “St. Kliment Ohridski”(索非亚大学“圣·克利门特·奥赫里德斯基”)

专题命中 文生图 :image synthesis(title);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 该研究针对文本到图像生成的成像因子解耦问题,提出基于VLM的X-MULTI方法及改进的I-FAA指标,提升了新颖因子组合的因子对齐效果与评估的稳健性。

Comments Accepted to the MUCG Workshop at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17027 2026-08-26 cs.CV cs.AI 版本更新 83%

Scientific Image Synthesis: Benchmarking, Methodologies, and Downstream Utility

科学图像合成:基准测试、方法论与下游应用

Honglin Lin, Zheng Liu, Chonghan Qin, Qizhi Pei, Yu Li, Zhanping Zhong, Xin Gao, Yanfeng Wang, Conghui He, Lijun Wu

机构 * Shanghai Jiao Tong University(上海交通大学) OpenDataLab, Shanghai Artificial Intelligence Laboratory(OpenDataLab,上海人工智能实验室) The University of Hong Kong(香港大学) Peking University(北京大学)

专题命中 文生图 :image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出ImgCoder框架和SciGenBench基准,通过逻辑驱动方法提升科学图像生成的结构精度,并展示微调LMMs在科学图像上的效果,验证了高保真合成在多模态推理中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24112 2026-08-26 cs.AI 新提交 78%

Scalable Question-Centric Text-to-Image Evaluation: Reliable Ranking, Fine-Grained Diagnosis, and Cost-Aware Routing

可扩展的以问题为中心的文本到图像评估:可靠排名、细粒度诊断与成本感知路由

Shaoan Zhao, Fang Zhao, Xueqiang Guo, Xinpei Su, Huanlin Gao, Qiang Hui, Ting Lu, Fuyuan Shi, Chao Tan, Bikun Yang, Kai Wang, Shiguo Lian

机构 * Data Science & Artificial Intelligence Research Institute, China Unicom(中国联通数据科学与人工智能研究院) Unicom Data Intelligence, China Unicom(中国联通数据智能) China Unicom Group Co.,Ltd(中国联通集团有限公司)

专题命中 文生图 :text-to-image(title,abstract)

AI总结 研究针对T2I模型评估的问题,提出QC-T2I-Bench框架,结合DSG实现细粒度诊断,评估显示多能力组件联合完成率随能力数增加下降,成本感知路由器可在减少算力的同时达到ERNIE的估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24160 2026-08-26 cs.AI 新提交 50%

OmniJudge or OmniBias? Diagnosing Multimodal Judges through Balanced, Decoupled Lenses

全能评判者还是全能偏差?通过平衡、解耦的视角诊断多模态评判者

Guangzheng Hu, Ziyue Jiang, Weixu Qiao, Lixin Zhang, Jianye Kang, Yuru Wu, Rong Bao, Niantong Li, Wei Wang, Ziyi Cheng, Xinfa Zhu, HangRui Hu, Ting He, Bing Zhao, Lin Qu, Hu Wei, Jin Xu

专题命中 文生图 :text-to-image(abstract)

AI总结 本研究推出平衡解耦的多模态评判者诊断基准D3-Omni,发现全能评判者存在模态相关维度表现差、漏检失败等系统性盲点,为评估多模态模型提供新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 1 篇

2608.24119 2026-08-26 cs.CV cs.AI 新提交 74%

TransPhy: Visual In-Context Learning for Physically Grounded Image Editing

TransPhy:面向物理基础图像编辑的视觉上下文学习

Siyi Xie, Xuanke Shi, Jinsheng Quan, Haoran Tang, Zukai Chen, Lei Yang, Quan Wang

机构 * Peking University(北京大学) SenseTime Research(商汤科技研究院) Zhejiang University(浙江大学)

专题命中 图像编辑 :image editing(title);分类 cs.CV

AI总结 针对现有视觉上下文学习对物理基础图像变换支持不足的问题,提出TransPhy框架,通过分解为物理规则归纳和过渡对齐渲染,在PhysVICL-74基准上提升了相关性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 62 篇

2608.18076 2026-08-26 cs.CV cs.AI 版本更新 85%

From Corpora to Co-Evolving Capabilities: Capability-Centric Data Design for Generalist Image Generation

从语料到协同进化的能力:面向通用图像生成的以能力为中心的数据设计

Xingjian Wang, Zhao Wang, Taihang Hu, Jun Zheng, Zhengrui Chen, Qinye Zhou, Zhengtao Wu, Yongchao Du, Zuan Gao, Chao Lin, Yefeng Shen, Yuan Wang, Xiaoli Xu, Zhengze Xu, Hao Yan, Denghui Yang, Yuhang Yu, Huayu Zhang, Mingzhou Zhang, Mengting Chen

机构 * Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 该研究提出能力驱动的数据基础设施,构建三类监督引擎,整理大规模图像语料,训练多模态扩散模型,在CPI-Bench等评估中展现良好生成与迁移能力。

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21885 2026-08-26 cs.CV 版本更新 83%

Pixel-Space Diffusion via Observation Operators

基于观测算子的像素空间扩散模型

Shaojie Guo, Lichen Ma, Haoyang Tong, Yu He, Zipeng Guo, Xiaoan Liu, Feng Yan, Yu Guo, Fei Wang, Junshi Huang, Yan Wang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对像素空间扩散模型的尺度-时间不匹配问题,提出观测算子扩散框架,采用时变观测轨迹与GL-CoDA解码器,在ImageNet-256上FID达1.52,收敛更快且生成质量提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23462 2026-08-26 cs.CV 版本更新 83%

LAFR: Efficient Diffusion-based Blind Face Restoration via Latent Codebook Alignment Adapter

LAFR:基于潜在码本对齐适配器的高效扩散盲人脸复原方法

Runyi Li, Bin Chen, Jian Zhang, Radu Timofte

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学) Computer Vision Lab, CAIDAS & IFI, University of Würzburg(计算机视觉实验室,乌尔姆大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究提出基于潜在码本对齐适配器的高效扩散盲人脸复原方法LAFR,通过轻量级微调与多级损失提升性能,在降低计算成本的同时优于OSEDiff风格基线。

Comments BMVC 2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24816 2026-08-26 physics.flu-dyn physics.chem-ph 新提交 82%

Effects of pressure on the chemical sooting structure of equi-diffusive counterflow diffusion flames

压力对等扩散对向流扩散火焰中化学 soot 结构的影响

Rajat Sawanni, Ömer L. Gülder

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究结合实验与OpenSMOKE++数值模拟,探究1-6 bar压力对等扩散对向流扩散火焰soot结构的影响,发现soot浓度随压力升高而增加,乙炔为碳传递关键节点,其影响力随压力增大。

Comments accepted for publication in the Proceedings of the Combustion Institute, Vol. 42

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22111 2026-08-26 cs.SD 版本更新 80%

FlowSep 2: Self-Supervised Flow Matching for Language-Queried Audio Source Separation

FlowSep 2:用于语言查询音频源分离的自监督流匹配方法

Yi Yuan, Xubo Liu, Haohe Liu, Xiyuan Kang, Mark D. Plumbley, Wenwu Wang

机构 * School of Computer Science and Electronic Engineering, University of Surrey(萨里大学计算机科学与电子工程学院) Meta Superintelligence Labs(元宇宙超级智能实验室) Department of Informatics, King’s College London(伦敦国王学院信息学系)

专题命中 扩散模型 :diffusion(summary_cn,abstract)

AI总结 本研究提出FlowSep2,一种结合Self-Flow与Diffusion Transformer的文本条件流匹配生成模型,用于语言查询音频源分离,在多个基准上达到SOTA性能,可有效分离重叠声源。

Comments Submission to IEEE/ACM Transactions on Audio, Speech, and Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24646 2026-08-26 cs.CV 新提交 79%

On-Policy Self-Distillation in Diffusion Models

扩散模型中的在线策略自蒸馏

Wei Zhou, Xiongwei Zhu, Lingdong Kong, Bo Chen, Lei Zhang, Yongyuan Liang, Xiaoxia Hou, Ye Tian, Xian Sun, Yingshuo Wang, Linfeng Li, Shengqiong Wu, Leigang Qu, Feng Li, Wei Liu, Julian McAuley, Tat-Seng Chua

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DiffusionOPSD在线策略自蒸馏框架,将图像级奖励指导转为中间监督,在SD 3.5-M等模型上获最佳保留得分,训练GPU小时显著减少,为高效可诊断的扩散模型对齐提供新路径。

Comments Technical Report; Project Page at this https URL (https://diffusionopsd.github.io) GitHub Repo at this https URL (https://github.com/worldbench/DiffusionOPSD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24422 2026-08-26 cs.CV 新提交 79%

ZODIAC: Zero-shot Octree-based Diffusion for Anatomical Completion

ZODIAC:基于八叉树的零样本解剖结构补全扩散模型

Miruna-Alexandra Gafencu, Vlad Bratulescu, Yordanka Velikova, Mohammad Farid Azampour, Nassir Navab

机构 * Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Konrad Zuse School of Excellence in Reliable AI (relAI)(康拉德·楚泽可靠AI卓越学院(relAI))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本研究针对术中超声脊柱补全的不适定问题,提出零样本框架ZODIAC,通过混合补全机制结合扩散先验与部分几何,在HD95指标上较全监督方法提升22%泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24105 2026-08-26 cs.CV 新提交 79%

DRRG: A Discrete Diffusion Framework for Radiology Report Generation

DRRG:用于放射报告生成的离散扩散框架

Shaoyang Zhoua, Yingshu Li, Yunyi Liu, Lijun Pu, Lingqiao Liu, Lei Wang, Luping Zhou

机构 * School of Electrical and Computer Engineering, The University of Sydney(悉尼大学电气与计算机工程学院) Department of Radiology, The First Affiliated Hospital of Soochow University(苏州大学附属第一医院放射科) School of Computer Science, The University of Adelaide(阿德莱德大学计算机学院) School of Computing and Information Technology, University of Wollongong(卧龙岗大学计算与信息技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本研究提出基于离散扩散大语言模型的DRRG框架,将放射报告生成转化为迭代掩码词去噪,在MIMIC-CXR、CheXpert Plus数据集上的多项指标优于对比方法,为放射报告生成提供了有效替代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24068 2026-08-26 cs.CV 新提交 79%

Representation Learning in Diffusion and Flow-based Model: An Application Aspect

扩散模型与基于流的模型中的表示学习:应用视角

Yanchen Xu, Sida Huang, Zhenyu Gu, Ruishu Zhu, Yilan Gao, Hongyuan Zhang

机构 * Fudan University(复旦大学) School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University(西北工业大学光学与电子信息人工智能学院(iOPEN)) The University of Hong Kong(香港大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本综述聚焦应用场景,提出三层渐进框架,梳理扩散与基于流的模型中表示学习的双向关系,分类下游任务方法,明确研究挑战并指明未来方向,为相关应用研究提供参考。

Comments Accepted by Vicinagearth

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23864 2026-08-26 cs.CV 新提交 79%

AffineTok: Semantic Affine Consistency for Diffusion-Friendly Visual Tokenizer

AffineTok:面向扩散模型友好型视觉分词器的语义仿射一致性

Junqiu Yu, Pandeng Li, Yikai Wang, Jiaxing Zhao, Yujie Wei, Kaixun Jiang, Quanhao Li, Hongtao Yu, Zhihang Liu, Zhaohe Liao, Junjie Zhou, Yun Zheng, Yu Liu, Yanwei Fu

机构 * Fudan University(复旦大学) Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出AffineTok,通过语义仿射一致性(SAC)引导视觉分词器训练,引入M_SAC作为代理指标,在ImageNet 256上实现了gFID的显著降低,达到无引导1.21、有引导1.10的SOTA性能。

Comments Project page: this https URL (https://michaelyu781.github.io/AffineTok-site/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23664 2026-08-26 cs.CV cs.LG 新提交 79%

Scaling Reinforcement Learning for Diffusion Models via Velocity Matching

通过速度匹配扩展扩散模型的强化学习

Jaemoo Choi, Wei Guo, Yuchen Zhu, Arash Vahdat, Molei Tao, Julius Berner, Yongxin Chen

机构 * Georgia Institute of Technology(佐治亚理工学院) NVIDIA(英伟达公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究提出基于奖励的速度匹配(RVM)方法,用于扩散模型的奖励微调,其训练成本显著降低,性能优于或相当基于轨迹的策略梯度方法,还通过动态跟踪奖励改善了视频生成的运动效果。

Comments 30 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23343 2026-08-26 cs.CV 版本更新 79%

Controllable blind deblurring with diffusion models

基于扩散模型的可控盲去模糊

Imane Si Salah, Emile Cribelier, Thomas Veit, Wolf Hauser, Arthur Leclaire

机构 * DxO Labs LTCI, Télécom Paris, IP Paris(LTCI,巴黎电信学院,巴黎理工大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出基于扩散模型的SuperSharpen盲去模糊方法,通过模糊度量可控调整复原强度,经实验验证其在合成与真实模糊上的感知质量及可控性优于对比策略

Comments 6 pages, 5 figures, 1 table. Accepted to IEEE ICIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20818 2026-08-26 cs.LG cs.AI cs.CV 版本更新 79%

Scaling Muon for Diffusion Transformers

针对扩散Transformer的Muon优化器的缩放研究

Chenghao Li, Xiao Han, Xinxin Huang, Wei Liu, Boyang Li, Bing Xiao, Heran Zhang, Juanma Perez Rua, Ke Xu, Kangning Liu, Linjun Kuang, Na Li, Tan Wang, Tian Xie, Wei Peng, Yang Pei, Yifan Xu, Yuanhao Zhai, Yuwei Lin, Zhe Wang, Zihao He, Daniel Li, Junbiao Tang, Ziyang Jiang, Dake Chen

机构 * University of Southern California(南加州大学) Meta

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究针对大型扩散Transformer的Muon优化器,提出周期性行级Muon,在保留其生成质量优势的同时,大幅降低训练的计算、通信开销与时间。

Comments This version has to be withdrawn due to the incomplete publication privacy review required by the company. After completing the privacy review, the newer version will be updated

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19567 2026-08-26 cs.CV 版本更新 79%

Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion

Block3D:基于分块扩散的高效文本到3D生成

Bowen Cui, Weijie Wang, Zeyu Zhang, Yefei He, Mingda Lin, Haoyu Zhao, Yuanyu He, Donny Y. Chen, Feng Chen, Bohan Zhuang

机构 * ZipLab, Zhejiang University(浙江大学ZipLab) University of California, Berkeley(加州大学伯克利分校) Wuhan University(武汉大学) Monash University(莫纳什大学) University of Adelaide(阿德莱德大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对文本到3D生成成本高的问题,提出Block3D分块扩散框架,通过分块生成、联合去噪及置信度引导的块内修正,在保持几何保真度的同时实现5.15倍的速度提升。

Comments Project page: this https URL (https://alexandertsui.github.io/block3d/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24192 2026-08-26 cs.CV cs.AI cs.CL 版本更新 79%

Co-occurring Associated REtained concepts in Diffusion Unlearning

扩散模型遗忘中的共现关联保留概念

Miso Kim, Georu Lee, Yunji Kim, Hoki Kim, Jinseong Park, Woojin Lee

机构 * Dongguk University-Seoul(东国大学-首尔) Chung-Ang University(Chung-Ang 大学) Korea Institute for Advanced Study(韩国高级研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对扩散模型遗忘中误删良性共现概念的问题,提出CARE评分量化保留程度,并设计ReCARE框架通过自动构建CARE集实现稳健遗忘,平衡概念擦除、整体效用与共现概念保留。

Comments Accepted as a poster at ICLR 2026. Code available at this https URL (https://github.com/damilab/CARE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09477 2026-08-26 cs.CV cs.AI 版本更新 79%

Outlier-Robust Diffusion Solvers for Inverse Problems

具有鲁棒性的扩散求解器用于逆问题

Yang Zheng, Jiahua Liu, Tongyao Pang, Wen Li, Zhaoqiang Liu

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) Yau Mathematical Sciences Center, Tsinghua University(清华大学尤太数学科学中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种鲁棒扩散求解器,通过噪声估计和Huber损失构建迭代加权最小二乘目标,以解决逆问题中的异常值问题,并在多个图像数据集上验证了其有效性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24043 2026-08-26 cs.CV 版本更新 79%

Spatio-Temporal Garment Reconstruction Using Diffusion Mapping via Pattern Coordinates

基于模式坐标扩散映射的时空服装重建

Yingxuan You, Ren Li, Corentin Dumery, Cong Cao, Hao Li, Pascal Fua

机构 * CVLab, École Polytechnique Fédérale de Lausanne (EPFL)(瑞士联邦理工学院(EPFL)计算机视觉实验室) Mohamed bin Zayed University of Artificial Intelligence(马尔代夫人工智能大学) Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) Pinscreen and Mohamed bin Zayed University of Artificial Intelligence(Pinscreen和马尔代夫人工智能大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于模式坐标扩散映射的时空服装重建方法,结合隐式缝合模式与生成扩散模型,实现高保真3D服装重建,适用于虚拟试穿和动画等领域。

Comments arXiv admin note: text overlap with arXiv:2504.08353 (https://arxiv.org/abs/2504.08353)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12524 2026-08-26 cs.CV 版本更新 79%

Voronoi-Assisted Optimization for Diffusing Unsigned Distance Fields from Unoriented Points

基于Voronoi辅助优化的无向点云无符号距离场扩散方法

Jiayi Kong, Chen Zong, Junkai Deng, Xuhui Chen, Fei Hou, Shiqing Xin, Junhui Hou, Chen Qian, Ying He

机构 * S-Lab Nanyang Technological University Singapore(南洋理工大学新加坡S-Lab) College of Mathematics Nanjing University of Aeronautics and Astronautics China(南京航空航天大学数学学院) College of Computing and Data Science Nanyang Technological University Singapore(南洋理工大学计算与数据科学学院) Institute of Software Chinese Academy of Sciences China(中国科学院软件研究所) School of Computer Science Shandong University China(山东大学计算机科学学院) Department of Computer Science City University of Hong Kong China(香港城市大学计算机科学系) SenseTime Research China(SenseTime研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出轻量级无网络方法VAD,通过Voronoi准则对齐无向点云法向量并扩散积分,可高效稳定计算UDF,稳健处理各类三维几何结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24812 2026-08-26 cs.LG 新提交 78%

MDTE: Minority-Aware Diffusion over Temporal Edge Events for Imbalanced Node Classification

MDTE:面向时序边事件的少数类感知扩散模型用于不平衡节点分类

Zhou Zelong, Zhang Tianming, Yang Zhengyi, Tang Yifu, Hou Chenyu, Cao Bin, Fan Jing

机构 * Zhejiang University of Technology(浙江工业大学) The University of Sydney(悉尼大学) Vecton AI

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对时序图不平衡节点分类中少数类表示被同化、判别证据不足的问题,提出MDTE框架,通过分布感知选择性传播与多视图判别融合,在五个真实数据集上显著提升少数类相关指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24699 2026-08-26 eess.SY 新提交 78%

DeepONet-LSTM Neural Operator for Output Feedback Control of Reaction Diffusion PDEs

用于反应扩散偏微分方程输出反馈控制的DeepONet-LSTM神经算子

Jing Zhang, Jie Qi, Linglong Jiang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出混合DeepONet-LSTM神经算子,近似反应扩散偏微分方程输出反馈控制的因果边界算子,结合理论分析与改进损失函数,实现系统有效镇定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23807 2026-08-26 cs.AI 新提交 78%

Serving Masked Diffusion LLMs: Characterization and Design Principles from Real Hardware

部署掩码扩散大语言模型:基于真实硬件的特性分析与设计原则

Farhana Amin, Sabiha Afroz, Mona Moghadampanah, Dimitrios S. Nikolopoulos

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过真实硬件实验分析LLaDA-8B-Instruct等dLLM的部署特性,发现其请求步数离散、批处理可分摊CPU开销等规律,提出适配dLLM的部署设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23798 2026-08-26 cs.LG 新提交 78%

A Theory of Speciation in Generative Diffusion Models on Compact Riemannian Manifolds

紧致黎曼流形上生成式扩散模型的物种形成理论

Alessio Marta, Paola Causin

机构 * University of Milan(米兰大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究建立紧致黎曼流形上生成式扩散模型的物种形成内蕴理论,刻画其分岔机制,推导相关估计与稳定性结论,经球面实验及神经网络学习方案验证。

Comments 48 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24253 2026-08-26 math.AP 新提交 78%

Critical Three-Species Competition-Diffusion: Traveling-Wave Rigidity and the Fastest-Species Selection

临界三物种竞争扩散系统:行波刚性与最快物种选择

Haozhe Shu, Dongyuan Xiao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对一维临界三物种竞争扩散系统,研究行波刚性与长期物种选择,结合熵方法及相关不等式,在特定条件下可使较慢物种灭绝并收敛至最快物种的平衡点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23734 2026-08-26 math.AP 新提交 78%

Smoothing effect and uniqueness for aggregation diffusion models

聚集扩散模型的光滑效应与唯一性

Stefano Lisini, Edoardo Mainini

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对$\mathbb R^d$($d\geq2$)中含牛顿或贝塞尔势的聚集扩散模型,通过JKO格式分析,建立$L^\infty$光滑效应,证明梯度流解的唯一性,刻画梯度流并得到公平竞争下解的一致消失性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02579 2026-08-26 cond-mat.stat-mech 版本更新 78%

A general thermodynamic approach for diffusion on a lattice

晶格上扩散的通用热力学方法

Matías A. Di Muro, Miguel Hoyuelos

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究提出通用热力学方法描述晶格粒子扩散,推导Onsager矩阵与理想对应项的关系,重现Darken方程并推导Zhdanov模型非对角扩散矩阵,其分析预测获数值模拟验证。

详情

展开后加载摘要…

URL PDF HTML 收藏