arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-24 至 2026-08-24 共收录 70 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 55 篇

2608.20534 2026-08-24 cs.CV 新提交 57%

Grounded-Exo2Ego: Structured Semantic Grounding for Robust Exocentric-to-Egocentric Video Generation

Grounded-Exo2Ego:用于鲁棒外部视角到自我视角视频生成的结构化语义 grounding

Shengze Wang, Michael Stengel, Tianye Li, Seonwook Park, Amrita Mazumdar, Koki Nagano, Alex Trevithick, Shalini De Mello

机构 * NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出Grounded-Exo2Ego框架,通过双分支视频扩散模型、相机重定位算法和自动合成数据引擎,在EgoExo4D数据集上大幅提升了外部视角到自我视角视频生成的性能。

Comments website url: this https URL (https://research.nvidia.com/labs/amri/projects/grounded-exo2ego/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20561 2026-08-24 eess.IV cs.AI cs.CV cs.LG physics.med-ph 新提交 57%

Consistency Models for Fast MRI Reconstruction Using Regularization by Denoising

基于去噪正则化的快速MRI重建一致性模型

Merve Gülle, Junno Yun, Yaşar Utku Alçalar, Mehmet Akçakaya

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本研究提出CM-RED方法,将一致性模型整合到去噪正则化框架中,仅用4次网络函数评估,在fastMRI数据集上实现优于现有方法的快速高质量MRI重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01479 2026-08-24 cs.CV 版本更新 57%

RecGen3D: Reconstruction-Guided 3D Generation in a Shared Canonical Space

UniRecGen:统一多视图3D重建与生成

Zhisheng Huang, Jiahao Chen, Cheng Lin, Chenyu Hu, Hanzhuo Huang, Zhengming Yu, Mengfei Li, Yuheng Liu, Zekai Gu, Zibo Zhao, Yuan Liu, Xin Li, Wenping Wang

机构 * Macau University of Science and Technology(澳门科技大学) Xidian University(西安电子科技大学) ShanghaiTech University(上海科技大学) Hong Kong University of Science and Technology(香港科技大学) University of California, Irvine(加利福尼亚大学尔湾分校)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 UniRecGen融合了高效重建与生成模型,通过共享空间协作学习提升多视图3D模型的完整性和一致性,实验显示其在稀疏观测下生成更精确稳定的3D模型。

Comments Accepted to SIGGRAPH Asia 2026 (Conference Papers). 21 pages including supplementary material. Code: this https URL (https://github.com/zsh523/RecGen3D)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20965 2026-08-24 cs.LG 新提交 56%

Training, learning and inference: unified dynamics of neural systems

训练、学习与推理:神经系统的统一动力学

Mian Wang

专题命中 扩散模型 :diffusion(abstract,comments)

AI总结 该研究定义原子生成事实并构建生成事实图,基于nanoGPT等建立训练-学习统一动力学,二阶预测器在四转换上获91.43%准确率等,还将推理确立为训练-学习动力学的冻结投影。

Comments 39 pages, 2 figures, 3 tables. Evidence spans 22 indexed experimental programmes: held-out prediction (91.43% accuracy), causal interventions, and cross-system validation in nanoGPT, ResNet/CIFAR-100 and diffusion/CIFAR-10. Code: this https URL (https://github.com/wind342/gfg-training-learning-inference-experiments). Evidence: this https URL (https://doi.org/10.5281/zenodo.22032772)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20530 2026-08-24 cs.CL 新提交 50%

LiLiCorr: Lightweight Likelihood Correlation of Parallel Drafts for Speculative Decoding

LiLiCorr:用于推测解码的并行草稿轻量级似然关联模型

Matan Rusanovsky, Yoav Miron, Roy Uziel, Omer Belhasin, Ran Zilberstein, Maor Ashkenazi, Michael Elad

机构 * NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(abstract)

AI总结 LiLiCorr是关联并行草稿边际分布的轻量级模型,联合训练草稿生成器后,在多数设置下提升了推测解码的接受长度与吞吐量,且对长输入仍保持性能优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20375 2026-08-24 cs.CL 新提交 50%

GRAFT: Adaptive DLM-Based Draft Tree Construction with Target-Distilled Edge Scoring

GRAFT:基于自适应DLM的草稿树构建与目标蒸馏边评分

Xuming Ye, Zeming Ma, Runjie Yu, Yuan Liu, Tianle Li, Shuhan Bai, Jian Zhou, Fei Wu

专题命中 扩散模型 :diffusion(abstract)

AI总结 GRAFT 是用于基于 DLM 的推测解码的草稿树构建框架,通过 TDES 和 SABA 解决现有方法的父子兼容性与预算适配问题,实现了 2.13 倍至 6.36 倍的端到端加速,每轮开销不足 0.5 毫秒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20346 2026-08-24 cs.CL cs.SD eess.AS 新提交 50%

Building and Evaluating a Synthetic Bengali Speech Resource for Telecom Customer Care

构建并评估面向电信客服场景的合成孟加拉语语音资源

Kawshik Kumar Paul, Md. Nafiul Alam Fuji

机构 * Bangladesh University of Engineering and Technology (BUET)(孟加拉工程技术大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文构建并公开了面向电信客服场景的合成孟加拉语语音数据集,经评估其文本与音频一致性强,同时探讨了合成语音及STT评估的局限性。

Comments Dataset URL: this https URL (https://huggingface.co/datasets/kawshikbuet17/bengali-telecom-customer-care-speech)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21213 2026-08-24 math.DG math.AP 新提交 50%

Differential Harnack Estimates for the Filtration Equations on Riemannian Manifolds via Nash--Moser Iteration

基于Nash–Moser迭代的黎曼流形上过滤方程的微分Harnack估计

Jian-Hua Hao, Yu-Zhao Wang

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对黎曼流形上过滤方程的光滑正解,通过Bochner判别式结合Nash–Moser迭代推导微分Harnack估计,恢复了两类方程的经典估计并拓展了过滤律类型。

Comments 25pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20996 2026-08-24 math.OC 新提交 50%

Bridging Semantics and Behavior: An Agent-Based Evolutionary Model of Topic Competition with BERTopic

衔接语义与行为:基于智能体的BERTopic主题竞争演化模型

Blekanov I., Gubar E., Fan X

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究提出结合BERTopic、演化博弈论与智能体模拟的框架,揭示社交媒体主题传播的微观机制,复现真实传播趋势,为在线集体行为研究及相关应用提供支撑。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20950 2026-08-24 math.AP 新提交 50%

Concentration-compactness for the geometric polyharmonic heat flow

几何多重调和热流的集中紧性

James McCoy, Scott Parkins, Glen Wheeler, Valentina Wheeler

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对任意高阶几何演化方程建立集中紧性理论,以三维欧氏空间闭浸入曲面的几何多重调和热流为模型,结合多种估计与性质,证明满足无迹曲率阈值条件的连通初始浸入对应的解全局存在且指数收敛到圆球面。

Comments 58 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20441 2026-08-24 cs.LG math.NA physics.comp-ph 新提交 50%

Shared Physics Responses Recover Hidden Rankings in Neural Operator Libraries

共享物理响应在神经算子库中恢复隐藏排名

Hanbing Liang, Fujun Liu

机构 * Changchun University of Science and Technology(长春理工大学) School of Physics(物理学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对无高保真参考解时神经算子部署的最优选择难题,提出利用共享物理响应的方法,恢复模型库隐藏排名,准确率超99%,实现无需真值数据的高效科学代理部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20439 2026-08-24 cs.LG physics.comp-ph 新提交 50%

Wrong-Physics Backdoors in Neural PDE Operators

神经PDE算子中的错误物理后门

Hanbing Liang, Fujun Liu

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究提出跨参数重链接数据投毒原语,在神经PDE算子中构造错误物理后门,在保持低干净误差的同时实现高攻击成功率,暴露了其结构性验证缺口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20985 2026-08-24 physics.comp-ph 新提交 50%

Resolving positive semi-definiteness in physics-informed kernels for scientific machine learning

解决科学机器学习中物理信息核的半正定性问题

J. Moser, C. Albert, S. Ranftl

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文针对科学机器学习中物理信息核的半正定性问题,确立了m阶线性微分算子对应的基核需m次连续可微的充分条件,指出相关不稳定性源于数值问题,为算子信息核方法提供了统一有效性基础。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20889 2026-08-24 quant-ph cond-mat.quant-gas 新提交 50%

Characterizing Multimode Effects in a Guided Matterwave Gyroscope

导波光物质波陀螺仪中的多模效应表征

Jessica K. Eastman, Ellen Zheng, Stuart S. Szigeti, Simon A. Haine

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究理论探究由两分量玻色-爱因斯坦凝聚体构成的紧凑型物质波涡旋陀螺仪性能,量化其两种性能退化机制,确定参数权衡区间,对比导波萨格纳克干涉仪展现更优缩放特性,是紧凑型高精度旋转传感的有前途候选方案。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20780 2026-08-24 cond-mat.mes-hall 新提交 50%

Planar Nanofluidic Memristors Enabled by Surface Charge Gradient

由表面电荷梯度实现的平面纳米流体忆阻器

Zhongyuan Zhao, Ziyi Yin, Chudi Qi, Yuheng Li, Shoushan Fan, Qunqing Li, Yang Wei

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种由表面电荷梯度实现的平面纳米流体忆阻器,采用PNP框架分析其忆阻行为,揭示记忆效应与表面电荷一阶矩的关联,为该类器件的优化设计提供理论基础。

Comments Main text: 7 pages, 4 figures. Supplementary material: 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19943 2026-08-24 quant-ph cond-mat.other hep-lat hep-ph nucl-th 版本更新 50%

Imaginary time evolution of a quantum system through analytic continuation from real-time quantum simulation

通过从实时量子模拟进行解析延拓实现量子系统的虚时演化

Peng Guo, Anto Shibu, Joshua Lin, Yong Zhao

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究提出一种通过对测得的实时关联函数进行解析延拓来获取一般量子哈密顿量虚时演化的算法,并在IBM量子硬件上通过实例验证了该方法的有效性。

Comments some reference link errors are fixed

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11194 2026-08-24 math.AP math.FA 版本更新 50%

Lions' Maximal Regularity Problem for Divergence-Form Differential Operators: Failure at the $\frac{1}{2}$-Hölder Endpoint

散度型微分算子的Lions极大正则性问题:在1/2-Hölder端点处失效

Lukas Niebel

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对散度型微分算子的Lions极大正则性问题,构造出1/2-Hölder端点处的反例,证明仅该连续性不蕴含极大L²正则性,且可推广到高维有界区域。

Comments Added one reference and two remarks. No changes to the proofs

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18172 2026-08-24 cond-mat.mtrl-sci cond-mat.mes-hall 版本更新 50%

Phase-field modeling of TiO2 nanocarving via reaction with hydrogen-bearing gas

通过与含氢气体反应对TiO2进行纳米雕刻的相场模拟

Alireza Seifi, Sheikh Akbar, Yanzhou Ji

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过建立二维相场模型,探讨TiO2纳米雕刻中形态演变,纳入多种因素,经模拟明确各向异性因素作用,确定反应速率各向异性为主导,还探索晶粒取向差角影响,为微观结构演变及控制提供见解和指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14388 2026-08-24 cond-mat.stat-mech 版本更新 50%

Memory Retention and the Classification of Renormalization-Group Fixed Points in Self-Similar Dynamics

自相似扩散中初始条件的记忆:重整化群视角

Ko Okumura

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究自相似扩散中初始条件的记忆,利用统一重整化群框架,通过修正密度依赖扩散模型揭示标度结构,初始条件信息渐近相关,Barenblatt方程是特例,为普遍性和反常标度提供新视角。

Comments 12 pages, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10875 2026-08-24 physics.flu-dyn 版本更新 50%

Spreading and rupture dynamics of soluble surfactant-laden thin film flow down a slippery incline in presence of external shear

在外部剪切作用下,含可溶性表面活性剂的薄膜在光滑斜坡上流动的扩展与破裂动力学

Dipankar Paul, Harekrushna Behera

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究含可溶性表面活性剂薄膜在光滑斜坡流动时的扩展与破裂动力学,用润滑近似法推导方程,考虑吸附动力学速率的快速和慢速情况,分析外部剪切力等因素对薄膜厚度及破裂的影响,揭示相关作用机制及滑移参数的双重效应。

Comments 28 pages, 71 figures, comments are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09079 2026-08-24 cond-mat.stat-mech 版本更新 50%

Predictive Renormalization-Group Theory of Universality Classes in Nonlinear Systems

非线性系统中普适类的预测重整化群理论

Ko Okumura

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对非线性系统普适性问题,开发重整化群框架,通过标度不变性和消除无关结构确定普适类,适用于多种动力学情况,能再现标度行为并预测方程族,为非线性系统普适性提供统一视角,揭示其源于与临界现象相同的基本原理。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02507 2026-08-24 cond-mat.mtrl-sci cs.ET cs.LG physics.app-ph physics.comp-ph 版本更新 50%

Towards Automated Discovery: A Review of Generative Models, Multimodal Learning and Closed-Loop Workflows in Inverse Materials Design

迈向自动发现:逆向材料设计中生成模型、多模态学习与闭环工作流综述

Anand Babu, Rogério Almeida Gouvêa, Gian-Marco Rignanese

机构 * Institute of Condensed Matter and Nanosciences, Université Catholique de Louvain(凝聚态与纳米科学研究所,比利时列日-努瓦尔桑大学) WEL Research Institute(WEL研究机构)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文综述了逆向材料设计中生成晶体结构建模、多模态学习和闭环设计管道的最新进展,重点讨论了可行性约束与物理先验的施加方式、多模态融合策略以及多种逆向设计策略(如条件生成与潜在优化、贝叶斯优化、强化学习和主动学习),并指出了常见失败模式及基于分阶段报告的评估实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06103 2026-08-24 cs.IT 版本更新 50%

Identification for Inverse Gaussian Channels

逆高斯信道的识别问题

Mohammad Javad Salariseddigh, Christian Deppe

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究逆高斯信道的识别容量上下界,分析确定性编码方案在峰值时间约束下的渐进行为,发现满足弱正则性条件时,识别容量随码字长度呈超指数增长。

Comments 18 pages, 2 figures; the converse proof has been extended to hold without restrictive noise assumptions

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21171 2026-08-24 math.AP 版本更新 50%

Navier-Stokes-Cahn-Hilliard system in a $3$D perforated domain with free slip and source term: Existence and homogenization

三维穿孔区域中具有自由滑移和源项的Navier-Stokes-Cahn-Hilliard系统:存在性与均匀化

Amartya Chakrabortty, Haradhan Dutta, Hari Shankar Mahato

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究周期性穿孔多孔介质中二元不可压缩混合物的扩散界面模型,证明微观NSCH系统弱解的存在性,并通过均匀化得到两种宏观模型:无毛细力时解耦为线性Stokes和Cahn-Hilliard系统;平衡时得到耦合的Navier-Stokes-Cahn-Hilliard系统。

Comments 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10282 2026-08-24 cs.RO 版本更新 50%

Update-Free On-Policy Steering via Verifiers

基于验证器的免更新在线策略引导

Maria Attarian, Ian Vyse, Jasper Gerigk, Evgenii Opryshko, Yifan Ruan, Anas Almasri, Sumeet Singh, Yilun Du, Igor Gilitschenski, Claas Voelcker

机构 * University of Toronto(多伦多大学) Google DeepMind(谷歌DeepMind) University of Alberta(阿尔伯塔大学) UTAustin(得克萨斯大学奥斯汀分校) Harvard University(哈佛大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出UF-OPS方法,利用策略评估中的验证器函数引导基础策略选择高成功概率动作,无需更新参数即可提升黑箱扩散策略性能,在5个真实任务中平均成功率提升49%。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05588 2026-08-24 astro-ph.HE 版本更新 50%

Radiation GRMHD Models of Accretion onto Stellar-Mass Black Holes: III. Near-Eddington Accretion

辐射GRMHD模型中的恒星质量黑洞吸积:III. 近爱丁顿吸积

Lizhong Zhang, James M. Stone, Shane W. Davis, Yan-Fei Jiang, Patrick D. Mullen, Christopher J. White

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过求解包含完整辐射输运的GRMHD方程,研究了四个近爱丁顿黑洞吸积模型,揭示了磁场拓扑和黑洞自旋对吸积盘结构及喷流的影响。

Comments 29 pages, 24 figures, 3 tables, accepted for publication in ApJ

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06621 2026-08-24 stat.ML cs.LG 版本更新 50%

Infinite-dimensional generative diffusions via Doob's h-transform

通过Doob的h变换构建无限维生成扩散

Thorben Pieper-Sethmacher, Daniel Paulin

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过Doob的h变换在无限维中构建生成扩散模型,通过测度变换推动扩散过程,实现了更灵活的模型构建,并在合成和真实数据上验证了方法有效性。

Comments Accepted to the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07128 2026-08-24 math.AP 版本更新 50%

Stability of propagating terraces in spatially periodic multistable equations in $\mathbb{R}^N$

$\boldsymbol{\text{R}}^N$ 中空间周期多稳态方程中传播台阶的稳定性

Thomas Giletti, Luca Rossi

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究 $\boldsymbol{\text{R}}^N$ 中空间周期多稳态反应扩散方程解的长时间行为,证明传播台阶的唯一性,揭示其速度决定柯西问题解的扩展速度,并指出其速度 Wulff 形状可能非光滑。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 5 篇

2608.20932 2026-08-24 cs.CV 新提交 79%

OccluRank: Controllable Occlusion-Aware Layout-to-Image Generation by Adding Just an Ordinal Rank

OccluRank:仅添加序数秩的可控遮挡感知布局到图像生成

Wenyang Hong, Yuan Wang, Yanbin Hao, Lanqing Xue, Ke Wang, Xiang Wang, Kuien Liu, Richang Hong

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

AI总结 提出OccluRank框架,仅添加序数秩实现可控遮挡感知布局到图像生成,构建相关数据集与基准,实验表明其能可靠保留实例、遵循布局并实现期望遮挡关系,性能相当。

Comments 16 pages, 7 figures. Code: this https URL (https://github.com/Wenyang-hong/OccluRank)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20929 2026-08-24 cs.CV 新提交 70%

GAP-SAM: A Global Artifact Prior for Generalizable AI-Generated Image Manipulation Localization

GAP-SAM:用于通用AI生成图像篡改定位的全局伪影先验

Haozhen Yan, Siyuan Shan, Zijian Yu, Youqi Wang, Yan Hong, Jun Lan, Jianfu Zhang

专题命中 可控生成 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本研究针对AI生成图像篡改定位的分布外性能问题,提出GAP-SAM方法,通过构建COCO-ControlNet对齐语义与几何,利用全局伪影标记抑制语义边界捷径,在六个数据集上平均像素F1达79.8,优于现有方法且在各类图像退化下表现最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏