arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-21 至 2025-11-21 共收录 50 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 40 篇

2511.16631 2025-11-21 astro-ph.HE 50%

A Core-Collapse Supernova Neutrino Parameterization with Enhanced Physical Interpretability

超新星核心坍缩中具有增强物理解释性的中微子参数化

Haihao Shi, Zhenyang Huang, Junda Zhou, Guoliang Lü, Xuefei Chen

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种增强物理解释性的超新星中微子参数化方法,通过分析$τ(t)$的时间演化区分成功与失败爆炸,并约束SN1987A前身质量。

Comments 48 pages, 31 figures, It has been accepted by APJS

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16601 2025-11-21 math.DG math-ph math.AP math.FA math.MP 50%

An Information-Theoretic Reconstruction of Curvature

信息论视角下的曲率重建

Amandip Sangha

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种基于信息论的方法,通过热扩散数据重建黎曼曲率,利用相对熵分析曲率信息不平衡,提供了一种新的曲率分析视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16426 2025-11-21 cs.LG 50%

FreqFlow: Long-term forecasting using lightweight flow matching

FreqFlow: 基于轻量级流匹配的长期预测

Seyed Mohamad Moghadas, Bruno Cornelis, Adrian Munteanu

机构 * ETRO Department, Vrije Universiteit Brussel(布鲁塞尔自由大学ETRO部门) imec

专题命中 扩散模型 :diffusion(abstract)

AI总结 FreqFlow通过频率域中的条件流匹配实现轻量级多变量时间序列预测,实现7%的RMSE改进,比现有方法更高效。

Comments Accepted at EurIPS, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16371 2025-11-21 cond-mat.soft cond-mat.dis-nn 50%

Modeling adsorption processes on the core-shell-like polymer structures: star and comb topologies

在核心壳状聚合物结构上建模吸附过程:星形和梳状拓扑结构

V. Blavatska, Ja. Ilnytskyi, E. Lähderanta

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过晶格聚合物模型分析星形和梳状拓扑结构的吸附性能,发现梳状结构在吸附容量上更优但吸附强度较低,且随分支分离增加效应更明显。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16300 2025-11-21 math.AP 50%

Asymptotic behavior and sharp estimates for spreading fronts in a cooperative system with free boundaries

自由边界合作系统中传播前沿的渐进行为与精确估计

Qian Qin, JinJing Jiao, Zhiguo Wang, Hua Nie

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了具有自由边界的反应扩散系统中两种合作物种的扩散行为,通过半波系统确定前沿的渐近速度并提供精确估计,揭示了系统在长期中的扩散-消失二元性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.07942 2025-11-21 math.AP math.DG 50%

A general nonlinear characterization of stochastic incompleteness

随机不完整性的通用非线性特征

Gabriele Grillo, Kazuhiro Ishige, Matteo Muratori, Fabio Punzo

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了随机不完整性的通用非线性特征,证明了其与非线性抛物方程解的非唯一性等价,并探讨了其在不同物理问题中的应用。

Comments Final version, to appear in J. Math. Pures Appl

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16190 2025-11-21 math.DS math.PR 50%

Random Attractors for McKean-Vlasov SDEs

麦肯-瓦拉斯方程组的随机吸引子

Mengyu Cheng, Xianjin Cheng, Zhenxin Liu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了麦肯-瓦拉斯随机微分方程组在可分希尔伯特空间上的随机吸引子存在性,通过转换方程到产品空间并分析协程,建立了通用理论并应用于多种随机偏微分方程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16089 2025-11-21 physics.chem-ph 50%

Structure and Spectroscopy of Criegee Intermediates in Gas- and Aqueous Environments

气相及水环境中的特瑞格尔中间体的结构与光谱学

Cangtao Yin, Meenu Upadhyay, Markus Meuwly

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究了特瑞格尔中间体在气相和水环境中的结构与光谱特性,发现其在不同环境中的扩散行为和光谱位移差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16036 2025-11-21 physics.optics 50%

Understanding and improving axial detection in optical tweezers based on the interference of forward- and backward- scattered light

理解并改进光学镊子中轴向检测基于前向和后向散射光的干涉

Isaac Pérez Castillo, Simon Leturcq, Sylvain Domitin, Ashley L. Nord, Francesco Pedaci, Alejandro V. Arzola

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种考虑后向散射光干涉的模型,用于改进光学镊子中轴向检测的准确性,以更全面地理解并提升其在复杂条件下的应用能力。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16013 2025-11-21 cs.LG cs.AI 50%

Physics-Guided Inductive Spatiotemporal Kriging for PM2.5 with Satellite Gradient Constraints

物理引导的诱导时空克里金法用于PM2.5的卫星梯度约束

Shuo Wang, Mengfan Teng, Yun Cheng, Lothar Thiele, Olga Saukh, Shuangshuang He, Yuanting Zhang, Jiang Zhang, Gangfeng Zhang, Xingyuan Yuan, Jingfang Fan

机构 * School of Systems Science, Beijing Normal University(北京师范大学系统科学学院) College of Information Engineering, Jiangxi University of Science and Technology(江西理工大学信息工程学院) D-ITET, ETH Zurich(ETH Zurich的D-ITET) Graz University of Technology(格拉茨技术大学) ColorfulClouds Technology Co.,Ltd.(ColorfulClouds技术有限公司) State Key Laboratory of Earth Surface Processes and Disaster Risk Reduction, Beijing Normal University(北京师范大学地球表层过程与灾害风险降低国家重点实验室)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出SPIN框架,通过整合物理过程和卫星数据,实现高精度PM2.5污染预测,降低数据缺失影响,达到新的MAE最优水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15995 2025-11-21 cs.RO 50%

PushingBots: Collaborative Pushing via Neural Accelerated Combinatorial Hybrid Optimization

PushingBots: 通过神经加速的组合混合优化实现协作推搡

Zili Tang, Ying Zhang, Meng Guo

机构 * School of Advanced Manufacturing and Robotics, Peking University(先进制造与机器人学院,北京大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 PushingBots通过神经加速的组合混合优化实现机器人协作推搡,解决复杂环境中多物体精准推运问题。

Comments 20 pages, 24 figures. Accepted to IEEE Transactions on Robotics (T-RO), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.13913 2025-11-21 math.PR math.FA q-fin.MF 50%

Invariant cones for jump-diffusions in infinite dimensions

跳跃扩散在无限维中的不变锥

Stefan Tappe

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了跳跃扩散在无限维中的不变锥条件,并探讨了其在自然科学和经济学中的应用。

Comments 46 pages

Journal ref Nonlinear Differential Equations and Applications 31(6), Article Number 107, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.10337 2025-11-21 math.PR math.FA 50%

Infinite dimensional affine processes

无穷维仿射过程

Thorsten Schmidt, Stefan Tappe, Weijun Yu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究无穷维仿射扩散过程,推导Riccati微分方程系统并证明其存在性,同时提供相关例子。

Comments 37 pages

Journal ref Stochastic Processes and Their Applications 130(12):7131-7169, 2020

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 2 篇

2511.16666 2025-11-21 cs.CV 79%

SceneDesigner: Controllable Multi-Object Image Generation with 9-DoF Pose Manipulation

SceneDesigner: 9自由度姿态操控的可控多物体图像生成

Zhenyuan Qin, Xincheng Shuai, Henghui Ding

机构 * Fudan University(复旦大学)

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

AI总结 SceneDesigner通过9自由度姿态操控实现多物体图像生成,采用CNOCS图和两阶段训练策略提升可控性与质量。

Comments NeurIPS 2025 (Spotlight), Project Page: https://henghuiding.com/SceneDesigner/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02260 2025-11-21 cs.CV 57%

MagicFace: High-Fidelity Facial Expression Editing with Action-Unit Control

MagicFace: 通过动作单元控制实现高保真的面部表情编辑

Mengting Wei, Tuomas Varanka, Xingxun Jiang, Huai-Qian Khor, Guoying Zhao

机构 * Center for Machine Vision and Signal Analysis, Faculty of Information Technology and Electrical Engineering, University of Oulu(机器视觉与信号分析中心,信息科技与电气工程学院,奥卢大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 MagicFace通过动作单元控制实现高保真的面部表情编辑,结合扩散模型和ID编码器,能够精细调整表情并保持身份和背景一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 2 篇

2401.17629 2025-11-21 cs.CV cs.LG 83%

Spatial-and-Frequency-aware Restoration method for Images based on Diffusion Models

基于扩散模型的图像空间和频率感知修复方法

Kyungsung Lee, Donggyu Lee, Myungjoo Kang

机构 * Department of Mathematical Sciences, Seoul National University(数学科学系,首尔国立大学)

专题命中 图像修复 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出SaFaRI,一种基于扩散模型的图像修复方法,通过同时考虑空间和频率域的数据保真度,实现高质量的图像重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10724 2025-11-21 math.NA cs.NA 50%

Quaternion tensor low rank Quaternion tensor low-rank approximation using a family of non-convex norms

四元数张量低秩 四元数张量低秩近似使用一族非凸范数

Alaeddine Zahir, Ahmed Ratnani, Khalide Jbilou

专题命中 图像修复 :inpainting(abstract)

AI总结 本文提出使用非凸范数对四元数张量进行低秩近似,通过准范数和非凸范数方法提升张量修复和去噪的效率。

Comments 18 pages, 3 figures, 2 tables, 4 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 1 篇

2506.09109 2025-11-21 cs.CV cs.CL 57%

CAIRe: Cultural Attribution of Images by Retrieval-Augmented Evaluation

CAIRe:通过检索增强评估进行图像文化归因

Arnav Yayavaram, Siddharth Yayavaram, Simran Khanuja, Michael Saxon, Graham Neubig

机构 * BITS Pilani(比斯·皮兰大学) Carnegie Mellon University(卡内基梅隆大学) University of California, Santa Barbara(加州大学圣巴巴拉分校)

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

AI总结 CAIRe通过检索增强评估方法,评估图像在不同文化标签下的相关性,有效衡量文化偏见,提升跨文化公平性。

Comments Preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 2 篇

2509.23584 2025-11-21 cs.CV 79%

VividFace: High-Quality and Efficient One-Step Diffusion For Video Face Enhancement

VividFace: 高质量和高效的一步扩散用于视频面部增强

Shulian Zhang, Yong Guo, Long Peng, Ziyang Wang, Ye Chen, Wenbo Li, Xiao Zhang, Yulun Zhang, Jian Chen

机构 * South China University of Technology(华南理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学)) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学) Nanjing University of Science and Technology(南京理工大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV

AI总结 VividFace通过单步扩散框架和联合训练策略,高效提升视频面部增强的高质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16047 2025-11-21 cs.CV 57%

AMS-KV: Adaptive KV Caching in Multi-Scale Visual Autoregressive Transformers

AMS-KV: 多尺度视觉自回归变换器中的自适应KV缓存

Boxun Xu, Yu Wang, Zihu Wang, Peng Li

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

AI总结 AMS-KV通过自适应KV缓存策略提升多尺度视觉自回归变换器的生成质量和效率

详情

展开后加载摘要…

URL PDF HTML 收藏