arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-11-27 至 2025-11-27 共收录 76 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 52 篇

2505.14739 2025-11-27 cs.LG cs.AI 78%

Time Series Similarity Score Functions to Monitor and Interact with the Training and Denoising Process of a Time Series Diffusion Model applied to a Human Activity Recognition Dataset based on IMUs

时间序列相似度评分函数用于监控和与时间序列扩散模型的训练和去噪过程互动,应用于基于IMUs的人体活动识别数据集

Heiko Oppel, Andreas Spilz, Michael Munz

机构 * AI for Sensor Data Analytics Research Group, Ulm University of Applied Sciences(人工智能传感器数据解析研究组,乌尔姆应用科学大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究提出利用时间序列相似度评分函数优化扩散模型的训练过程,以提升生成数据的质量并减少训练时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02954 2025-11-27 cs.LG 78%

IMUDiffusion: A Diffusion Model for Multivariate Time Series Synthetisation for Inertial Motion Capturing Systems

IMUDiffusion:一种用于惯性运动捕捉系统多变量时间序列合成的扩散模型

Heiko Oppel, Michael Munz

机构 * Research Group Biomechatronics Ulm University of Applied Sciences(生物机械学研究组 奥尔姆应用科学大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 IMUDiffusion是一种专为惯性运动捕捉系统设计的扩散模型,通过生成合成数据提升人类活动分类器性能,显著提高宏F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21390 2025-11-27 math.AP 71%

Stationary equation of the relativistic heat diffusion in transparent media having $L^1$--data

相对热扩散的 stationary 方程在具有 $L^1$--数据的透明介质中

Francesco Balducci, Sergio Segura de León

专题命中 扩散模型 :diffusion(title)

AI总结 本文研究了在具有 $L^1$--数据的透明介质中相对热扩散的 stationary 方程的存在性与正则性,提出了解的定义方法并验证了结果与已有研究的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21415 2025-11-27 cs.CV 70%

DiverseVAR: Balancing Diversity and Quality of Next-Scale Visual Autoregressive Models

DiverseVAR: 在不重新训练或微调的情况下提升下一尺度视觉自回归模型的多样性和质量

Mingue Park, Prin Phunyaphibarn, Phillip Y. Lee, Minhyuk Sung

机构 * KAIST(韩国科学技术院)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 DiverseVAR通过在测试时注入文本嵌入噪声和scale-travel技术,提升视觉自回归模型的多样性与图像质量的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20462 2025-11-27 cs.CV cs.LG 70%

STARFlow-V: End-to-End Video Generative Modeling with Normalizing Flows

STARFlow-V:基于归一化流的端到端视频生成模型

Jiatao Gu, Ying Shen, Tianrong Chen, Laurent Dinh, Yuyang Wang, Miguel Angel Bautista, David Berthelot, Josh Susskind, Shuangfei Zhai

机构 * Apple(苹果公司)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 STARFlow-V基于归一化流提出端到端视频生成模型,具备端到端学习、鲁棒因果预测和原生似然估计等优势,实现了高质量自回归视频生成。

Comments 21 pages, 9 figures. Code and samples are available at https://github.com/apple/ml-starflow

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21635 2025-11-27 cs.LG cs.AI cs.CV 57%

Mechanisms of Non-Monotonic Scaling in Vision Transformers

视觉变换器中非单调缩放机制

Anantha Padmanaban Krishna Kumar

机构 * Department of Computer Science, Boston University(计算机科学系,波士顿大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 研究揭示了视觉变换器中深度增加导致性能非单调变化的机制,通过信息混乱指数发现信息扩散与任务性能的权衡关系。

Comments 16 pages total (11 pages main text, 1 pages references, 4 pages appendix), 5 figures, 11 tables. Code available at https://github.com/AnanthaPadmanaban-KrishnaKumar/Cliff-Plateau-Climb

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21113 2025-11-27 cs.CV 57%

FaithFusion: Harmonizing Reconstruction and Generation via Pixel-wise Information Gain

FaithFusion:通过像素级信息增益和谐融合重建与生成

YuAn Wang, Xiaofan Li, Chi Huang, Wenhao Zhang, Hao Li, Bosheng Wang, Xun Sun, Jun Wang

机构 * Baidu Inc.(百度公司) Nanjing University(南京大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 FaithFusion通过像素级信息增益融合3DGS与扩散模型,实现高保真的驾驶场景生成。

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21051 2025-11-27 cs.CV 57%

MUSE: Manipulating Unified Framework for Synthesizing Emotions in Images via Test-Time Optimization

MUSE:通过测试时优化实现图像情感合成的统一框架

Yingjie Xia, Xi Wang, Jinglei Shi, Vicky Kalogeiton, Jian Yang

机构 * VCIP & TMCC & DISSec, College of Computer Science, Nankai University(南开大学计算机学院) LIX, Ecole Polytechnique, IP Paris(巴黎高等理工学院) Key Lab of SCCI, Dalian University of Technology(大连理工大学SCCI重点实验室)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 MUSE通过测试时优化实现图像情感合成的统一框架,解决情感生成与编辑的整合问题,提升情感准确性和语义多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21028 2025-11-27 eess.IV cs.CV 57%

Deep Parameter Interpolation for Scalar Conditioning

深度参数插值用于标量条件化

Chicago Y. Park, Michael T. McCann, Cristina Garcia-Cardona, Brendt Wohlberg, Ulugbek S. Kamilov

机构 * WashU(华盛顿大学) Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室) UW–Madison(威斯康星大学麦迪逊分校)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出深度参数插值方法,通过动态插值实现神经网络对标量输入的条件化,提升去噪和样本质量的同时保持计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20986 2025-11-27 cs.CV 57%

Inversion-Free Style Transfer with Dual Rectified Flows

无反向过程的双修正流风格迁移

Yingying Deng, Xiangyu He, Fan Tang, Weiming Dong, Xucheng Yin

机构 * Department of Computer Science and Technology, University of Science and Technology Beijing(北京科技大学计算机科学与技术系) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出无反向过程的双修正流框架,通过并行预测和动态中点插值实现高效风格迁移,提升视觉保真度和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05613 2025-11-27 cs.CV cs.AI cs.LG 57%

PointNSP: Autoregressive 3D Point Cloud Generation with Next-Scale Level-of-Detail Prediction

PointNSP: 基于下一尺度细节预测的自回归3D点云生成

Ziqiao Meng, Qichao Wang, Zhiyang Dou, Zixing Song, Zhipeng Zhou, Irwin King, Peilin Zhao

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 PointNSP通过多尺度分解和下一尺度预测,实现自回归3D点云生成,首次在该范式中达到最先进的生成质量,并在效率和可扩展性上超越扩散基线。

Comments This work was intended as a replacement of arXiv:2503.08594 and any subsequent updates will appear there

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21949 2025-11-27 cs.CV cs.AI 57%

Contrast-Prior Enhanced Duality for Mask-Free Shadow Removal

对比优先增强双重视角用于无掩码阴影去除

Jiyu Wu, Yifan Liu, Jiancheng Huang, Mingfu Yan, Shifeng Chen

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出AGBA机制和FCFN网络,通过对比优先增强双重视角实现无掩码阴影去除,取得最佳性能。

Comments There are unresolved authorship disputes related to this submission, and the current version does not reflect an agreed authorship list

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21584 2025-11-27 cs.RO cs.AI 50%

Model-Based Policy Adaptation for Closed-Loop End-to-End Autonomous Driving

基于模型的策略适应用于闭环端到端自动驾驶

Haohong Lin, Yunzhi Zhang, Wenhao Ding, Jiajun Wu, Ding Zhao

机构 * CMU(卡内基梅隆大学) Stanford(斯坦福大学) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于模型的策略适应框架,通过生成反事实轨迹和训练Q值模型提升自动驾驶在闭环环境中的鲁棒性和安全性。

Comments Published at NeurIPS 2025: https://openreview.net/forum?id=4OLbpaTKJe

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21335 2025-11-27 cs.LG 50%

TSGM: Regular and Irregular Time-series Generation using Score-based Generative Models

TSGM: 使用基于分数的生成模型进行规则和不规则时间序列生成

Haksoo Lim, Jaehoon Lee, Sewon Park, Minjung Kim, Noseong Park

机构 * LG AI Research(LG人工智能研究)

专题命中 扩散模型 :image generation(abstract)

AI总结 本文提出TSGM模型,通过条件分数网络和定制的去噪分数匹配损失,实现规则和不规则时间序列的高质量生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21230 2025-11-27 math.AP 50%

Curvature-driven pattern formation in biomembranes: A gradient flow approach

生物膜中由曲率驱动的图案形成:一种梯度流方法

Patrik Knopf, Anastasija Pešić, Dennis Trautwein

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种基于梯度流的相场模型,用于研究生物膜中由曲率驱动的图案形成,通过数值实验展示了不同参数对膜图案的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20896 2025-11-27 cond-mat.mtrl-sci 50%

Photo-induced carrier dynamics in InSb probed with broadband THz spectroscopy based on BNA crystals

基于BNA晶体的宽带THz光谱对InSb中光诱导载流子动力学的探测

Elodie Iglesis, Alexandr Alekhin, Maximilien Cazayous, Alain Sacuto, Yann Gallais, Sarah Houver

专题命中 扩散模型 :diffusion(abstract)

AI总结 利用BNA晶体宽带THz光谱研究InSb中光诱导载流子动力学,提取载流子密度随时间变化并分析扩散长度与穿透深度差异。

Comments 10 pages, 6 figures, 32 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20869 2025-11-27 stat.ME 50%

Closure Term Estimation in Spatiotemporal Models of Dynamical Systems

时空动力系统模型中的闭合项估计

Eric Crislip, Mohammad Khalil, Teresa Portone, Oksana Chkrebtii, Kyle Neal

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种高效且能处理稀疏观测和噪声的闭合项估计方法,用于时空动力系统模型,提供不确定性量化并验证了其在反应扩散和对流扩散方程中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20863 2025-11-27 physics.chem-ph 50%

Bridging Atomistic and Mesoscale Lithium Transport via Machine-Learned Force Fields and Markov State Models

通过机器学习力场和马尔可夫状态模型桥接原子尺度和介观尺度的锂传输

Muhammad Nawaz Qaisrani, Christoph Kirsch, Aaron Flötotto, Jonas Hänseroth, Jules Oumard, Daniel Sebastiani, Christian Dreßler

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过机器学习力场和马尔可夫状态模型,建立原子尺度与介观尺度锂传输的定量联系,揭示稀有扩散过程和传输路径。

Comments 36 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20835 2025-11-27 q-bio.NC cs.HC 50%

Symbiotic Brain-Machine Drawing via Visual Brain-Computer Interfaces

通过视觉脑机接口实现共生式脑机绘画

Gao Wang, Yingying Huang, Lars Muckli, Daniele Faccio

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种非侵入性脑机接口,利用视觉刺激和SSVEPs实现思维绘画,通过共生式人机交互显著提升BCI比特率,为AI增强型BCI的发展提供平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20416 2025-11-27 math.PR cs.SY eess.SY math.DS stat.CO 50%

Nonuniform-Grid Markov Chain Approximation of Continuous Processes with Time-Linear Moments

非均匀网格马尔可夫链对具有时间线性矩的连续过程的近似

Do Hyun Kim, Ahmet Cetinkaya

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种非均匀网格马尔可夫链方法,用于近似具有时间线性矩的连续过程,通过精确匹配一阶和二阶矩实现高效模拟与分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19459 2025-11-27 physics.soc-ph 50%

Constructing a Unified Model of Community Formation in Community-Supported Agriculture: Insights from Consumer and Producer Pathways in Japan

构建社区支持农业中社区形成的统一模型:来自日本消费者和生产者路径的见解

Sota Takagi, Miki Saijo, Takumi Ohashi

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种六阶段的CSA社区形成模型,通过整合消费者和生产者的路径,揭示了其在社区支持农业中的互动机制与持续发展的关键因素。

Comments 47 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12975 2025-11-27 cs.LG stat.ML 50%

A Connection Between Score Matching and Local Intrinsic Dimension

从分数匹配到局部内在维度的一种联系

Eric Yeats, Aaron Jacobson, Darryl Hannan, Yiran Jia, Timothy Doster, Henry Kvinge, Scott Mahan

机构 * PNNL(太平洋西北国家实验室) UNC Chapel Hill(北卡罗来纳大学教堂山分校) UC San Diego(圣地亚哥大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出利用去噪分数匹配损失作为局部内在维度估计器,通过理论分析和实验验证其在高维数据中的有效性与可扩展性。

Comments Accepted to the 3rd SPIGM Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14572 2025-11-27 astro-ph.GA astro-ph.SR 50%

Metallicity fluctuation statistics in the interstellar medium and young stars -- II. Elemental cross-correlations and the structure of chemical abundance space

银河际介质和年轻恒星中的金属度波动统计——II. 元素交叉相关性及化学丰度空间的结构

Mark R. Krumholz, Yuan-Sen Ting, Zefeng Li, Chuhan Zhang, Jennifer Mead, Melissa K. Ness

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文扩展了随机驱动扩散模型,用于解释多元素丰度相关性,并预测气体和年轻恒星中的相关程度,揭示了元素相关性的控制因素。

Comments Published in OJAp; 22 pages, 7 figures

Journal ref Open Journal of Astrophysics, vol. 8, 26 November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17680 2025-11-27 astro-ph.CO gr-qc hep-ph hep-th 50%

Time-reversed Stochastic Inflation

反向随机膨胀

Baptiste Blachier, Christophe Ringeval

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出反向随机膨胀方法,通过反向福克-普朗克方程非微扰地推导量子时期内场值的概率分布,并推导出曲率涨落的新精确公式。

Comments 34 pages, 7 figures, uses jcappub. Discussions added, matches published version

Journal ref JCAP 2511:032,2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04876 2025-11-27 physics.comp-ph cond-mat.mtrl-sci physics.chem-ph 50%

Modelling complex proton transport phenomena -- Exploring the limits of fine-tuning and transferability of foundational machine-learned force fields

复杂质子传输现象建模——探索基础机器学习力场的微调和可迁移性极限

Malte Grunert, Max Großmann, Jonas Hänseroth, Aaron Flötotto, Jules Oumard, Johannes Laurenz Wolf, Erich Runge, Christian Dreßler

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究利用MACE力场模拟固体酸的质子传输,通过微调和多纳秒级MD模拟,实现了与实验数据一致的扩散系数和活化能结果。

Journal ref The Journal of Physical Chemistry C 2025 129 (21), 9662-9669

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04619 2025-11-27 cs.LG stat.ML 50%

CTSyn: A Foundation Model for Cross Tabular Data Generation

CTSyn:跨表格数据生成的基准模型

Xiaofeng Lin, Chenheng Xu, Matthew Yang, Guang Cheng

机构 * Department of Statistics and Data Science, University of California Los Angeles(统计与数据科学系,加州大学洛杉矶分校) Department of Computer Science, University of California Los Angeles(计算机科学系,加州大学洛杉矶分校)

专题命中 扩散模型 :diffusion(abstract)

AI总结 CTSyn提出了一种基于扩散的生成性基准模型,用于跨表格数据生成,通过统一潜在空间和条件潜在扩散模型提升表格合成的实用性和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13348 2025-11-27 q-bio.MN math.DS math.PR 50%

On the reduction of stochastic chemical reaction networks

关于随机化学反应网络的简化

Justin Eilertsen, Wylie Stroberg

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了随机化学反应网络中线性噪声近似的简化方法,探讨了特征值差异对慢流形投影准确性的影響,并提出了更一般的理论框架。

Comments 9 Figures, 38 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.06097 2025-11-27 math.PR 50%

Feynman-Kac formula for BSDEs with jumps and time delayed generators associated to path-dependent nonlinear Kolmogorov equations

具有跳跃和时间延迟生成函数的BSDEs的Feynman-Kac公式及与路径依赖非线性柯尔莫戈罗夫方程的相关性

Luca Di Persio, Matteo Garbelli, Adrian Zălinescu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种将具有跳跃和时间延迟生成函数的BSDEs解与路径依赖非线性柯尔莫戈罗夫方程解关联的非线性Feynman-Kac公式,并应用于研究大型投资者问题的扩展。

Journal ref Nonlinear Differential Equations and Applications NoDEA 30, no. 6 (2023): 72

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 8 篇

2511.21691 2025-11-27 cs.CV 85%

Canvas-to-Image: Compositional Image Generation with Multimodal Controls

画布到图像:利用多模态控制的组合图像生成

Yusuf Dalva, Guocheng Gordon Qian, Maya Goldenberg, Tsai-Shien Chen, Kfir Aberman, Sergey Tulyakov, Pinar Yanardag, Kuan-Chieh Jackson Wang

机构 * Snap Inc. UC Merced(加州大学默塞德分校) Virginia Tech(弗吉尼亚理工大学)

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 Canvas-to-Image通过统一框架整合多模态控制,提升图像生成的组合性和控制精度。

Comments 24 pages; webpage: https://snap-research.github.io/canvas-to-image/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21129 2025-11-27 cs.CV cs.GR 81%

CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion

通过统一多模态视频扩散实现可控视频生成

Dianbing Xi, Jiepeng Wang, Yuanzhi Liang, Xi Qiu, Jialun Liu, Hao Pan, Yuchi Huo, Rui Wang, Haibin Huang, Chi Zhang, Xuelong Li

机构 * State Key Laboratory of CAD&CG(计算机辅助设计与图形学国家重点实验室) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院) Tsinghua University(清华大学)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV、cs.GR

AI总结 CtrlVDiff通过统一多模态视频扩散模型,实现可控视频生成,支持多模态输入并提升生成的可控性和保真度。

Comments 27 pages, 18 figures, 9 tables. Project page: https://tele-ai.github.io/CtrlVDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏