arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-04 至 2025-12-04 共收录 68 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 45 篇

2512.03185 2025-12-04 math.AP math-ph math.MP 78%

Nonlinear diffusion limit of non-local interactions on a sphere

球面上非局部相互作用的非线性扩散极限

Mark A. Peletier, Anna Shalova

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了球面上非局部相互作用的非线性扩散极限,通过变分与谐分析方法证明了解收敛于具有渗流型扩散项的方程,并探讨了其在变压器模型中的应用。

Comments 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03127 2025-12-04 cs.LG cs.AI physics.chem-ph 78%

Atomic Diffusion Models for Small Molecule Structure Elucidation from NMR Spectra

原子扩散模型用于从NMR谱解析小分子结构

Ziyu Xiong, Yichi Zhang, Foyez Alauddin, Chu Xin Cheng, Joon Soo An, Mohammad R. Seyedsayamdost, Ellen D. Zhong

机构 * Princeton University(普林斯顿大学) California Institute of Technology(加州理工学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 ChefNMR通过原子扩散模型从NMR光谱直接预测小分子结构,实现高精度自动解析。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01214 2025-12-04 physics.geo-ph 78%

Diffusion Models Bridge Deep Learning and Physics in ENSO Forecasting

扩散模型将深度学习与物理在ENSO预测中结合

Weifeng Xu, Xiang Zhu, Xiaoyong Li, Qiang Yao, Xiaoli Ren, Kefeng Deng, Song Wu, Chengcheng Shao, Xiaolong Xu, Juan Zhao, Chengwu Zhao, Jianping Cao, Jingnan Wang, Wuxin Wang, Qixiu Li, Xiaori Gao, Xinrong Wu, Huizan Wang, Xiaoqun Cao, Weiming Zhang, Junqiang Song, Kaijun Ren

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出基于条件扩散模型的ENSO预测方法,通过高阶马尔可夫链构建概率映射,量化不确定性并提升预测能力,揭示反向扩散过程与充电-放电机制的联系,为ENSO预测提供新的理论框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22501 2025-12-04 cs.SI cs.IT math.IT math.OC 78%

A Novel Discrete-time Model of Information Diffusion on Social Networks Considering Users Behavior

一种考虑用户行为的社交网络信息扩散离散时间模型

Tran Van Khanh, Do Xuan Cho, Hoang Phi Dung

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出SDIR模型,通过引入延迟状态来更精确地描述社交网络中用户的信息扩散行为,并设计算法优化信息扩散的传播效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18603 2025-12-04 cs.LG 78%

Demystify Protein Generation with Hierarchical Conditional Diffusion Models

通过分层条件扩散模型解开蛋白质生成之谜

Zinan Ling, Yi Shi, Brett McKinney, Da Yan, Yang Zhou, Bo Hui

机构 * University of Tulsa(塔尔萨大学) Johns Hopkins University(约翰霍普金斯大学) Indiana University Bloomington(印第安纳大学布卢明顿分校) Auburn University(阿伯茨维尔大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种分层条件扩散模型,整合序列和结构信息,以高效生成功能导向的蛋白质,并引入新的评估指标评估生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25127 2025-12-04 cs.CV cs.AI cs.LG 77%

Score Distillation of Flow Matching Models

流匹配模型的分数蒸馏

Mingyuan Zhou, Yi Gu, Huangjie Zheng, Liangchen Song, Guande He, Yizhe Zhang, Wenze Hu, Yinfei Yang

机构 * Apple(苹果公司)

专题命中 扩散模型 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出了一种适用于文本到图像流匹配模型的分数蒸馏方法,通过统一高斯扩散和流匹配模型,实现了高效的生成加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03683 2025-12-04 cs.CV 70%

GaussianBlender: Instant Stylization of 3D Gaussians with Disentangled Latent Spaces

GaussianBlender: 通过解耦潜在空间实现3D高斯体的即时风格化

Melis Ocal, Xiaoyan Xing, Yue Li, Ngo Anh Vien, Sezer Karaoglu, Theo Gevers

机构 * University of Amsterdam(阿姆斯特丹大学) Bosch Center for AI(博世人工智能中心)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 GaussianBlender通过解耦潜在空间实现文本驱动的3D风格化,提供即时高保真风格化并超越传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18084 2025-12-04 cs.CV cs.RO 70%

DynamicCity: Large-Scale 4D Occupancy Generation from Dynamic Scenes

DynamicCity: 从动态场景生成大规模4D占用图

Hengwei Bian, Lingdong Kong, Haozhe Xie, Liang Pan, Yu Qiao, Ziwei Liu

机构 * WorldBench Team(WorldBench团队)

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 DynamicCity通过VAE和DiT模型生成高质量动态4D占用图,提升拟合质量与训练效率。

Comments ICLR 2025 Spotlight; 35 pages, 18 figures, 15 tables; Project Page at https://dynamic-city.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02933 2025-12-04 cs.CV 70%

LoVoRA: Text-guided and Mask-free Video Object Removal and Addition with Learnable Object-aware Localization

LoVoRA: 基于文本引导和无掩码的视频对象移除与添加方法

Zhihan Xiao, Lin Liu, Yixin Gao, Xiaopeng Zhang, Haoxuan Che, Songping Mai, Qi Tian

机构 * Tsinghua University(清华大学) Huawei Inc.(华为公司) University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 LoVoRA通过可学习的对象感知定位机制实现无掩码的视频对象移除与添加,结合图像到视频转换和光流传播,实现端到端视频编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03453 2025-12-04 cs.CV 57%

GeoVideo: Introducing Geometric Regularization into Video Generation Model

GeoVideo: 在视频生成模型中引入几何正则化

Yunpeng Bai, Shaoheng Fang, Chaohui Yu, Fan Wang, Qixing Huang

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) DAMO Academy, Alibaba Group(阿里云达摩院) Hupan Lab(鸿篇实验室)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 GeoVideo通过引入几何正则化损失,提升视频生成的时空一致性和几何结构合理性。

Comments Project Page: https://geovideo.github.io/GeoVideo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03404 2025-12-04 cs.CV 57%

MOS: Mitigating Optical-SAR Modality Gap for Cross-Modal Ship Re-Identification

MOS:缓解光学-合成孔径雷达模态差距以实现跨模态舰船重识别

Yujian Zhao, Hankun Liu, Guanglin Niu

机构 * School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 MOS通过模态一致表示学习和跨模态数据生成与融合,有效缓解光学与SAR图像间的模态差距,提升舰船跨模态重识别的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04003 2025-12-04 math.NA cs.NA 50%

Mixed finite element approximation for non-divergence form elliptic equations with random input data

非散度形式椭圆方程的混合有限元近似

Amireh Mousavi

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种混合型连续有限元方法,结合插值离散化,用于非散度形式椭圆方程的随机输入数据近似,并建立了误差界和数值验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03974 2025-12-04 physics.comp-ph cs.LG 50%

Refining Machine Learning Potentials through Thermodynamic Theory of Phase Transitions

通过相变热力学理论精炼机器学习势

Paul Fuchs, Julija Zavadlav

机构 * Multiscale Modeling of Fluid Materials, Technical University of Munich(流体材料多尺度建模,慕尼黑技术大学) Atomistic Modeling Center, Munich Data Science Institute, Technical University of Munich(原子建模中心,慕尼黑数据科学研究所,慕尼黑技术大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出通过自顶向下学习方法微调机器学习势,以提高相变温度预测的准确性,适用于多组分系统和多种相变类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03937 2025-12-04 cs.SI 50%

DSP: A Statistically-Principled Structural Polarization Measure

DSP:一种基于统计原理的结构极化度量

Giulia Preti, Matteo Riondato, Aristides Gionis, Gianmarco De Francisci Morales

专题命中 扩散模型 :diffusion(abstract)

AI总结 DSP通过基于扩散的结构极化度量,纠正现有极化度量的偏差,提供可靠且可解释的诊断工具,揭示社会极化趋势。

Comments Accepted for publication at ACM WSDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00068 2025-12-04 physics.flu-dyn 50%

A Geometric Foundation for the Universal Laws of Turbulence

湍流通用定律的几何基础

Marcial Sanchis-Agudo, Ricardo Vinuesa

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于几何方法的湍流理论框架,通过随机示踪剂和Schrödinger Bridge原理推导出Kolmogorov尺度和壁面定律,揭示湍流尺度律的物理基础。

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14206 2025-12-04 cs.LG cs.AI 50%

Challenges and Limitations of Generative AI in Synthesizing Wearable Sensor Data

生成式AI在合成可穿戴传感器数据中的挑战与局限性

Flavio Di Martino, Franca Delmastro

机构 * Institute for Informatics and Telematics of the Nationa Research Council (IIT-CNR)(意大利国家研究 council 信息与电信研究所)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文探讨了生成式AI在合成可穿戴传感器数据中的挑战与局限,评估了现有模型在多模态处理、长依赖性和条件生成方面的不足,并提出了未来研究方向以提升生成模型的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03426 2025-12-04 physics.chem-ph cond-mat.mtrl-sci 50%

Zero-Waste Biorefinery: Pyrolysis of Fermentation Residues into Catalytic Biochar for Circular Biohydrogen Systems

零浪费生物炼油:将发酵残渣通过热解转化为催化性生物炭用于循环生物氢系统

Muhammad Shahzaib

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究通过热解发酵残渣制备催化性生物炭,提升生物氢生产效率,实现废物资源化和循环经济发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03375 2025-12-04 cs.LG 50%

MAGE-ID: A Multimodal Generative Framework for Intrusion Detection Systems

MAGE-ID:一种多模态生成框架用于入侵检测系统

Mahdi Arab Loodaricheh, Mohammad Hossein Manshaei, Anita Raja

机构 * Department of Computer Science, Hunter College and The Graduate Center, City University of New York(计算机科学系,亨特学院和研究生中心,纽约市立大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 MAGE-ID通过多模态生成框架提升入侵检测系统的数据增强效果,实现更平衡和一致的多模态合成,显著提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03365 2025-12-04 cond-mat.mtrl-sci physics.comp-ph 50%

Generative Refinement:A New Paradigm for Determining Single Crystal Structures Directly from HKL Data

生成细化:一种直接从HKL数据确定单晶结构的新范式

Wen-Lin Luo, Yi Yuan, Cheng-Hui Li, Yue Zhao, Jing-Lin Zuo

专题命中 扩散模型 :diffusion(abstract)

AI总结 RefrActor通过端到端深度学习框架直接从HKL数据确定单晶结构,实现无需人工干预的自动精修。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03265 2025-12-04 math.AP 50%

Large-time behavior in a nonlocal heat equation with absorption. The absorption dominated case with fast decaying initial data

非局部热方程中大时间行为研究:吸收主导情况与快速衰减初始数据

Carmen Cortázar, Fernando Quirós, Noemi Wolanski

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了非局部热方程在吸收主导情况下的大时间行为,证明了在不同初始条件下的衰减率和极限解特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03243 2025-12-04 stat.ML cs.LG math.PR math.ST stat.TH 50%

Novelty detection on path space

路径空间上的新颖性检测

Ioannis Gasteratos, Antoine Jacquier, Maud Lemercier, Terry Lyons, Cristopher Salvi

机构 * Institute of Mathematics TU Berlin(柏林技术大学数学研究所) Department of Mathematics Imperial College London(伦敦帝国理工学院数学系) Mathematical Institute University of Oxford(牛津大学数学研究所)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于签名的检验统计量用于路径空间新颖性检测,通过运输成本不等式和洗牌积推导出CVaR替代公式,并设计新的单类SVM算法,评估了其在异常扩散和分子生物学数据中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03205 2025-12-04 math-ph math.MP 50%

A discontinuous Galerkin approach for simulating graphene-based electron devices via the Boltzmann transport equation

基于玻色-爱因斯坦传输方程的不连续伽辽金方法用于模拟基于石墨烯的电子器件

Giovanni Nastasi, Vittorio Romano

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于玻色-爱因斯坦传输方程的不连续伽辽金方法,用于模拟基于石墨烯的电子器件,以提高模拟精度和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03095 2025-12-04 cs.SI cs.AI 50%

Community Quality and Influence Maximization: An Empirical Study

社区质量和影响力最大化:一项实证研究

Motaz Ben Hassine

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了社区质量对影响力最大化的影响,提出了一种基于高质量社区结构的种子选择方法,实验证明高质量社区能显著提升信息扩散效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03090 2025-12-04 physics.chem-ph 50%

Digital Surfactant

数字表面活性剂

Sayeedul I. Sheikh, V. Subhasree Navya, Riya Sharma, Sudip Roy, Jayant K. Singh

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了基于图扩散和变压器的两种模型在生成非离子型表面活性剂中的性能,发现逆设计模型生成多样性更好,而变压器更擅长满足属性约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21951 2025-12-04 eess.SY cs.SY 50%

Pricing Problems in Adoption of New Technologies

新技术采纳中的定价问题

Yijin Wang, Subhonmesh Bose

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种考虑价格影响的离散时间 Bass 扩散模型,研究了垄断者在有限时间内的最优定价策略以及政策制定者与垄断者之间的斯塔克尔伯格博弈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17478 2025-12-04 cs.LG cs.AI physics.bio-ph q-bio.BM q-bio.QM 50%

ConfRover: Simultaneous Modeling of Protein Conformation and Dynamics via Autoregression

ConfRover:通过自回归方法同时建模蛋白质构象与动力学

Yuning Shen, Lihao Wang, Huizhuo Yuan, Yan Wang, Bangji Yang, Quanquan Gu

机构 * ByteDance Seed(字节跳动种子基金) School of Mathematical Sciences, Tongji University(同济大学数学科学学院) Department of Automation, Tsinghua University(清华大学自动化系)

专题命中 扩散模型 :diffusion(abstract)

AI总结 ConfRover通过自回归方法同时建模蛋白质构象与动力学,支持时间依赖和时间无关的采样,首次在单一框架内实现蛋白质构象和轨迹的生成。

Comments 35 pages, 17 figures; Camera ready for NeurIPS 2025; Website: https://bytedance-seed.github.io/ConfRover

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 3 篇

2512.03510 2025-12-04 cs.CV cs.RO 57%

CSMapping: Scalable Crowdsourced Semantic Mapping and Topology Inference for Autonomous Driving

CSMapping: 可扩展的众包语义制图与拓扑推断用于自动驾驶

Zhijian Qiao, Zehuan Yu, Tong Li, Chih-Chung Chou, Wenchao Ding, Shaojie Shen

机构 * the Department of Electronic and Computer Engineering, the Hong Kong University of Science and Technology, Hong Kong, China(电子与计算机工程系,香港科技大学,香港,中国) the Academy for Engineering and Technology, Fudan University, Shanghai, China(工程与技术学院,复旦大学,上海,中国) Zhuoyu Technology Co., Ltd., Shenzhen, China(珠海优创科技有限公司,深圳,中国)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 CSMapping通过潜在扩散模型和拓扑优化方法,实现高质量的语义地图和道路中心线生成,适用于自动驾驶场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03345 2025-12-04 cs.CV cs.AI 57%

HalluGen: Synthesizing Realistic and Controllable Hallucinations for Evaluating Image Restoration

HalluGen: 合成逼真且可控的幻觉以评估图像修复

Seunghoi Kim, Henry F. J. Tregidgo, Chen Jin, Matteo Figini, Daniel C. Alexander

机构 * Hawkes Institute, UCL(UCL哈维斯研究所) Dept. of Medical Physics and Biomedical Engineering, UCL(UCL医学物理与生物医学工程系) Dept. of Computer Science, UCL(UCL计算机科学系) Centre for AI, DS&AI, AstraZeneca, UK(阿斯利康AI中心)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 HalluGen 通过合成逼真可控的幻觉,构建首个大规模幻觉数据集,用于评估图像修复中的幻觉检测与缓解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03361 2025-12-04 cs.CR cs.IT math.IT 50%

Rethinking Security in Semantic Communication: Latent Manipulation as a New Threat

重新思考语义通信中的安全问题:潜在操纵作为新的威胁

Zhiyuan Xi, Kun Zhu

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出两种攻击方法,揭示语义通信中潜在空间的安全漏洞,通过操纵潜在表示来改变传输语义,且不易被检测。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 3 篇

2512.03964 2025-12-04 cs.CV 57%

Training for Identity, Inference for Controllability: A Unified Approach to Tuning-Free Face Personalization

面向身份与可控性的训练:一种无需调优的面部个性化统一方法

Lianyu Pang, Ji Zhou, Qiping Wang, Baoquan Zhao, Zhenguo Yang, Qing Li, Xudong Mao

机构 * Sun Yat-sen University(中山大学) East China Normal University(华东师范大学) Guangdong University of Technology(广东工业大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 UniID提出了一种无需调优的面部个性化统一方法,通过整合文本嵌入和适配器方法,实现高保真身份和灵活文本可控性。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏