arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-03 至 2026-02-03 共收录 167 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 115 篇

2602.01232 2026-02-03 cs.SI cs.DS 50%

Profit Maximization in Closed Social Networks

封闭社交网络中的利润最大化

Poonam Sharma, Suman Banerjee

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了封闭社交网络中的利润最大化问题,提出两种解决方案以提高利润收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00960 2026-02-03 cs.LG cs.AI cs.CE stat.CO stat.ML 50%

Multimodal Scientific Learning Beyond Diffusions and Flows

多模态科学学习超越扩散与流

Leonardo Ferreira Guilhoto, Akshat Kaushal, Paris Perdikaris

机构 * Graduate Group in Applied Mathematics and Computational Science(应用数学与计算科学联合研究生组) Department of Computer and Information Science(计算机与信息科学系) Department of Mechanical Engineering and Applied Mechanics(机械工程与应用力学系)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出混合密度网络作为多模态科学学习中更高效、更稳定的替代方法,实现对科学问题中多模态不确定性的有效建模与解决。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00875 2026-02-03 math.PR 50%

Long term convergence rate of Smoluchowski-Kramers approximation by Stein's method

Smoluchowski-Kramers近似长期收敛速率的Stein方法研究

Shiyu Liu, Wei Liu, Lihu Xu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文利用Stein方法研究Smoluchowski-Kramers近似的长期收敛速率,证明了小质量极限下的收敛速率与质量m的平方根和对数相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15039 2026-02-03 cs.RO 50%

CADGrasp: Learning Contact and Collision Aware General Dexterous Grasping in Cluttered Scenes

CADGrasp: 学习接触和碰撞感知的通用灵巧抓取在杂乱场景中

Jiyao Zhang, Zhiyuan Ma, Tianhao Wu, Zeyuan Chen, Hao Dong

机构 * Center on Frontiers of Computing Studies, School of Computer Science, Peking University(前沿计算研究中心,计算机学院,北京大学) National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家级重点实验室,计算机学院,北京大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 CADGrasp通过两阶段算法实现接触和碰撞感知的灵巧抓取,利用点云输入预测稀疏IBS表示,并结合占用扩散模型和能量函数优化,提升在杂乱场景中的抓取成功率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00452 2026-02-03 cs.LG 50%

Imitation from Observations with Trajectory-Level Generative Embeddings

通过轨迹级生成嵌入进行观察模仿学习

Yongtao Qu, Shangzhe Li, Weitong Zhang

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 扩散模型 :diffusion(abstract)

AI总结 TGE通过轨迹级生成嵌入解决离线模仿学习中专家数据稀缺的问题,利用时序扩散模型构建平滑奖励,提升离线数据与专家行为间的学习信号。

Comments 25 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18946 2026-02-03 hep-ph hep-ex hep-th nucl-ex nucl-th 50%

Soret and Dufour effects in hot and dense QCD matter

Soret和Dufour效应在高温高密度QCD物质中的作用

Kamaljeet Singh, Kangkan Goswami, Raghunath Sahoo

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究首次在高温高密度QCD物质中利用第一性原理方法探讨Soret和Dufour效应,通过输运方程推导相关系数并应用于重离子碰撞模型。

Comments Same as the published version in Phys. Rev. D

Journal ref Physical Review D 113, 014040 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16382 2026-02-03 quant-ph 50%

Parrondo paradox in quantum image encryption

量子图像加密中的帕尔伦多悖论

Łukasz Pawela

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于离散时间量子行走的量子图像加密方案,利用帕尔伦多悖论提升加密性能,实现高熵和低相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11818 2026-02-03 cs.LG 50%

SynCoGen: Synthesizable 3D Molecule Generation via Joint Reaction and Coordinate Modeling

SynCoGen: 通过联合反应和坐标建模实现可合成的3D分子生成

Andrei Rekesh, Miruna Cretu, Dmytro Shevchuk, Vignesh Ram Somnath, Pietro Liò, Robert A. Batey, Mike Tyers, Michał Koziarski, Cheng-Hao Liu

机构 * University of Toronto(多伦多大学) The Hospital for Sick Children(多伦多儿童医院) University of Cambridge(剑桥大学) ETH Zürich(苏黎世联邦理工学院) Vector Institute(向量研究所) Mila – Quebec AI Institute(魁北克AI研究所) McGill University(麦吉尔大学) Caltech(加州理工学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 SynCoGen通过联合反应和坐标建模实现可合成的3D分子生成,实现了分子构建块、化学反应和原子坐标的联合分布采样,在无条件小分子生成和药物发现中表现出色。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24061 2026-02-03 cs.LG 50%

Measure gradients, not activations! Enhancing neuronal activity in deep reinforcement learning

测量梯度,而非激活!增强深度强化学习中的神经元活动

Jiashun Liu, Zihao Wu, Johan Obando-Ceron, Pablo Samuel Castro, Aaron Courville, Ling Pan

机构 * Hong Kong University of Science and Technology(香港科技大学) Mila - Québec AI Institute(魁北克AI研究所) Université de Montréal(蒙特利尔大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出GraMa用于衡量深度强化学习中神经元的学习能力,通过梯度而非激活来增强神经元活动,提升学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11817 2026-02-03 cond-mat.mtrl-sci cond-mat.soft 50%

How glass breaks -- Damage explains the difference between surface and fracture energies in amorphous silica

玻璃是如何破裂的--损伤解释了非晶硅中表面能和断裂能之间的差异

Gergely Molnár, Etienne Barthel

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过多尺度模拟揭示非晶硅中表面能与断裂能差异的机制,结合分子动力学与相场方法量化能量贡献,阐明脆性断裂机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.00471 2026-02-03 math.DG math.AP 50%

Global existence and full convergence of the Möbius-invariant Willmore flow in the $3$-sphere

在3球面中Möbius不变Willmore流的全局存在性和完全收敛性

Ruben Jakob

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了Möbius不变Willmore流在3球面中的全局存在性和完全收敛性,证明了其在特定条件下对初始浸入的小扰动稳定性。

Journal ref The Journal of Geometric Analysis, Volume 34, no. 1, Article 24, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00357 2026-02-03 cs.LG 50%

Planning with Language and Generative Models: Toward General Reward-Guided Wireless Network Design

基于语言和生成模型的规划:迈向通用奖励引导的无线网络设计

Chenyang Yuan, Xiaoyuan Cheng

机构 * University of Sheffield(谢菲尔德大学) University College London(伦敦大学学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于统一奖励函数的扩散生成模型,用于高效解决室内无线网络接入点部署问题,通过大规模数据训练提升泛化能力与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00199 2026-02-03 cs.LG 50%

Reducing Memorisation in Generative Models via Riemannian Bayesian Inference

通过黎曼贝叶斯推断减少生成模型中的记忆化

Johanna Marie Gegenfurtner, Albert Kjøller Jacobsen, Naima Elosegui Borras, Alejandro Valverde Mahou, Georgios Arvanitidis

机构 * Department of Applied Mathematics(应用数学系) Computer Science, Technical University of Denmark(计算机科学,丹麦技术大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过黎曼贝叶斯推断减少生成模型中的记忆化,提升模型的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00143 2026-02-03 q-bio.QM cs.LG stat.ML 50%

Early warning prediction: Onsager-Machlup vs Schrödinger

早期预警预测:Onsager-Machlup与Schrödinger

Xiaoai Xu, Yixuan Zhou, Xiang Zhou, Jingqiao Duan, Ting Gao

机构 * School of Mathematics and Information Science, Guangzhou University(广州大学数学与信息科学学院) School of Sciences, Great Bay University(大亚湾大学科学学院) Guangdong Provincial Key Laboratory of Mathematical and Neural Dynamical Systems, Great Bay University(广东省数学与神经动力系统重点实验室) School of Mathematics and Statistics, Huazhong University of Science and Technology(华中科技大学数学与统计学院) Center for Mathematical Science, Huazhong University of Science and Technology(华中科技大学数学科学中心) Department of Mathematics, City University of Hong Kong(香港城市大学数学系)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种结合流形学习与随机动力学系统建模的早期预警框架,通过Schrödinger桥理论定义新指标,提升癫痫预测的灵敏度和鲁棒性。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00090 2026-02-03 econ.GN math.PR q-fin.EC 50%

Stochastic bifurcation in economic growth model driven by Lévy noise

经济成长模型中由莱维噪声驱动的随机分岔

Almaz Abebe, Shenglan Yuanb, Daniel Tesfay, James Brannan

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过引入莱维噪声改进经济成长模型,研究随机波动对经济增长的影响,揭示跳跃扩散过程在长期GDP波动中的作用,并通过数值模拟展示随机噪声导致经济分岔的机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00057 2026-02-03 q-bio.NC cs.AI cs.LG 50%

Explore Brain-Inspired Machine Intelligence for Connecting Dots on Graphs Through Holographic Blueprint of Oscillatory Synchronization

探索脑启发式机器智能:通过振荡同步的全息蓝图连接图中的点

Tingting Dan, Jiaqi Ding, Guorong Wu

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出HoloGraph框架,通过振荡同步机制改进图神经网络,解决过平滑问题并提升图推理能力。

Comments Published in Nature Communications

Journal ref Nature Communications 16, 9425 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18579 2026-02-03 cond-mat.mtrl-sci physics.comp-ph 50%

Stability Criteria and Optoelectronic Properties of Mg3ZBr3 (Z = As, Sb, Bi) Perovskites for Evaluating the Performance in PIN Photo Diode

Mg3ZBr3 (Z = As, Sb, Bi) 钙钛矿的稳定性准则与光电性质用于评估PIN光电二极管的性能

Md Mohiuddin, Mohammed Mehedi Hasan, Alamgir Kabir

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究Mg3ZBr3(Z=As,Sb,Bi)钙钛矿的稳定性及光电性质,发现其具有良好的带隙和介电响应,适用于无铅光电二极管应用。

Comments This manuscript has been submitted to ACS Energy Materials for possible publication

Journal ref ACS Omega 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00647 2026-02-03 cs.LG 50%

Cooperative Sheaf Neural Networks

协同sheaf神经网络

André Ribeiro, Ana Luiza Tenório, Juan Belieni, Amauri H. Souza, Diego Mesquita

机构 * Getulio Vargas Foundation(戈利亚沃斯基金会) Federal Institute of Ceará(塞阿拉联邦理工学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出协同sheaf神经网络,通过引入cellular sheaves概念,解决sheaf扩散中缺乏信息方向性导致无法实现协同行为的问题,并在实验中展示了更好的性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 6 篇

2602.01905 2026-02-03 cs.CV cs.AI cs.LG 57%

Learning Sparse Visual Representations via Spatial-Semantic Factorization

通过空间-语义分解学习稀疏视觉表示

Theodore Zhengde Zhao, Sid Kiblawi, Jianwei Yang, Naoto Usuyama, Reuben Tan, Noel C Codella, Tristan Naumann, Hoifung Poon, Mu Wei

机构 * Microsoft(微软)

专题命中 可控生成 :generative vision(abstract);分类 cs.CV

AI总结 STELLAR通过空间-语义分解实现稀疏视觉表示,在保持高重建质量的同时达到与密集模型相当的语义性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01574 2026-02-03 cs.CV 57%

SGHA-Attack: Semantic-Guided Hierarchical Alignment for Transferable Targeted Attacks on Vision-Language Models

SGHA-Attack:语义引导的层次对齐用于视觉-语言模型的可迁移定向攻击

Haobo Wang, Weiqi Luo, Xiaojun Jia, Xiaochun Cao

机构 * Guangdong Province Key Lab of Information Security Technology, and School of Computer Science and Engineering, Sun Yat-sen University(广东信息安全技术重点实验室,计算机科学与工程学院,中山大学) Nanyang Technological University(南洋理工大学) School of Cyber Science and Technology, Shenzhen Campus, Sun Yat-sen University(网络安全科学与技术学院,深圳校区,中山大学)

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

AI总结 SGHA-Attack通过语义引导的层次对齐框架,提升视觉-语言模型的定向转移攻击效果,增强跨异构模型的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00570 2026-02-03 cs.CV 57%

GLAD: Generative Language-Assisted Visual Tracking for Low-Semantic Templates

GLAD: 生成式语言辅助低语义模板视觉跟踪

Xingyu Luo, Yidong Cai, Jie Liu, Jie Tang, Gangshan Wu, Limin Wang

机构 * State Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 GLAD通过生成式多模态融合提升低语义模板视觉跟踪性能,实现更高效的多模态特征融合与语义增强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01321 2026-02-03 math.OC cs.NA math.NA 50%

Global stabilization and finite element analysis of the viscous Burgers' equation with memory subject to Neumann boundary feedback control

带有记忆项的粘性Burgers方程的全局稳定性及有限元分析及Neumann边界反馈控制

Shishu Pal Singh, Sudeep Kundu

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究了带有记忆项的粘性Burgers方程的全局稳定性,采用Neumann边界反馈控制并结合有限元方法进行分析,验证了稳定性及误差估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00574 2026-02-03 cs.AI 50%

Learning Modal-Mixed Chain-of-Thought Reasoning with Latent Embeddings

通过潜在嵌入学习模态混合的思考链推理

Yifei Shao, Kun Zhou, Ziming Xu, Mohammad Atif Quamar, Shibo Hao, Zhen Wang, Zhiting Hu, Biwei Huang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出模态混合CoT方法,通过潜在嵌入结合视觉与文本信息,提升多模态推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00368 2026-02-03 physics.optics eess.IV physics.app-ph physics.med-ph 50%

Enhancing Imaging Depth and Sensitivity in Reflectance Mode Near Infrared Optical Imaging with Scatter Reducing Agents

在近红外光学成像反射模式中使用散射减少剂以增强成像深度和灵敏度

Mannu Bardhan Paul, Kaiser Niknam, Mini Das

专题命中 可控生成 :diffusion(abstract)

AI总结 本研究通过使用柠檬黄染料作为散射减少剂,在近红外反射模式成像中提升深度灵敏度和弱吸收体检测能力,利用折射率梯度增强反射信号。

Comments 26 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 4 篇

2602.01864 2026-02-03 cs.CV 79%

Trust but Verify: Adaptive Conditioning for Reference-Based Diffusion Super-Resolution via Implicit Reference Correlation Modeling

信任但验证:通过隐式参考相关性建模实现基于参考的扩散超分辨率的自适应条件化

Yuan Wang, Yuhao Wan, Siming Zheng, Bo Li, Qibin Hou, Peng-Tao Jiang

机构 * VCIP, School of Computer Science, Nankai University(VCIP,计算机科学学院,南开大学) vivo Mobile Communication Co., Ltd.(vivo移动通信有限公司)

专题命中 图像修复 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Ada-RefSR,通过自适应隐式相关性门控机制,在扩散模型中实现基于参考的超分辨率,提升图像恢复的准确性和鲁棒性。

Comments 26 pages, 19 figures. Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00192 2026-02-03 cs.CV cs.AI 79%

AI-Generated Image Detectors Overrely on Global Artifacts: Evidence from Inpainting Exchange

AI生成图像检测器过度依赖全局伪影:来自修复交换的证据

Elif Nebioglu, Emirhan Bilgiç, Adrian Popescu

机构 * Independent Researcher(独立研究者)

专题命中 图像修复 :inpainting(title,abstract);分类 cs.CV

AI总结 AI生成图像检测器过度依赖全局伪影,通过修复交换实验发现检测器准确性显著下降,需改进内容感知检测方法。

Comments 21 pages, 15 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00749 2026-02-03 cs.CV 57%

HSI-VAR: Rethinking Hyperspectral Restoration through Spatial-Spectral Visual Autoregression

HSI-VAR: 通过空间-光谱视觉自回归重新思考高光谱图像恢复

Xiangming Wang, Benteng Sun, Yungeng Liu, Haijin Zeng, Yongyong Chen, Jingyong Su, Jie Liu

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Harvard University(哈佛大学)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

AI总结 HSI-VAR通过空间-光谱视觉自回归方法,高效解决高光谱图像恢复问题,实现计算成本降低50%和推理速度提升95.5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00579 2026-02-03 cs.CV 57%

Bridging Degradation Discrimination and Generation for Universal Image Restoration

弥合退化鉴别与生成以实现通用图像修复

JiaKui Hu, Zhengjian Yao, Lujia Jin, Yanye Lu

机构 * Institute of Medical Technology, Peking University(北京大学医学技术学院) Biomedical Engineering Department, College of Future Technology, Peking University(北京大学未来技术学院生物医学工程系) National Biomedical Imaging Center, Peking University(北京大学国家生物医学成像中心) China Mobile Research Institute(中国移动研究院)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

AI总结 本文提出BDG方法,通过多角度多尺度灰度共生矩阵提升退化鉴别与生成能力,实现通用图像修复和超分辨率任务的性能提升。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 个性化与一致性 9 篇

2602.00639 2026-02-03 cs.CV 83%

Diff-PC: Identity-preserving and 3D-aware Controllable Diffusion for Zero-shot Portrait Customization

Diff-PC: 保持身份和3D感知的可控扩散用于零样本肖像定制

Yifang Xu, Benxiang Zhai, Chenyu Zhang, Ming Li, Yang Li, Sidan Du

机构 * School of Electronic Science and Engineering, Nanjing University(南京大学电子科学与工程学院) School of Business, Hohai University(河海大学商学院) School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院)

专题命中 个性化与一致性 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 Diff-PC通过3D感知和可控扩散方法实现零样本肖像定制,提升身份保持和面部可控性。

Comments Accepted by Information Fusion 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00267 2026-02-03 cs.CV cs.AI 83%

PLACID: Identity-Preserving Multi-Object Compositing via Video Diffusion with Synthetic Trajectories

PLACID:通过视频扩散与合成轨迹实现身份保持的多物体合成

Gemma Canet Tarrés, Manel Baradad, Francesc Moreno-Noguer, Yumeng Li

机构 * Amazon Barcelona(亚马逊巴塞罗那)

专题命中 个性化与一致性 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 PLACID通过视频扩散与合成轨迹实现多物体合成,保持物体身份和背景细节,提升合成效果与视觉吸引力。

详情

展开后加载摘要…

URL PDF HTML 收藏