arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-13 至 2026-01-13 共收录 91 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 67 篇

2509.07834 2026-01-13 math.NA cs.NA 50%

Convergence analysis for the Barrett--Garcke--Nurnberg method of transport type for evolving curves

传输型Barrett-Garcke-Nurnberg方法的收敛性分析用于演化的曲线

Genming Bai, Harald Garcke, Shravan Veerapaneni

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种传输型Barrett-Garcke-Nurnberg方法,用于一般流驱动的曲线演化问题,并首次证明其在L2范数下的次优收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21176 2026-01-13 cond-mat.mes-hall physics.app-ph 50%

Alternating Spintronics: Capacitive Behavior of Spin Valves and Resonator Applications

交替自旋电子学:自旋阀和共振器的应用的电容行为

Yunwen Liu, Jiang Xiao

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究通过时间依赖自旋扩散模型揭示了自旋阀在交变电流下的电容特性,为高频自旋电子器件开发提供了新思路。

Comments 6 pages, 4 figures, 1 appendix section

Journal ref Phys. Rev. B 113, L020403 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11700 2026-01-13 cs.LG 50%

Geometry-Aware Edge Pooling for Graph Neural Networks

面向几何的边池化用于图神经网络

Katharina Limbeck, Lydia Mezrag, Guy Wolf, Bastian Rieck

机构 * Helmholtz Munich(海德堡-穆恩大学) Technical University of Munich(慕尼黑技术大学) Université de Montréal(蒙特利尔大学) Mila - Quebec AI Institute(魁北克人工智能研究所) Université de Fribourg(弗里堡大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出面向几何的边池化方法,通过扩散几何和迭代缩减图结构,提升图神经网络在多样任务中的性能和可解释性。

Comments Accepted at the 39th Conference on Neural Information Processing Systems (NeurIPS) 2025. Our code is available at https://github.com/aidos-lab/mag_edge_pool

详情

展开后加载摘要…

URL PDF HTML 收藏
0809.2506 2026-01-13 math.PR 50%

Exponential functionals of Brownian motion and class-one Whittaker functions

布朗运动的指数函数与一类Whittaker函数

Fabrice Baudoin, Neil O'Connell

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了布朗运动的指数函数与一类Whittaker函数之间的关系,推导了相关扩散过程的性质。

Comments 23 pages, 1 figure. v3: minor corrections and additional references. v4: minor corrections, additional background material and references

Journal ref Ann. Inst. H. Poincare Probab. Statist. 47(4): 1096-1120 (November 2011)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06709 2026-01-13 physics.soc-ph math.DS 50%

Bystander effect emerges from individual psychological prospects

旁观者效应源于个体心理前景

Tiffanie Ng, Sara M Clifton

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一个基于社会心理假设和前景理论的模型,揭示旁观者效应源于非协调个体在模糊情境中的社会风险感知,并发现社会学习会加剧该效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06583 2026-01-13 cond-mat.mtrl-sci 50%

A Rechargeable Chromium Battery

可充电铬电池

Apurva Anjan, Adwitiya Rao, Rohit M. Manoj, Vrindha Pongalat, Varad Mahajani, Sohail Shah, Mukesh Bacchav, Chandra Veer Singh, Nikhil Koratkar

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究通过开发富含铬的高熵合金,克服了铬金属氧化形成的保护层限制,实现了可充电铬电池的高循环稳定性与高效能量存储性能。

Comments 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06529 2026-01-13 cond-mat.mtrl-sci 50%

On unconstrained solidification of spherical metallic drops

关于无约束球形金属滴的固结

Priti Ranjan Panda, Harish Singh Dhami, Koushik Viswanathan

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究球形金属滴固结过程中曲率和受限对成核、生长和稳定性的影响,揭示了曲率和尺寸对微观结构的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06467 2026-01-13 eess.SP 50%

Neuro-Wideband WiFi Sensing via Self-Conditioned CSI Extrapolation

通过自条件CSI外推实现神经宽带WiFi感知

Sijie Ji, Weiying Hou, Chenshu Wu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出Neuro-Wideband(NWB)通过自条件学习实现宽带WiFi感知,无需专用硬件,利用深度学习框架提升多径分辨能力,实验证明其在定位和呼吸监测中的有效性。

Comments In Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06384 2026-01-13 cond-mat.mtrl-sci 50%

Mechanisms of alkali ionic transport in amorphous oxyhalides solid state conductors

无定形氧卤化物固态导体中碱金属离子传输机制

Luca Binci, KyuJung Jun, Bowen Deng, Gerbrand Ceder

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究揭示无定形氧卤化物中碱金属离子传输机制,通过分子动力学分析发现氧阴离子限制碱金属扩散,且传输特性对原子化学变化不敏感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06383 2026-01-13 math.PR 50%

Well-posedness of state-dependent rank-based interacting systems

状态依赖秩基相互作用系统的适定性

Hélène Guérin, Nathalie Krell

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了基于秩的随机微分方程系统在不同系数条件下的适定性,探讨了强弱适定性及解的正性问题。

Comments 21 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06277 2026-01-13 astro-ph.SR 50%

The Energy-Duration Relationship in Astrophysical Self-Organized Criticality Systems

天体自我组织临界系统中的能量-持续时间关系

Markus J. Aschwanden, Alexandre Araujo

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究天体自我组织临界系统中能量与持续时间的标度关系,发现观测结果与理论预测一致,但小时间范围导致标度指数波动。

Comments 8 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06156 2026-01-13 cs.IT cs.AI math.IT 50%

Channel Knowledge Map Construction via Guided Flow Matching

通过引导流匹配构建通道知识图

Ziyu Huang, Yong Zeng, Shen Fu, Xiaoli Xu, Hongyang Du

机构 * National Mobile Communications Research Laboratory, Southeast University, Nanjing 210096, China(南京东南大学国家移动通信研究中心) Pervasive Communication Research Center, Purple Mountain Laboratories, Nanjing 211111, China(紫金山实验室 pervasive 通信研究中心) Department of Electrical and Electronic Engineering, University of Hong Kong, Hong Kong SAR, China(香港大学电子工程系)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出LT-GFM框架,通过线性传输引导流匹配高效构建通道知识图,实现高保真与高效之间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06040 2026-01-13 cs.CY 50%

Cognitive Sovereignty and the Neurosecurity Governance Gap: Evidence from Singapore

认知主权与神经安全治理鸿沟:来自新加坡的证据

Hailee Carter

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文探讨了认知主权与神经安全治理鸿沟,通过新加坡案例分析,提出认知主权框架以保护神经过程免受外部干扰。

Comments 18 pages, 0 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03561 2026-01-13 cs.LG 50%

Neural Operators for Biomedical Spherical Heterogeneity

神经运算符用于生物医学球形异质性

Hao Tang, Hao Chen, Hao Li, Chao Li

机构 * University of Dundee(邓迪大学) University of Cambridge(剑桥大学) Fudan University(复旦大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 GSNO通过融合等变、不变和各向异性格林函数运算,有效建模生物医学中的球形异质性和各向异性,提升真实世界系统的适应性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20308 2026-01-13 math.NA cs.NA 50%

Deep random difference method for high-dimensional quasilinear parabolic partial differential equations

高维拟线性抛物型偏微分方程的深度随机差分方法

Wei Cai, Shuixin Fang, Tao Zhou

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出深度随机差分方法,用于高维拟线性抛物型PDEs和HJB方程的求解,通过一阶差分和深度神经网络避免导数计算,实现高效并行计算。

Comments 64 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02973 2026-01-13 cs.CL 50%

Expanding before Inferring: Enhancing Factuality in Large Language Models through Premature Layers Interpolation

在推断前扩展:通过提前层插值增强大语言模型的事实性

Dingwei Chen, Ziqiang Liu, Feiteng Fang, Chak Tou Leong, Shiwen Ni, Ahmadreza Argha, Hamid Alinejad-Rokny, Min Yang, Chengming Li

机构 * Sun Yat-Sen University(中山大学) Shenzhen MSU-BIT University(深圳MSU-BIT大学) The Hong Kong Polytechnic University(香港理工大学) UNSW, Sydney, NSW 2052, Australia(新南威尔士大学) Shenzhen Key Laboratory for High Performance Data Mining, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳高性能数据挖掘重点实验室,深圳先进技术研究院,中国科学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出PLI方法,通过提前层插值提升大语言模型的事实一致性,有效减少幻觉并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11211 2026-01-13 math.AP math.DS 50%

Instability of the Standing Pulse in Skew-Gradient Systems and Its Application to FitzHugh-Nagumo Type Systems

斜梯度系统中稳定脉冲的不稳定性及其在FitzHugh-Nagumo型系统中的应用

Jing Li, Qin Xing, Ran Yang

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了非自共轭斜梯度系统中稳定脉冲的不稳定性,并将其应用于FitzHugh-Nagumo型系统,通过拓扑方法分析非线性抑制对脉冲稳定性的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 5 篇

2601.06605 2026-01-13 cs.CV 85%

Sissi: Zero-shot Style-guided Image Synthesis via Semantic-style Integration

Sissi:通过语义-风格整合实现零样本风格引导图像合成

Yingying Deng, Xiangyu He, Fan Tang, Weiming Dong, Xucheng Yin

专题命中 可控生成 :image synthesis(title);image generation(abstract);diffusion(abstract);inpainting(abstract)

AI总结 Sissi通过语义-风格整合实现零样本风格引导图像合成,采用上下文学习框架提升风格化效果与语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14031 2026-01-13 cs.CV 83%

FashionMAC: Deformation-Free Fashion Image Generation with Fine-Grained Model Appearance Customization

FashionMAC: 无变形的时尚图像生成与细粒度模型外观定制

Rong Zhang, Jinxiao Li, Jingnan Wang, Zhiwen Zuo, Jianfeng Dong, Wei Li, Chi Wang, Weiwei Xu, Xun Wang

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 FashionMAC通过无变形的扩散框架实现高质量可控的时尚图像生成,采用RADA机制和链式掩码注入策略提升细粒度外观可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06823 2026-01-13 cs.HC 78%

Generative Modeling of Human-Computer Interfaces with Diffusion Processes and Conditional Control

基于扩散过程和条件控制的人机界面生成模型

Rui Liu, Liuqingqing Yang, Runsheng Zhang, Shixiao Wang

专题命中 可控生成 :diffusion(title,abstract)

AI总结 本文提出基于扩散过程和条件控制的界面生成模型,通过整合用户意图和任务约束,提升界面生成的多样性、合理性和智能化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07660 2026-01-13 cs.CV 57%

StdGEN++: A Comprehensive System for Semantic-Decomposed 3D Character Generation

StdGEN++: 一种用于语义分解3D人物生成的综合性系统

Yuze He, Yanning Zhou, Wang Zhao, Jingwen Ye, Zhongkai Wu, Ran Yi, Yong-Jin Liu

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Tencent AIPD(腾讯AIPD) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 StdGEN++是一种基于双分支语义感知模型的综合性系统,通过语义分解和高效生成技术,实现高保真3D人物生成,适用于自动化角色资产生产。

Comments 13 pages, 12 figures. Extended version of CVPR 2025 paper arXiv:2411.05738

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06049 2026-01-13 cs.CY cs.AI 50%

The Violation State: Safety State Persistence in a Multimodal Language Model Interface

违规状态:多模态语言模型接口中的安全状态持续

Bentley DeVilling

专题命中 可控生成 :image generation(abstract)

AI总结 研究发现多模态语言模型在面对版权拒绝后,会持续拒绝无关图像生成请求,揭示了会话级安全状态的持续性问题。

Comments 19 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 2 篇

2601.06413 2026-01-13 cs.CV 70%

GlobalPaint: Spatiotemporal Coherent Video Outpainting with Global Feature Guidance

GlobalPaint: 基于全局特征引导的时空一致视频外推

Yueming Pan, Ruoyu Feng, Jianmin Bao, Chong Luo, Nanning Zheng

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家重点实验室,人工智能与机器人研究院,西安交通大学) Microsoft Research Asia(微软亚洲研究院) University of Science and Technology of China(中国科学技术大学)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 GlobalPaint提出一种基于扩散的视频外推框架,通过增强的空间-时间模块和全局特征引导,提升视频外推的时空一致性与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06525 2026-01-13 cs.CV 57%

Toward Generalizable Deblurring: Leveraging Massive Blur Priors with Linear Attention for Real-World Scenarios

迈向可泛化的去模糊化:利用大规模模糊先验与线性注意力以应对现实场景

Yuanting Gao, Shuo Cao, Xiaohui Li, Yuandong Pu, Yihao Liu, Kai Zhang

机构 * Tsinghua University(清华大学) USTC, Shanghai AI Lab(USTC,上海人工智能实验室) SJTU, Shanghai AI Lab(上海交通大学,上海人工智能实验室) Shanghai AI Lab(上海人工智能实验室)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

AI总结 本文提出BPP和MoSeG方法,通过大规模模糊先验与线性注意力提升图像去模糊化在现实场景中的泛化能力。

Comments 19 pages, 14 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 个性化与一致性 3 篇

2512.15542 2026-01-13 cs.CV 70%

BLANKET: Anonymizing Faces in Infant Video Recordings

BLANKET:婴儿视频记录中的人脸匿名化

Ditmar Hadera, Jan Cech, Miroslav Purkrabek, Matej Hoffmann

机构 * Department of Cybernetics, Faculty of Electrical Engineering, Czech Technical University in Prague(控制系、电气工程系、布拉格捷克技术大学)

专题命中 个性化与一致性 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 BLANKET通过生成与原身份兼容的新随机人脸并结合时间一致的面部交换,实现婴儿视频中的人脸匿名化,同时保留关键面部属性,优于现有方法DeepPrivacy2。

Comments Project website: https://github.com/ctu-vras/blanket-infant-face-anonym

Journal ref 2025 IEEE International Conference on Development and Learning (ICDL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06965 2026-01-13 cs.CV 57%

Unified Personalized Understanding, Generating and Editing

统一的个性化理解、生成与编辑

Yu Zhong, Tianwei Lin, Ruike Zhu, Yuqian Yuan, Haoyu Zheng, Liang Liang, Wenqiao Zhang, Feifei Shao, Haoyuan Li, Wanggui He, Hao Jiang, Yueting Zhuang

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 个性化与一致性 :image editing(abstract);分类 cs.CV

AI总结 OmniPersona是首个统一LMMs的端到端个性化框架,通过结构解耦的概念标记和显式知识重播机制,实现个性化理解、生成和图像编辑的一致可控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06867 2026-01-13 cs.LG 50%

U-MASK: User-adaptive Spatio-Temporal Masking for Personalized Mobile AI Applications

U-MASK:基于用户适应的时空掩码用于个性化移动AI应用

Shiyuan Zhang, Yilai Liu, Yuwei Du, Ruoxuan Yang, Dong In Kim, Hongyang Du

机构 * Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Department of Electrical and Computer Engineering, Sungkyunkwan University(成均馆大学电子与计算机工程系)

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 U-MASK通过用户适应的时空掩码方法,解决个性化移动AI中的数据稀疏和非平稳性问题,提升短期预测、长期预测和冷启动推荐性能。

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 图像生成评测 1 篇

2507.19024 2026-01-13 cs.CV 57%

A Survey of Multimodal Hallucination Evaluation and Detection

多模态幻觉评估与检测综述

Zhiyuan Chen, Yuecong Min, Jie Zhang, Bei Yan, Jiahao Wang, Xiaozhen Wang, Shiguang Shan

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences (CAS)(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Trustworthy Technology and Engineering Laboratory(可信技术与工程实验室) Huawei(华为公司)

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

AI总结 本文综述了多模态幻觉评估与检测方法,分析了幻觉分类、评估基准、检测技术及未来研究方向。

Comments 40 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 效率与蒸馏 3 篇

2601.07462 2026-01-13 cs.CV 79%

From Sketch to Fresco: Efficient Diffusion Transformer with Progressive Resolution

从草图到壁画:高效的扩散变换器与渐进分辨率

Shikang Zheng, Guantao Chen, Lixuan He, Jiacheng Liu, Yuqi Lin, Chang Zou, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) South China University of Technology(华南理工大学) Tsinghua University(清华大学)

专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV

AI总结 Fresco通过渐进式上采样统一重加噪和全局结构,实现高效扩散变换器的加速,适用于多种模型和领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07396 2026-01-13 cs.CV 79%

Forecast the Principal, Stabilize the Residual: Subspace-Aware Feature Caching for Efficient Diffusion Transformers

预测主成分,稳定残差:面向高效扩散变换器的子空间感知特征缓存

Guantao Chen, Shikang Zheng, Yuqi Lin, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Sun Yat-Sen University(中山大学) South China University of Technology(华南理工大学) Jilin University(吉林大学)

专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出SVD-Cache方法,通过子空间感知的特征缓存技术提升扩散变换器的推理效率,实现近无损效果并支持多种加速技术。

详情

展开后加载摘要…

URL PDF HTML 收藏