arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-15 至 2026-01-15 共收录 46 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 33 篇

2502.16649 2026-01-15 math.AP math.DS 50%

Attractors for Singular-Degenerate Porous Medium Type Equations Arising in Models for Biofilm Growth

生物膜生长模型中出现的奇异退化孔隙介质类型方程的吸引子

Zehra Şen, Stefanie Sonner

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了生物膜生长模型中出现的奇异退化孔隙介质类型方程的吸引子存在性及性质。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12234 2026-01-15 math.PR math.AP 50%

Quantitative homogenization and hydrodynamic limit of non-gradient exclusion process

非梯度排斥过程的定量均质化与流体动力学极限

Tadahisa Funaki, Chenlin Gu, Han Wang

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过粗粒化方法和梯度耦合,解决了非梯度排斥过程中粒子数约束问题,实现了扩散矩阵和电导率的定量均质化,并推导了流体动力学极限。

Comments 109 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08934 2026-01-15 physics.ins-det hep-ex nucl-ex 50%

Hybrid-Contact Planar HPGe Process Vehicle Toward Ring-Contact Designs

混合接触平面高纯锗过程车向环形接触设计

Kunming Dong, Dongming Mei, Shasika Panamaldeniya, Anupama Karki, Patrick Burns, Sanjay Bhataarai

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种混合接触平面HPGe工艺,用于制造高纯锗探测器,验证了锂悬浮涂料与薄膜a-Ge/Al接触的兼容性,实现了低噪声和高能量分辨率的探测性能。

Comments 25 pages and 13 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08073 2026-01-15 physics.comp-ph cond-mat.dis-nn 50%

DDNet: A Unified Physics-Informed Deep Learning Framework for Semiconductor Device Modeling

DDNet: 一种用于半导体器件建模的统一物理信息深度学习框架

Roberto Riganti, Matteo G. C. Alasio, Enrico Bellotti, Luca Dal Negro

专题命中 扩散模型 :diffusion(abstract)

AI总结 DDNet是一种统一的物理信息深度学习框架,用于解决半导体器件建模的正向和反向问题,通过高效准确的计算实现低误差和低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01773 2026-01-15 cs.NI 50%

Frontiers of Generative AI for Network Optimization: Theories, Limits, and Visions

生成人工智能在网络优化中的前沿:理论、限制与展望

Bo Yang, Ruihuai Liang, Weixin Li, Han Wang, Xuelin Cao, Zhiwen Yu, Samson Lasaulce, Mérouane Debbah, Mohamed-Slim Alouini, H. Vincent Poor, Chau Yuen

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文探讨生成人工智能在网络优化中的应用,分析其理论基础、局限性及未来发展方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13712 2026-01-15 math.PR 50%

Theoretical and computational investigations of superposed interacting affine and more complex processes

超叠加相互作用的仿射及更复杂过程的理论和计算研究

Hidekazu Yoshioka

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种适用于长记忆过程的分裂方案,通过马尔可夫提升方法研究仿射跳跃扩散过程,并探讨了其在环境科学中的应用。

Comments Update submitted on January 11 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 1 篇

2601.09255 2026-01-15 cs.CV 57%

PhyRPR: Training-Free Physics-Constrained Video Generation

PhyRPR: 无训练物理约束视频生成

Yibo Zhao, Hengjia Li, Xiaofei He, Boxi Wu

机构 * State Key Lab of CAD\&CG, Zhejiang University(CAD与CG国家重点实验室,浙江大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 PhyRPR提出一种无训练的三阶段视频生成方法,通过解耦物理理解和视觉合成,提升生成视频的物理合理性和运动可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 1 篇

2601.09169 2026-01-15 cs.CV cs.CY 57%

Architecture inside the mirage: evaluating generative image models on architectural style, elements, and typologies

镜中架构:在幻象中评估生成图像模型对建筑风格、元素和类型学的再现能力

Jamie Magrill, Leah Gornstein, Sandra Seekins, Barry Magrill

专题命中 个性化与一致性 :text-to-image(abstract);分类 cs.CV

AI总结 评估生成图像模型在建筑风格、元素和类型学上的准确性,发现常见提示生成的图像更准确,但整体准确性有限,需加强标注和教育使用。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 1 篇

2511.11134 2026-01-15 cs.AI 50%

GGBench: A Geometric Generative Reasoning Benchmark for Unified Multimodal Models

GGBench: 一种用于统一多模态模型的几何生成推理基准

Jingxuan Wei, Caijun Jia, Xi Bai, Xinglong Xu, Siyuan Li, Linzhuang Sun, Bihui Yu, Conghui He, Lijun Wu, Cheng Tan

机构 * University of Chinese Academy of Sciences(中国科学院大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 图像生成评测 :image generation(abstract)

AI总结 GGBench通过几何构造评估统一多模态模型的生成推理能力,推动智能系统发展。

Comments 35 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 6 篇

2506.17139 2026-01-15 cs.LG cs.AI physics.chem-ph physics.comp-ph stat.ML 78%

Consistent Sampling and Simulation: Molecular Dynamics with Energy-Based Diffusion Models

一致采样与模拟:基于能量的扩散模型的分子动力学

Michael Plainer, Hao Wu, Leon Klein, Stephan Günnemann, Frank Noé

专题命中 效率与蒸馏 :diffusion(title,abstract)

AI总结 本文提出了一种基于能量的扩散模型,通过福克-普朗克方程导出的正则化项来提高分子动力学模拟中的一致性和采样效率。

Comments Accepted at Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09452 2026-01-15 cs.CV 57%

MAD: Motion Appearance Decoupling for efficient Driving World Models

MAD:用于高效驾驶世界模型的运动外观解耦

Ahmad Rahimi, Valentin Gerard, Eloi Zablocki, Matthieu Cord, Alexandre Alahi

机构 * Sorbonne Université(索邦大学)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

AI总结 MAD通过解耦运动学习与外观合成,高效地将通用视频扩散模型转化为可控的驾驶世界模型,实现低计算成本和高性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09316 2026-01-15 cs.CV 57%

Frequency Error-Guided Under-sampling Optimization for Multi-Contrast MRI Reconstruction

频率误差引导的多对比MRI重建下采样优化

Xinming Fang, Chaoyan Huang, Juncheng Li, Jun Wang, Jun Shi, Guixu Zhang

机构 * School of Communication and Information Engineering, Shanghai University, Shanghai, 200444, China(通信与信息工程学院,上海大学,上海,200444,中国) School of Computational Mathematics Science and Engineering, Michigan State University, Ann Arbor, USA(计算数学科学与工程学院,密歇根州立大学,安阿伯,美国) School of Computer Science and Technology, East China Normal University, Shanghai, 200062, China(计算机科学与技术学院,华东师范大学,上海,200062,中国)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

AI总结 本文提出一种频率误差引导的MRI重建方法,通过联合优化下采样模式和重建网络,提升多对比MRI重建的效率和可解释性。

Comments 44 pages, 12 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08867 2026-01-15 cs.CV cs.AI 57%

R$^2$BD: A Reconstruction-Based Method for Generalizable and Efficient Detection of Fake Images

R$^2$BD: 一种基于重建的方法,用于通用性和高效的假图像检测

Qingyu Liu, Zhongjie Ba, Jianmin Guo, Qiu Wang, Zhibo Wang, Jie Shi, Kui Ren

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学) Huawei International(华为国际)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

AI总结 R$^2$BD通过统一的重建模型和残差偏差计算模块,实现了高效且通用的假图像检测,检测精度和效率均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07832 2026-01-15 cs.CV cs.AI 57%

MHLA: Restoring Expressivity of Linear Attention via Token-Level Multi-Head

MHLA: 通过令牌级多头恢复线性注意力的表达性

Kewei Zhang, Ye Huang, Yufan Deng, Jincheng Yu, Junsong Chen, Huan Ling, Enze Xie, Daquan Zhou

机构 * Peking University(北京大学) NVIDIA(英伟达)

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

AI总结 MHLA通过令牌级多头机制恢复线性注意力的表达性,提升多个领域任务性能

Comments Code: https://github.com/DAGroup-PKU/MHLA/ Project website: https://dagroup-pku.github.io/MHLA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09377 2026-01-15 cs.RO 50%

ReflexDiffusion: Reflection-Enhanced Trajectory Planning for High-lateral-acceleration Scenarios in Autonomous Driving

ReflexDiffusion:面向自动驾驶高侧向加速度场景的反射增强轨迹规划

Xuemei Yao, Xiao Yang, Jianbin Sun, Liuwei Xie, Xuebin Shao, Xiyu Fang, Hang Su, Kewei Yang

专题命中 效率与蒸馏 :diffusion(abstract)

AI总结 ReflexDiffusion通过反射调整机制提升自动驾驶在高侧向加速度场景下的轨迹规划安全性与可靠性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他图像生成 1 篇

2601.09212 2026-01-15 cs.CV cs.AI cs.LG 79%

Annealed Relaxation of Speculative Decoding for Faster Autoregressive Image Generation

退火放松的投机解码用于更快的自回归图像生成

Xingyao Li, Fengzhuo Zhang, Cunxiao Du, Hui Ji

专题命中 其他图像生成 :image generation(title,abstract);分类 cs.CV

AI总结 本文提出COOL-SD,通过退火放松的投机解码方法提升自回归图像生成的速度与质量。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏