arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-04 至 2026-02-04 共收录 88 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 68 篇

2602.02924 2026-02-04 cs.LG cs.SY eess.SY 78%

How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models?

如何通过扩散模型使拉格朗日量引导安全强化学习?

Xiaoyuan Cheng, Wenxuan Yuan, Boyang Li, Yuanchao Xu, Yiming Yang, Hao Liang, Bei Peng, Robert Loftin, Zhuo Sun, Yukun Hu

机构 * University College London(伦敦大学学院) Imperial College London(伦敦帝国学院) University of California, San Diego(加州大学圣地亚哥分校) Kyoto University(京都大学) King's College London(伦敦国王学院) University of Sheffield(谢菲尔德大学) Shanghai University of Finance and Economics(上海财经大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出ALGD算法,通过增强拉格朗日方法解决安全强化学习中的稳定性问题,实现稳定有效的政策生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02831 2026-02-04 cs.RO 78%

Adaptive Linear Path Model-Based Diffusion

基于自适应线性路径模型的扩散

Yutaka Shimizu, Masayoshi Tomizuka

机构 * Department of Mechanical Engineering, University of California, Berkeley(加州大学伯克利分校机械工程系)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出LP-MBD和ALP-MBD,通过线性概率路径和强化学习提升扩散模型在机器人控制中的适应性和鲁棒性。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02795 2026-02-04 eess.IV 78%

Super-Resolution and Denoising of Corneal B-Scan OCT Imaging Using Diffusion Model Plug-and-Play Priors

利用扩散模型插件式先验进行角膜B扫OCT影像的超分辨率和去噪

Yaning Wang, Jinglun Yu, Wenhan Guo, Ziyi Huang, Rosalinda Xiong, Yu Sun, Jin U. Kang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出利用扩散模型插件式先验提升角膜B扫OCT影像的分辨率和去噪能力,通过贝叶斯逆问题和预训练生成先验实现高保真成像。

Journal ref Proceedings of SPIE, Vol. 13865, 13865-67 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02727 2026-02-04 cs.LG cs.AI 78%

Search-Augmented Masked Diffusion Models for Constrained Generation

带有搜索增强的掩码扩散模型用于受约束生成

Huu Binh Ta, Michael Cardei, Alvaro Velasquez, Ferdinando Fioretto

机构 * University of Virginia(弗吉尼亚大学) University of Colorado at Boulder(科罗拉多大学 Boulder分校)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 SearchDiff通过整合有信息的搜索到反向去噪过程中,提高了约束满足和属性遵循,优于离散扩散和自回归基线。

Comments Huu Binh Ta and Michael Cardei contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02699 2026-02-04 cs.LG cs.AI 78%

Sparsely Supervised Diffusion

稀疏监督扩散

Wenshuai Zhao, Zhiyuan Li, Yi Zhao, Mohammad Hassan Vali, Martin Trapp, Joni Pajarinen, Juho Kannala, Arno Solin

机构 * Department of Electrical Engineering and Automation, Aalto University, Finland(电气工程与自动化系,阿alto大学,芬兰) Department of Computer Science, Aalto University, Finland(计算机科学系,阿alto大学,芬兰)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究提出了一种稀疏监督学习方法,通过掩码扩散模型中的大部分像素来减少生成不一致性,同时保持模型性能并提高稳定性。

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02178 2026-02-04 cs.CL 78%

AR-MAP: Are Autoregressive Large Language Models Implicit Teachers for Diffusion Large Language Models?

AR-MAP:自回归大语言模型是否是扩散大语言模型的隐式教师?

Liang Lin, Feng Xiong, Zengbin Wang, Kun Wang, Junhao Dong, Xuecai Hu, Yong Wang, Xiangxiang Chu

机构 * AMAP, Alibaba Group(AMAP,阿里巴巴集团) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 AR-MAP通过利用自回归大语言模型作为隐式教师,有效提升扩散大语言模型的偏好对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08150 2026-02-04 cs.IR 78%

DiffuGR: Generative Document Retrieval with Diffusion Language Models

DiffuGR:基于扩散语言模型的生成性文档检索

Xinpeng Zhao, Zhaochun Ren, Yukun Zhao, Zhenyang Li, Mengqi Zhang, Jun Feng, Ran Chen, Ying Zhou, Zhumin Chen, Shuaiqiang Wang, Dawei Yin, Xin Xin

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 DiffuGR通过扩散语言模型实现生成性文档检索,解决DocID生成与自然语言生成不匹配及效率与准确性权衡问题,提升检索性能与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00294 2026-02-04 cs.LG cs.AI 78%

Free Draft-and-Verification: Toward Lossless Parallel Decoding for Diffusion Large Language Models

免费草稿与验证:迈向无损并行解码的扩散大语言模型

Shutong Wu, Jiawei Zhang

机构 * Department of Computer Sciences, University of Wisconsin--Madison, Madison, WI(计算机科学系,威斯康星大学麦迪逊分校,麦迪逊,WI)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 FreeDave是一种专为DLLMs设计的快速解码算法,通过无损并行解码实现高效推理,无需模型修改或额外模块,提升了推理速度而不影响性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23286 2026-02-04 cs.CL cs.AI 78%

A2D: Any-Order, Any-Step Safety Alignment for Diffusion Language Models

A2D: 任意顺序、任意步长的安全对齐用于扩散语言模型

Wonje Jeung, Sangyeon Yoon, Yoonjun Cho, Dongjae Jeon, Sangwoo Shin, Hyesoo Hong, Albert No

机构 * Department of Artificial Intelligence, Yonsei University(人工智能系,延世大学) Department of Computer Science and Engineering, Yonsei University(计算机科学与工程系,延世大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 A2D通过令牌级对齐方法,在扩散语言模型中实现任意顺序和步长攻击的鲁棒防御,显著降低有害输出生成概率并提升安全终止效率。

Comments Accepted at ICLR 2026. Code and models are available at https://ai-isl.github.io/A2D

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04604 2026-02-04 q-bio.NC 78%

A diffusion MRI tractography atlas for concurrent white matter mapping across Eastern and Western populations

一种用于东西方人群同时白质映射的扩散磁共振成像束追踪图谱

Yijie Li, Wei Zhang, Ye Wu, Li Yin, Ce Zhu, Yuqian Chen, Suheyla Cetin-Karayumak, Kang Ik K Cho, Leo R. Zekelman, Jarrett Rushmore, Yogesh Rathi, Nikos Makris, Lauren J. O'Donnell, Fan Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究提出了一种跨东西方人群的白质图谱,用于同时进行白质映射,并创建了大规模协调的dMRI数据集,以促进对不同文化背景脑差异的研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00508 2026-02-04 cs.CV 77%

DuoGen: Towards General Purpose Interleaved Multimodal Generation

DuoGen:迈向通用的交错多模态生成

Min Shi, Xiaohui Zeng, Jiannan Huang, Yin Cui, Francesco Ferroni, Jialuo Li, Shubham Pachori, Zhaoshuo Li, Yogesh Balaji, Haoxiang Wang, Tsung-Yi Lin, Xiao Fu, Yue Zhao, Chieh-Yun Chen, Ming-Yu Liu, Humphrey Shi

机构 * Georgia Tech(佐治亚理工学院) NVIDIA research.nvidia.com/labs/dir/duogen(NVIDIA 研究所)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 DuoGen通过系统性地解决数据整理、架构设计和评估问题,实现了通用的交错多模态生成,提升了文本质量、图像保真度和图像-上下文对齐性能。

Comments Technical Report. Project Page: https://research.nvidia.com/labs/dir/duogen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03776 2026-02-04 q-fin.CP cs.AI 71%

DiffLOB: Diffusion Models for Counterfactual Generation in Limit Order Books

DiffLOB: 基于扩散模型的限价单簿反事实生成

Zhuohan Wang, Carmine Ventre

机构 * King’s College London(伦敦国王学院)

专题命中 扩散模型 :diffusion(title)

AI总结 DiffLOB提出一种基于扩散模型的可控反事实生成方法,用于模拟限价单簿在不同市场制度下的演变,提升市场分析与预测能力。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17783 2026-02-04 hep-ph 71%

Encoding off-shell effects in top pair production in Direct Diffusion networks

在直接扩散网络中编码非壳效应于顶夸克对产生

Mathias Kuschick

专题命中 扩散模型 :diffusion(title)

AI总结 本文提出在直接扩散网络中编码非壳效应以提高顶夸克对产生事件模拟的精度,并探讨了扩展该方法以包含更高阶效应的初步步骤。

Comments Talk at the 17th International Workshop on Top Quark Physics (Top2024), 22-27 September 2024

Journal ref SciPost Phys. Proc. 18, 005 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02659 2026-02-04 hep-th gr-qc 71%

Pseudospectra of holographic diffusion: gauge fields breaking free from the master scalar

反德西特空间中Schwarzschild黑洞膜上U(1)规范场的伪谱

David Garcia-Fariña, Karl Landsteiner, Pau G. Romeu, Pablo Saura-Bastida

专题命中 扩散模型 :diffusion(title)

AI总结 本文提出了一种计算反德西特空间中Schwarzschild黑洞膜上U(1)规范场伪谱的新方法,并发现其与传统主标量场方法结果一致,揭示了流体动力学模式的稳定性及复动量的不稳定性。

Comments 45 pages, 22 figures, 4 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03749 2026-02-04 cs.CV cs.GR 62%

See-through: Single-image Layer Decomposition for Anime Characters

See-through: 单图像层分解用于动漫人物

Jian Lin, Chengze Li, Haoyun Qin, Kwun Wang Chan, Yanghua Jin, Hanyuan Liu, Stephen Chun Wang Choy, Xueting Liu

机构 * Saint Francis University(圣芳济大学) University of Pennsylvania(宾夕法尼亚大学) Spellbrush(Spellbrush公司) Shitagaki Lab(Shitagaki实验室)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 本研究提出了一种单图像层分解方法,通过自动生成高质量监督信息和结合扩散模型与伪深度推断机制,实现动漫人物的2.5D可操控模型生成。

Comments 23 pages, 20 figures, preprint version only

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03753 2026-02-04 cs.CV 57%

Test-Time Conditioning with Representation-Aligned Visual Features

测试时条件化与表征对齐的视觉特征

Nicolas Sereyjol-Garros, Ellington Kirby, Victor Letzelter, Victor Besnier, Nermin Samet

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 REPA-G通过利用对齐的视觉表征,在推理时实现灵活的条件化生成,提供多尺度控制和多概念组合能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03747 2026-02-04 cs.CV 57%

LIVE: Long-horizon Interactive Video World Modeling

LIVE: 长时距交互视频世界建模

Junchao Huang, Ziyang Ye, Xinting Hu, Tianyu He, Guiyu Zhang, Shaoshuai Shi, Jiang Bian, Li Jiang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen Loop Area Institute(深圳河套学院) Microsoft Research(微软研究院) The University of Hong Kong(香港大学) Voyager Research, Didi Chuxing Project(Voyager研究,滴滴出行项目)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 LIVE通过循环一致性目标限制误差累积,无需教师蒸馏,实现长时距交互视频世界建模,取得最优性能。

Comments 18 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08042 2026-02-04 cs.CV 57%

Towards Sustainable Universal Deepfake Detection with Frequency-Domain Masking

迈向可持续的通用深度伪造检测:频域遮蔽

Chandler Timm C. Doloriel, Habib Ullah, Kristian Hovde Liland, Fadi Al Machot, Ngai-Man Cheung

机构 * Singapore University of Technology and Design (SUTD)(新加坡科技设计大学) Faculty of Science and Technology (REALTEK), Norwegian University of Life Sciences (NMBU)(科学与技术学院(REALTEK)、挪威生命科学大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出频域遮蔽方法,用于提升深度伪造检测的泛化能力和计算效率,实现可持续的通用检测。

Comments Accepted to ACM TOMM

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03123 2026-02-04 cs.CV cs.AI 57%

Beyond Cropping and Rotation: Automated Evolution of Powerful Task-Specific Augmentations with Generative Models

超越裁剪与轮换:利用生成模型自动化进化强大任务特定增强方法

Judah Goldfeder, Shreyes Kaliyur, Vaibhav Sourirajan, Patrick Minwan Puma, Philippe Martin Wyder, Yuhang Hu, Jiong Lin, Hod Lipson

机构 * Columbia University, New York, NY(哥伦比亚大学) University of Washington, Seattle, WA(华盛顿大学) Harvard University, Cambridge, MA(哈佛大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出EvoAug,利用生成模型和进化算法自动化学习任务特定增强方法,提升模型鲁棒性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00949 2026-02-04 cs.CV 57%

Data Augmentation for High-Fidelity Generation of CAR-T/NK Immunological Synapse Images

用于生成高保真CAR-T/NK免疫突触图像的数据增强

Xiang Zhang, Boxuan Zhang, Alireza Naghizadeh, Mohab Mohamed, Dongfang Liu, Ruixiang Tang, Dimitris Metaxas, Dongfang Liu

机构 * Rochester Institute of Technology(罗切斯特技术学院) Rutgers University(罗杰斯大学) Rutgers New Jersey Medical School(新泽西罗杰斯医学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出两种数据增强方法,用于生成高保真CAR-T/NK免疫突触图像,以提高免疫突触检测和分割的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23729 2026-02-04 cs.CV 57%

Proteus-ID: ID-Consistent and Motion-Coherent Video Customization

Proteus-ID:身份一致且运动协调的视频定制

Guiyu Zhang, Chen Shi, Zijian Jiang, Xunzhi Xiang, Jingjing Qian, Shaoshuai Shi, Li Jiang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Nanjing University(南京大学) Voyager Research, Didi Chuxing(Voyager Research与滴滴出行)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 Proteus-ID通过多模态身份融合、时间感知身份注入和自适应运动学习,实现了身份一致且运动协调的视频定制,提升了视频生成的真实性和流畅度。

Comments SIGGRAPH Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03621 2026-02-04 astro-ph.IM physics.comp-ph 50%

A Method for Thermal Radiation Transport Using Backward Characteristic Tracing

利用反向特征追踪的热辐射传输方法

J. C. Dolence, H. R. Hammer, H. Park, B. Prather, B. R. Ryan, R. T. Wollaeger

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种反向特征追踪方法用于热辐射传输,通过优化计算成本和稳定性,提升性能并验证其在多个测试问题中的有效性。

Comments Submitted to Journal of Computational Physics

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13390 2026-02-04 astro-ph.SR 50%

Statistical properties of spicules in MURaM-ChE

MURaM-ChE中喷流的统计特性

Sanghita Chandra, Robert Cameron, Damien Przybylski, Sami K. Solanki

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究MURaM-ChE模拟中喷流的统计特性,比较其与观测结果的一致性,发现自洽形成I型和II型喷流,并探讨快速跃迁与喷流的关系。

Comments 10 pages, 9 figures, Accepted for publication in A&A

Journal ref A&A 706, A53 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06409 2026-02-04 astro-ph.EP astro-ph.SR 50%

Modelling dust coagulation, dynamical drag and turbulent mixing during star and disc formation

模拟恒星和盘形成过程中的尘埃凝聚、动力学阻力和湍流混合

Matthew R. Bate, Mark A. Hutchison, Daniel Elsender

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种结合隐式积分方法和SPH模拟的模型,用于研究恒星形成早期阶段和原行星盘中尘埃颗粒的凝聚、混合与迁移过程,通过湍流扩散提高尘埃颗粒生长效率。

Comments Submitted to MNRAS, includes changes following referee's first report. 29 pages, 18 figures

Journal ref Mon Not R Astron Soc (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09517 2026-02-04 math.PR 50%

From Cannings model to Brownian motion conditioned on local time profile

从Cannings模型到局部时间剖面条件下的布朗运动

Xiaodan Li, Chengshi Wang, Yushu Zheng

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了Cannings模型谱系树的缩放极限,证明了其收敛于局部时间剖面条件下的布朗运动,并利用从无穷下降性质进行证明。

Comments 50 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19436 2026-02-04 astro-ph.CO 50%

Sensitivity of the redshifted 21 cm signal from the Dark Ages to parameters of primordial magnetic fields

红移21厘米信号对原始磁场参数的敏感性分析

Bohdan Novosyadlyj, Yurii Kulinich, Nazar Fortuna, Anton Rudakovskyi

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究分析了原始磁场参数对红移21厘米信号的敏感性,揭示了其对黑暗时代宇宙热历史和电离过程的影响。

Comments 10 pages, 9 figures; accepted for publication in A&A

Journal ref A&A 706, A48 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07868 2026-02-04 cs.RO 50%

VISTA: Generative Visual Imagination for Vision-and-Language Navigation

VISTA: 生成式视觉想象用于视觉-语言导航

Yanjia Huang, Mingyang Wu, Renjie Li, Zhengzhong Tu

机构 * Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯大学阿姆斯特朗分校)

专题命中 扩散模型 :diffusion(abstract)

AI总结 VISTA通过生成式视觉想象与感知对齐策略,提升长距离视觉-语言导航任务的性能。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11182 2026-02-04 physics.bio-ph cond-mat.soft 50%

A Model for Self-Organized Growth, Branching, and Allometric Scaling of the Planarian Gut

一种自组织生长、分支和异速标度的平囊动物消化道模型

Christian Hanauer, Amrutha Palavalli, Baiqun An, Efe Ilker, Jochen C. Rink, Frank Jülicher

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种模型,用于研究平囊动物消化道的自组织生长、分支和异速标度,通过理论和实验结合的方法揭示了分支器官的生长机制和标度规律。

Journal ref PRX Life 4, 013014 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.13439 2026-02-04 physics.soc-ph nlin.AO 50%

Dynamics of ranking

排名的动力学

Gerardo Iñiguez, Carlos Pineda, Carlos Gershenson, Albert-László Barabási

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究揭示了排名系统中鲁棒性与适应性平衡的机制,通过分析30种系统中的排名动态,发现元素流动和位移替换机制影响排名稳定性。

Comments 12 pages, 3 figures. SI: 40 pages, 22 figures

Journal ref Iñiguez, G., Pineda, C., Gershenson, C., Barabási, A-.L. Dynamics of ranking. Nature Communications 13, 1646 (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03065 2026-02-04 physics.flu-dyn 50%

An effective correction method for droplet volume conservation in direct numerical simulation of droplet-laden turbulence

直接数值模拟中液滴体积守恒的有效校正方法

Cheng Peng, Xuming Li, Chunhua Zhang, Lian-Ping Wang, Xinnan Wu, Cheng Peng, Xuming Li, Chunhua Zhang, Lian-Ping Wang, Xinnan Wu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种改进的相场方程,通过引入曲率依赖的反扩散校正,实现液滴体积在湍流条件下的统计守恒,避免了传统方法的诸多问题。

Comments 28 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏