arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-12-04 至 2025-12-04 共收录 68 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 9 篇

2512.03844 2025-12-04 cs.CV 88%

CoDA: From Text-to-Image Diffusion Models to Training-Free Dataset Distillation

CoDA:从文本到图像扩散模型到无训练数据集蒸馏

Letian Zhou, Songhua Liu, Xinchao Wang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 CoDA通过核心分布对齐技术,利用现成文本到图像模型实现无训练数据集蒸馏,提升目标语义与通用生成先验的对齐,取得ImageNet-1K的高准确率。

Comments 34 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03749 2025-12-04 cs.CV 88%

Fully Unsupervised Self-debiasing of Text-to-Image Diffusion Models

文本到图像扩散模型的完全无监督自去偏

Korada Sri Vardhana, Shrikrishna Lolla, Soma Biswas

机构 * Indian Institute of Science(印度科学研究院)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 SelfDebias是一种完全无监督的文本到图像扩散模型去偏方法,通过识别语义聚类来减少生成图像中的偏见,同时保持视觉真实性。

Comments Accepted at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03996 2025-12-04 cs.CV cs.AI 83%

Highly Efficient Test-Time Scaling for T2I Diffusion Models with Text Embedding Perturbation

面向T2I扩散模型的高效测试时缩放方法:文本嵌入扰动

Hang Xu, Linjiang Huang, Feng Zhao

机构 * MoE Key Lab of BIPC, USTC(信息与通信前沿技术联合实验室,中国科学技术大学) Beihang University(北京航空航天大学)

专题命中 文生图 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出文本嵌入扰动方法,通过结合频率引导的噪声调度与空间噪声扰动,提升T2I扩散模型生成质量与多样性,无需额外计算资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21209 2025-12-04 cs.CV cs.AI 77%

BitMark: Watermarking Bitwise Autoregressive Image Generative Models

BitMark: 图像生成模型中位级水印技术

Louis Kerner, Michel Meintz, Bihe Zhao, Franziska Boenisch, Adam Dziedzic

机构 * CISPA Helmholtz Center for Information Security(CISPA 河岸信息安全中心)

专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 BitMark通过位级水印技术防止图像生成模型中的模型崩溃,确保生成内容可检测。

Comments Accepted as a Conference Paper at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03905 2025-12-04 cs.CV 70%

Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence

无监督视频翻译与编辑中的帧空间-时间对应

Shuai Yang, Junxin Lin, Yifan Zhou, Ziwei Liu, Chen Change Loy

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) S-Lab, Nanyang Technological University(南洋理工大学S实验室)

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 FRESCO通过整合帧内与帧间对应关系,提升视频翻译与编辑的空间-时间一致性,实现高质量、一致的视频生成。

Comments Code: https://github.com/Sunnycookies/FRESCO-v2, Project: https://williamyang1991.github.io/projects/FRESCOv2/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03463 2025-12-04 cs.CV cs.AI cs.CL 70%

Text-Printed Image: Bridging the Image-Text Modality Gap for Text-centric Training of Large Vision-Language Models

文本打印图像:为以文本为中心的大型视觉-语言模型训练弥合图像-文本模态差距

Shojiro Yamabe, Futa Waseda, Daiki Shiono, Tsubasa Takahashi

机构 * Turing Inc.(图灵公司) Institute of Science Tokyo(东京科学研究院) The University of Tokyo(东京大学) Tohoku University(东北大学)

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本研究提出文本打印图像(TPI)技术,通过生成合成图像弥合图像-文本模态差距,提升以文本为中心的大型视觉-语言模型训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05127 2025-12-04 eess.IV cs.CV q-bio.QM 70%

PixCell: A generative foundation model for digital histopathology images

PixCell:数字病理图像的生成基础模型

Srikar Yellapragada, Alexandros Graikos, Zilinghan Li, Kostas Triaridis, Varun Belagali, Tarak Nath Nandi, Karen Bai, Beatrice S. Knudsen, Tahsin Kurc, Rajarsi R. Gupta, Prateek Prasanna, Ravi K Madduri, Joel Saltz, Dimitris Samaras

机构 * Stony Brook University(石溪大学) Argonne National Laboratory(阿贡国家实验室) The University of Chicago(芝加哥大学) University of Utah(犹他大学)

专题命中 文生图 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 PixCell是首个针对数字病理图像的生成基础模型,通过扩散模型在大规模数据集上训练,实现隐私保护的数据生成和虚拟染色任务,提升病理学研究效率。

Comments Project page - https://histodiffusion.github.io/docs/projects/pixcell

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03052 2025-12-04 cs.GR cs.CV 62%

LATTICE: Democratize High-Fidelity 3D Generation at Scale

LATTICE:大规模实现高保真3D生成

Zeqiang Lai, Yunfei Zhao, Zibo Zhao, Haolin Liu, Qingxiang Lin, Jingwei Huang, Chunchao Guo, Xiangyu Yue

机构 * MMLab, CUHK(CUHK人工智能实验室) Tencent Hunyuan(腾讯文言)

专题命中 文生图 :image synthesis(abstract);分类 cs.CV、cs.GR

AI总结 LATTICE通过VoxSet半结构化表示实现高效高保真3D生成,支持任意分辨率解码和灵活推理,达到最先进的性能。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03534 2025-12-04 cs.CV cs.AI 57%

Rethinking Prompt Design for Inference-time Scaling in Text-to-Visual Generation

重新思考推理时的提示设计以实现文本到视觉生成的扩展

Subin Kim, Sangwoo Mo, Mamshad Nayeem Rizve, Yiran Xu, Difan Liu, Jinwoo Shin, Tobias Hinz

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 PRIS通过自适应修改提示以实现文本到视觉生成的推理时扩展,提高生成质量并解决提示固定导致的质量停滞问题。

Comments Visualizations are available at the website: https://subin-kim-cv.github.io/PRIS

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 2 篇

2512.03981 2025-12-04 cs.CV 83%

DirectDrag: High-Fidelity, Mask-Free, Prompt-Free Drag-based Image Editing via Readout-Guided Feature Alignment

DirectDrag: 一种高保真、无掩码、无提示的拖动图像编辑方法通过读取引导的特征对齐

Sheng-Hao Liao, Shang-Fu Chen, Tai-Ming Huang, Wen-Huang Cheng, Kai-Lung Hua

机构 * National Taiwan University of Science and Technology(台湾科技大学) National Taiwan University(台湾大学) Microsoft Taiwan(微软台湾)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 DirectDrag通过读取引导的特征对齐方法实现无掩码、无提示的拖动图像编辑,提升图像质量和拖动精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03142 2025-12-04 cs.CV 83%

UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying

UniEdit-I: 基于迭代理解、编辑和验证的无训练图像编辑

Chengyu Bai, Jintao Chen, Xiang Bai, Yilong Chen, Qi She, Ming Lu, Shanghang Zhang

机构 * Peking University(北京大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 UniEdit-I通过在语义潜在空间中引入迭代理解、编辑和验证循环,实现了无训练的闭环图像编辑,无需微调或架构修改即可达到最先进的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 45 篇

2512.03247 2025-12-04 cs.CV 85%

PixPerfect: Seamless Latent Diffusion Local Editing with Discriminative Pixel-Space Refinement

PixPerfect: 基于判别像素空间的无缝潜在扩散局部编辑

Haitian Zheng, Yuan Yao, Yongsheng Yu, Yuqian Zhou, Jiebo Luo, Zhe Lin

机构 * Adobe Research(Adobe研究院) University of Rochester(罗切斯特大学)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);inpainting(abstract);分类 cs.CV

AI总结 PixPerfect通过判别像素空间和伪影模拟流程,实现跨不同LDM架构和任务的无缝高保真局部编辑。

Comments Published in the Thirty-ninth Annual Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11056 2025-12-04 cs.CV 83%

Flow to the Mode: Mode-Seeking Diffusion Autoencoders for State-of-the-Art Image Tokenization

流到模式:用于最新图像标记化的模式寻求扩散自编码器

Kyle Sargent, Kyle Hsu, Justin Johnson, Li Fei-Fei, Jiajun Wu

机构 * Stanford University(斯坦福大学) University of Michigan(密歇根大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 FlowMo是一种基于Transformer的扩散自编码器,通过模式匹配和模式寻求阶段实现图像标记化的新SOTA,无需卷积、对抗损失等。

Comments ICCV 2025, 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06424 2025-12-04 cs.CV 83%

Margin-aware Preference Optimization for Aligning Diffusion Models without Reference

基于边界的偏好优化:无需参考的扩散模型对齐

Jiwoo Hong, Sayak Paul, Noah Lee, Kashif Rasul, James Thorne, Jongheon Jeong

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出MaPO,一种无需参考的扩散模型对齐方法,通过优化偏好输出与非偏好输出之间的边界,提升T2I任务的适应性能,减少训练时间并优于现有方法。

Comments Accepted to AAAI 2026 Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03056 2025-12-04 cs.LG cs.AI 82%

Delta Sampling: Data-Free Knowledge Transfer Across Diffusion Models

Delta Sampling: 数据无源的知识迁移跨扩散模型

Zhidong Gao, Zimeng Pan, Yuhang Yao, Chenyue Xie, Wei Wei

机构 * Shanxi University(山西大学) Google Cloud(谷歌云) Carnegie Mellon University(卡内基梅隆大学) University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract)

AI总结 Delta Sampling通过推理时利用模型预测差异实现跨不同架构基模型的知识迁移,无需原始训练数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03566 2025-12-04 cs.CV cs.MM 81%

GAOT: Generating Articulated Objects Through Text-Guided Diffusion Models

通过文本引导的扩散模型生成拟人化物体:GAOT

Hao Sun, Lei Fan, Donglin Di, Shaohui Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学) University of New South Wales(新南威尔士大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

AI总结 GAOT通过文本引导的扩散模型和超图学习,实现从文本提示到拟人化物体的生成,取得优于现有方法的性能。

Comments Accepted by ACM MM Asia2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03673 2025-12-04 cs.CV 79%

ConvRot: Rotation-Based Plug-and-Play 4-bit Quantization for Diffusion Transformers

ConvRot:基于旋转的插拔式4位量化用于扩散变换器

Feice Huang, Zuliang Han, Xing Zhou, Yihuang Chen, Lifei Zhu, Haoqian Wang

机构 * SIGS, Tsinghua University(清华大学信号与信息系) Central Media Technology Institute, Huawei(华为中央媒体技术研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ConvRot提出基于旋转的4位量化方法,通过正则Hadamard变换抑制异常值,实现扩散变换器的插拔式W4A4推理,提升速度和内存效率同时保持图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19499 2025-12-04 cs.CV cs.AI 79%

Sat2Flow: A Structure-Aware Diffusion Framework for Human Flow Generation from Satellite Imagery

Sat2Flow: 一种结构感知的扩散框架,用于从卫星图像生成人类流量

Xiangxu Wang, Tianhong Zhao, Wei Tu, Bowen Zhang, Guanzhou Chen, Jinzhou Cao

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Sat2Flow通过结构感知的扩散框架,利用卫星图像生成结构一致的OD流量,解决了现有方法对辅助数据依赖和空间拓扑变化敏感的问题。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14430 2025-12-04 cs.CV cs.AI cs.PF 79%

PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference

PipeFusion: 基于扩散变换器推理的片级流水线并行

Jiarui Fang, Jinzhe Pan, Aoyu Li, Xibo Sun, Jiannan Wang

机构 * ByteDance(字节跳动) HUST(华中科技大学) Tencent(腾讯) The University of Hong Kong(香港大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 PipeFusion通过片级流水线并行方法,提高扩散变换器推理的效率和性能,适用于大模型如Flux.1。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03451 2025-12-04 cs.CV cs.AI cs.LG 79%

GalaxyDiT: Efficient Video Generation with Guidance Alignment and Adaptive Proxy in Diffusion Transformers

GalaxyDiT:通过引导对齐和自适应代理实现高效的视频生成

Zhiye Song, Steve Dai, Ben Keller, Brucek Khailany

机构 * Massachusetts Institute of Technology(麻省理工学院) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 GalaxyDiT通过引导对齐和自适应代理选择,提升视频生成效率,实现高达2.37倍的速度提升并保持高质量输出

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03450 2025-12-04 cs.CV cs.LG 79%

KeyPointDiffuser: Unsupervised 3D Keypoint Learning via Latent Diffusion Models

KeyPointDiffuser: 通过潜在扩散模型实现无监督的3D关键点学习

Rhys Newbury, Juyan Zhang, Tin Tran, Hanna Kurniawati, Dana Kulić

机构 * Monash University(蒙纳士大学) Australian National University(澳大利亚国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 KeyPointDiffuser通过潜在扩散模型实现无监督3D关键点学习,提升关键点一致性6个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03430 2025-12-04 cs.CV 79%

Label-Efficient Hyperspectral Image Classification via Spectral FiLM Modulation of Low-Level Pretrained Diffusion Features

通过低级预训练扩散特征的光谱FiLM调制实现标签高效的超光谱图像分类

Yuzhen Hu, Biplab Banerjee, Saurabh Prasad

机构 * University of Houston, Texas, USA(德克萨斯大学) Indian Institute of Technology Bombay, Mumbai, India(印度班加罗尔理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于预训练扩散模型的标签高效超光谱图像分类方法,通过光谱FiLM调制融合空间和光谱信息,提升分类性能。

Comments Accepted to the ICML 2025 TerraBytes Workshop (June 9, 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03317 2025-12-04 cs.CV cs.AI cs.LG cs.RO 79%

NavMapFusion: Diffusion-based Fusion of Navigation Maps for Online Vectorized HD Map Construction

NavMapFusion: 基于扩散的导航地图融合用于在线向量化的高精度地图构建

Thomas Monninger, Zihan Zhang, Steffen Staab, Sihao Ding

机构 * Mercedes-Benz Research & Development North America, USA(梅赛德斯-奔驰北美研究与开发) University of Stuttgart, Germany(斯图加特大学) University of California, San Diego, USA(加州大学圣地亚哥分校) University of Southampton, United Kingdom(南安普顿大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 NavMapFusion通过结合低保真先验与高保真传感器数据,利用扩散模型实现在线高精度地图构建,提升环境表示的准确性和实时性。

Comments Accepted to 2026 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03813 2025-12-04 math.DS 78%

Hopf bifurcations in a reaction-diffusion model with a general advection term and delay effect

具有通用对流项和延迟效应的反应扩散模型中的Hopf分岔

Jingxiao Song, Chengwei Ren, Shaofen Zou

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了具有通用对流项和延迟效应的反应扩散模型,通过分析Hopf分岔的方向和稳定性,验证了模型在种群动态中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03759 2025-12-04 cs.CL cs.AI cs.LG 78%

Principled RL for Diffusion LLMs Emerges from a Sequence-Level Perspective

从序列层面视角出发的扩散大语言模型原理化强化学习

Jingyang Ou, Jiaqi Han, Minkai Xu, Shaoxuan Xu, Jianwen Xie, Stefano Ermon, Yi Wu, Chongxuan Li

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大模型与智能治理研究重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程技术研究中心) Stanford University(斯坦福大学) Lambda, Inc(Lambda公司) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出ESPO,一种基于序列级优化的原理化强化学习框架,用于提升扩散大语言模型的生成能力,通过ELBO作为似然代理,显著优于token级方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08873 2025-12-04 cond-mat.soft physics.chem-ph 78%

Coherent X-rays reveal anomalous molecular diffusion and cage effects in crowded protein solutions

相干X射线揭示拥挤蛋白质溶液中异常分子扩散和笼效应

Anita Girelli, Maddalena Bin, Mariia Filianina, Michelle Dargasz, Nimmi Das Anthuparambil, Johannes Möller, Alexey Zozulya, Iason Andronis, Sonja Timmermann, Sharon Berkowicz, Sebastian Retzbach, Mario Reiser, Agha Mohammad Raza, Marvin Kowalski, Mohammad Sayed Akhundzadeh, Jenny Schrage, Chang Hee Woo, Maximilian D. Senft, Lara Franziska Reichart, Aliaksandr Leonau, Prince Prabhu Rajaiah, William Chèvremont, Tilo Seydel, Jörg Hallmann, Angel Rodriguez-Fernandez, Jan-Etienne Pudell, Felix Brausse, Ulrike Boesenberg, James Wrigley, Mohamed Youssef, Wei Lu, Wonhyuk Jo, Roman Shayduk, Trey Guest, Anders Madsen, Felix Lehmkühler, Michael Paulus, Fajun Zhang, Frank Schreiber, Christian Gutt, Fivos Perakis

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 利用MHz-XPCS研究铁蛋白在拥挤环境中的异常扩散及笼效应,通过δγ理论建模揭示蛋白质在细胞质中的复杂运动机制。

Comments This version of the article has been accepted for publication after peer review, but is not the Version of Record and does not reflect post-acceptance improvements or any corrections. The Version of Record is available online at: https://doi.org/10.1038/s41467-025-66972-6

Journal ref Nature Communications volume 16, Article number: 10814 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05794 2025-12-04 eess.IV 78%

Robust Physics-based Deep MRI Reconstruction Via Diffusion Purification

通过扩散净化实现鲁棒的基于物理的深度MRI重建

Ismail Alkhouri, Shijun Liang, Rongrong Wang, Qing Qu, Saiprasad Ravishankar

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出通过扩散模型净化提升MRI重建的鲁棒性,避免对抗训练的minimax优化,仅需微调即可提高模型稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.13480 2025-12-04 math.AP 78%

Kinks and solitons in linear and nonlinear-diffusion Keller-Segel type models with logarithmic sensitivity

线性和非线性扩散凯勒-塞格尔型模型中的结节和孤子

Juan Campos, Claudia García, Carlos Pulido, Juan Soler

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了凯勒-塞格尔模型中线性和非线性扩散情况下旅行波模式的存在性及差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03564 2025-12-04 cs.LG cs.CR 78%

Towards Irreversible Machine Unlearning for Diffusion Models

向扩散模型的不可逆机器遗忘学习迈进

Xun Yuan, Zilong Zhao, Jiayu Li, Aryan Pasikhani, Prosanta Gope, Biplab Sikdar

机构 * Department of Electrical and Computer Engineering, College of Design and Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系,设计与工程学院) Betterdata, Singapore(新加坡Betterdata公司) Department of Computer Science, University of Sheffield(谢菲尔德大学计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出DiMRA攻击可逆转基于微调的扩散模型机器遗忘学习方法,并提出DiMUM方法通过记忆替代数据提升模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03234 2025-12-04 stat.ML cs.LG 78%

Iterative Tilting for Diffusion Fine-Tuning

迭代倾斜用于扩散微调

Jean Pachebat, Giovanni Conforti, Alain Durmus, Yazid Janati

机构 * CMAP, École Polytechnique(巴黎高等理工学院计算机学院) Università degli Studi di Padova(帕多瓦大学) Institute of Foundation Models(基础模型研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出迭代倾斜方法,通过分解奖励倾斜并利用泰勒展开实现扩散模型的高效微调,适用于具有线性奖励的二维高斯混合物场景。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏