arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70196 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70196 篇

2505.23171 2026-01-07 cs.CV 79%

RoboTransfer: Controllable Geometry-Consistent Video Diffusion for Manipulation Policy Transfer

RoboTransfer: 可控的几何一致视频扩散用于操控策略迁移

Liu Liu, Xiaofeng Wang, Guosheng Zhao, Keyu Li, Wenkang Qin, Jiagang Zhu, Jiaxiong Qiu, Zheng Zhu, Guan Huang, Zhizhong Su

机构 * Horizon Robotics GigaAI CASIA

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 RoboTransfer通过可控的几何一致视频扩散技术,提升机器人操控策略在真实环境中的泛化能力。

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01914 2026-01-06 cs.CV 79%

Learning Action Hierarchies via Hybrid Geometric Diffusion

通过混合几何扩散学习动作层次结构

Arjun Ramesh Kaushik, Nalini K. Ratha, Venu Govindaraju

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出HybridTAS框架,通过混合欧几里得和双曲几何提升时间动作分割的层次结构建模能力,实验表明其在多个数据集上达到最优性能。

Comments Accepted at WACV-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24015 2026-01-06 cs.CV 79%

On Exact Editing of Flow-Based Diffusion Models

关于基于流的扩散模型的精确编辑

Zixiang Li, Yue Song, Jianing Peng, Ting Liu, Jun Huang, Xiaochao Qu, Luoqi Liu, Wei Wang, Yao Zhao, Yunchao Wei

机构 * Institute of Information Science, Beijing Jiaotong University(信息科学学院,北京交通大学) Visual Intelligence +X International Cooperation Joint Laboratory of MOE(视觉智能+X国际合作联合实验室) MT Lab, Meitu Inc(美图实验室,美图公司) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 CVC通过双视角速度转换机制改进基于流的扩散编辑,实现更稳定的潜在动态和更准确的图像转换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01507 2026-01-06 cs.CV 79%

DiffKD-DCIS: Predicting Upgrade of Ductal Carcinoma In Situ with Diffusion Augmentation and Knowledge Distillation

DiffKD-DCIS:基于扩散增强与知识蒸馏的导管癌原位癌升级预测

Tao Li, Qing Li, Na Li, Hui Xie

机构 * School of Medical Imaging, Laboratory Medicine and Rehabilitation, Xiangnan University(医学影像学院、实验室医学与康复学院,湘南大学) Department of Radiotherapy, Affiliated Hospital (Clinical College) of Xiangnan University(放疗科,湘南大学附属医院(临床学院)) Faculty of Applied Sciences, Macao Polytechnic University(应用科学学院,澳门 polytechnic 大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffKD-DCIS通过扩散增强与知识蒸馏方法,实现对导管癌原位癌升级的准确预测,提升诊断效率与临床价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01425 2026-01-06 cs.CV 79%

DreamID-V:Bridging the Image-to-Video Gap for High-Fidelity Face Swapping via Diffusion Transformer

DreamID-V:弥合图像到视频的差距,通过扩散变换器实现高保真的面部交换

Xu Guo, Fulong Ye, Xinghui Li, Pengqi Tu, Pengze Zhang, Qichao Sun, Songtao Zhao, Xiangwang Hou, Qian He

机构 * Tsinghua University(清华大学) Intelligent Creation Lab, ByteDance(字节跳动智能创作实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DreamID-V通过扩散变换器框架实现高保真视频面部交换,结合新型数据管道和强化学习策略,提升身份一致性和视觉真实性。

Comments Project: https://guoxu1233.github.io/DreamID-V/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01141 2026-01-06 eess.IV cs.CV 79%

YODA: Yet Another One-step Diffusion-based Video Compressor

YODA: 另一种一步扩散视频压缩器

Xingchen Li, Junzhe Zhang, Junqi Shi, Ming Lu, Zhan Ma

机构 * School of Electronic Science and Engineering, Nanjing University(电子科学与工程学院,南京大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 YODA通过嵌入时间参考的多尺度特征,结合线性扩散变换器,实现了更高效的视频压缩,其在多个感知指标上均优于现有方法。

Comments Code will be available at https://github.com/NJUVISION/YODA

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22615 2026-01-06 cs.CV cs.CL 79%

Dream-VL & Dream-VLA: Open Vision-Language and Vision-Language-Action Models with Diffusion Language Model Backbone

Dream-VL & Dream-VLA: 基于扩散语言模型的开放视觉语言和视觉语言-动作模型

Jiacheng Ye, Shansan Gong, Jiahui Gao, Junming Fan, Shuang Wu, Wei Bi, Haoli Bai, Lifeng Shang, Lingpeng Kong

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 基于扩散语言模型构建的Dream-VL和Dream-VLA在视觉语言和视觉语言-动作任务中表现出色,实现了领先的性能。

Comments Add real-world experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14681 2026-01-06 eess.IV cs.CV 79%

Virtual Multiplex Staining for Histological Images using a Marker-wise Conditioned Diffusion Model

使用标记条件扩散模型进行虚拟多标记染色

Hyun-Jic Oh, Junsik Kim, Zhiyi Shi, Yichen Wu, Yu-An Chen, Peter K Sorger, Hanspeter Pfister, Won-Ki Jeong

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出了一种基于条件扩散模型的虚拟多标记染色方法,利用预训练模型生成多标记图像,提升了H&E图像的分子层面分析能力。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02043 2026-01-06 cs.CV 79%

Conditional Diffusion Model with Anatomical-Dose Dual Constraints for End-to-End Multi-Tumor Dose Prediction

具有解剖剂量双约束的条件扩散模型用于端到端多肿瘤剂量预测

Hui Xie, Haiqin Hu, Lijuan Ding, Qing Li, Yue Sun, Tao Tan

机构 * Faculty of Applied Sciences, Macao Polytechnic University(澳门理工大学应用科学学院) Affiliated Hospital of Xiangnan University(湘南大学附属医院) Jiangxi Cancer Hospital(江西省肿瘤医院) Chenzhou Third People's Hospital(郴州第三人民医院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ADDiff-Dose通过条件扩散模型实现多肿瘤剂量预测,结合解剖和剂量约束,提升预测精度与临床适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00328 2026-01-05 cs.CV 79%

Joint Geometry-Appearance Human Reconstruction in a Unified Latent Space via Bridge Diffusion

通过桥扩散实现统一潜在空间中的几何-外观人类重建

Yingzhi Tang, Qijian Zhang, Junhui Hou

机构 * Department of Computer Science, City University of Hong Kong(城市大学计算机科学系) Tencent Games, Shenzhen, Guangdong, China(腾讯游戏,深圳,广东,中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出JGA-LBD框架,通过桥扩散统一几何与外观重建,提升3D数字人类重建的保真度和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23210 2026-01-05 cs.CV 79%

Task-oriented Learnable Diffusion Timesteps for Universal Few-shot Learning of Dense Tasks

面向任务的可学习扩散时间步用于密集任务的通用少样本学习

Changgyoon Oh, Jongoh Jeong, Jegyeong Cho, Kuk-Jin Yoon

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出面向任务的可学习扩散时间步方法,通过自适应选择最优时间步提升少样本密集预测性能。

Comments Prematurely uploaded without mutual consent by all authors, with critical modifications necessary in the references

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21890 2026-01-05 cs.CV 79%

CrownGen: Patient-customized Crown Generation via Point Diffusion Model

CrownGen: 通过点扩散模型实现患者定制的牙冠生成

Juyoung Bae, Moo Hyun Son, Jiale Peng, Wanting Qu, Wener Chen, Zelin Qiu, Kaixin Li, Xiaojuan Chen, Yifan Lin, Hao Chen

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Hong Kong University of Science and Technology(香港科学与技术大学) Division of Pediatric Dentistry and Orthodontics, Faculty of Dentistry(牙科学院儿童牙科与正畸科) University of Hong Kong(香港大学) Department of Chemical and Biological Engineering(化学与生物工程系) Division of Life Science(生命科学系) HKUST Shenzhen-Hong Kong Collaborative Innovation Research Institute(香港科技大学深圳-香港联合创新研究院) State Key Laboratory of Nervous System Disorders(神经系统疾病国家重点实验室) Delun Dental Hospital(德尔润牙科医院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 CrownGen通过点扩散模型实现患者定制的牙冠自动化生成,提升了牙科修复的效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24948 2026-01-01 cs.CV cs.LG 79%

ProDM: Synthetic Reality-driven Property-aware Progressive Diffusion Model for Coronary Calcium Motion Correction in Non-gated Chest CT

ProDM:合成现实驱动的属性感知渐进扩散模型用于非门控胸部CT中的冠状动脉钙运动校正

Xinran Gong, Gorkem Durak, Halil Ertugrul Aktas, Vedat Cicek, Jinkui Hao, Ulas Bagci, Nilay S. Shah, Bo Zhou

机构 * Department of Radiology, Northwestern University, Chicago, IL, USA College of Computing, Georgia Institute of Technology, Atlanta, GA, USA Department of Biomedical Engineering, Northwestern University, Evanston, IL, USA Department of Cardiology, Northwestern University, Chicago, IL, USA Department of Preventive Medicine, Northwestern University, Chicago, IL, USA

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ProDM通过属性感知渐进校正扩散模型,有效校正非门控胸部CT中的运动伪影,提升冠状动脉钙评分的准确性与临床实用性。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24499 2026-01-01 cs.CR cs.CV 79%

Training-Free Color-Aware Adversarial Diffusion Sanitization for Diffusion Stegomalware Defense at Security Gateways

无需训练的色感知对抗扩散净化用于安全网关的扩散隐写术防御

Vladimir Frants, Sos Agaian

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出无需训练的对抗扩散净化方法,通过中和隐藏负载而非检测来防御扩散隐写术,有效降低安全网关的威胁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24473 2026-01-01 cs.CV cs.AI eess.IV 79%

F2IDiff: Real-world Image Super-resolution using Feature to Image Diffusion Foundation Model

F2IDiff: 利用特征到图像扩散基础模型进行现实世界图像超分辨率

Devendra K. Jangid, Ripon K. Saha, Dilshan Godaliyadda, Jing Li, Seok-Jun Lee, Hamid R. Sheikh

机构 * MPI Lab, Samsung Research America(Samsung Research America研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 F2IDiff通过使用低层次特征条件的扩散模型提升现实世界图像超分辨率性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24227 2026-01-01 cs.CV 79%

Mirage: One-Step Video Diffusion for Photorealistic and Coherent Asset Editing in Driving Scenes

Mirage: 驾驶场景中光实且一致的资产编辑一步视频扩散

Shuyun Wang, Haiyang Sun, Bing Wang, Hangjun Ye, Xin Yu

机构 * The University of Queensland(昆士兰大学) Xiaomi EV(小米电动车)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Mirage提出了一种用于驾驶场景中光实且一致的资产编辑的一步视频扩散模型,通过引入时序无关的潜在特征和两阶段数据对齐策略,提升了视觉保真度和时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24165 2026-01-01 cs.CV 79%

DiffThinker: Towards Generative Multimodal Reasoning with Diffusion Models

DiffThinker: 向基于扩散模型的生成多模态推理迈进

Zefeng He, Xiaoye Qu, Yafu Li, Tong Zhu, Siyuan Huang, Yu Cheng

机构 * Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffThinker通过基于扩散模型的生成方法,在多模态推理任务中实现了更高效的视觉推理和更精确的空间处理,显著优于现有模型。

Comments Project page: https://diffthinker-project.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24111 2026-01-01 cs.CV cs.RO 79%

Guided Diffusion-based Generation of Adversarial Objects for Real-World Monocular Depth Estimation Attacks

引导扩散生成对抗性物体用于现实世界单目深度估计攻击

Yongtao Chen, Yanbo Wang, Wentao Zhao, Guole Shen, Tianchen Deng, Jingchuan Wang

机构 * School of Automation and Intelligent Sensing, Institute of Medical Robotics, Shanghai Jiao Tong University(自动化与智能感知学院、医疗机器人研究院、上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种无需训练的生成对抗攻击框架,通过扩散模型生成自然且场景一致的对抗性物体,以提升自动驾驶系统中单目深度估计的对抗攻击效果和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24035 2026-01-01 cs.CV 79%

Reinforced Diffusion: Learning to Push the Limits of Anisotropic Diffusion for Image Denoising

强化扩散:学习推动各向异性扩散的极限以实现图像去噪

Xinran Qin, Yuhui Quan, Ruotao Xu, Hui Ji

机构 * School of Computer Science and Engineering at South China University of Technology(华南理工大学计算机科学与工程学院) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于强化学习的可训练各向异性扩散框架,通过深度Q学习优化扩散过程,提升图像去噪性能,优于传统方法并可与深度CNN方法竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20000 2026-01-01 cs.CV 79%

Few-Shot-Based Modular Image-to-Video Adapter for Diffusion Models

基于少样本的模块化图像到视频适配器用于扩散模型

Zhenhao Li, Shaohan Yi, Zheng Liu, Leonartinus Gao, Minh Ngoc Le, Ambrose Ling, Zhuoran Wang, Md Amirul Islam, Zhixiang Chi, Yuanhao Yu

机构 * Huawei Technologies Canada(华为加拿大技术有限公司) University of Waterloo(滑铁卢大学) University of British Columbia(不列颠哥伦比亚大学) University of Toronto(多伦多大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MIVA,一种轻量级模块化适配器,用于在扩散模型中实现更精确的运动控制,同时保持或提升生成质量。

Comments GitHub page: https://github.com/yishaohan/MIVA

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01085 2026-01-01 cs.CV 79%

Bidirectional Sparse Attention for Faster Video Diffusion Training

双向稀疏注意力用于更快的视频扩散训练

Chenlu Zhan, Wen Li, Chuyu Shen, Jun Zhang, Suhui Wu, Hao Zhang

机构 * ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出双向稀疏注意力框架,通过动态稀疏化查询和键值对,显著提升视频扩散模型的训练效率,同时保持生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22731 2026-01-01 cs.MM 79%

GestureHYDRA: Semantic Co-speech Gesture Synthesis via Hybrid Modality Diffusion Transformer and Cascaded-Synchronized Retrieval-Augmented Generation

GestureHYDRA: 通过混合模态扩散变换器和级联同步检索增强生成进行语义同步手势合成

Quanwei Yang, Luying Huang, Kaisiyuan Wang, Jiazhi Guan, Shengyi He, Fengguo Li, Hang Zhou, Lingyun Yu, Yingying Li, Haocheng Feng, Hongtao Xie

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.MM

AI总结 GestureHYDRA通过混合模态扩散变换器和级联同步检索增强生成技术,实现具有明确语义的手势合成,提升手势生成的准确性和效率。

Comments 10 pages, 5 figures, Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15159 2026-01-01 cs.CV 79%

OnlineVPO: Align Video Diffusion Model with Online Video-Centric Preference Optimization

OnlineVPO: 对齐视频扩散模型与在线视频中心偏好优化

Jiacheng Zhang, Jie Wu, Weifeng Chen, Yatai Ji, Xuefeng Xiao, Weilin Huang, Kai Han

机构 * The University of Hong Kong(香港大学) ByteDance Project Page(字节跳动项目)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 OnlineVPO通过改进反馈源和调节方法,提出一种针对视频扩散模型的高效偏好学习框架,提升视频生成质量与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23705 2025-12-30 cs.CV 79%

Diffusion Knows Transparency: Repurposing Video Diffusion for Transparent Object Depth and Normal Estimation

扩散知道透明:将视频扩散用于透明物体深度和法线估计

Shaocong Xu, Songlin Wei, Qizhe Wei, Zheng Geng, Hong Li, Licheng Shen, Qianpu Sun, Shu Han, Bin Ma, Bohan Li, Chongjie Ye, Yuhang Zheng, Nan Wang, Saining Zhang, Hao Zhao

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) University of Southern California(南加州大学) Tsinghua University(清华大学) Beihang University(北航) Wuhan University(武汉大学) Shanghai Jiao Tong University(上海交通大学) European Institute of Innovation and Technology Ningbo(创新与技术欧洲研究所宁波) FNii, The Chinese University of Hong Kong, Shenzhen(FNii,香港中文大学(深圳)) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DKT模型,利用视频扩散模型估计透明物体的深度和法线,实现零样本SOTA,提升现实和合成视频中的透明感知性能。

Comments Project Page: https://daniellli.github.io/projects/DKT/; Code: https://github.com/Daniellli/DKT; Dataset: https://huggingface.co/datasets/Daniellesry/TransPhy3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23232 2025-12-30 cs.CV 79%

SURE Guided Posterior Sampling: Trajectory Correction for Diffusion-Based Inverse Problems

SURE引导的后验采样:基于扩散模型的逆问题轨迹校正

Minwoo Kim, Hongki Lim

机构 * Department of Electrical and Computer Engineering(电子与计算机工程系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 SURE引导的后验采样通过减少误差累积提升扩散模型在逆问题中的重建质量,实现更高效的样本生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22881 2025-12-30 cs.CV 79%

Guided Path Sampling: Steering Diffusion Models Back on Track with Principled Path Guidance

引导路径采样:通过原理性路径引导将扩散模型重新引导到正确轨道

Haosen Li, Wenshuo Chen, Shaofeng Liang, Lei Wang, Haozhe Jia, Yutao Yue

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Griffith University\&Data61/CSIRO(格里菲斯大学与Data61/CSIRO)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 引导路径采样通过原理性路径引导提升扩散模型的稳定性和生成质量,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21734 2025-12-30 cs.CV 79%

Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation

结绳强制:驯服自回归视频扩散模型以实现实时无限交互肖像动画

Steven Xiao, Xindi Zhang, Dechao Meng, Qi Wang, Peng Zhang, Bang Zhang

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里集团)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Knot Forcing通过分块生成、时间结模块和提前运行机制,解决实时肖像动画中的时间一致性、误差累积和长期一致性问题,实现高保真、低延迟的无限交互动画。

Comments Project Page: https://humanaigc.github.io/knot_forcing_demo_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19823 2025-12-30 cs.CV 79%

Learning to Refocus with Video Diffusion Models

利用视频扩散模型学习重聚焦

SaiKiran Tedla, Zhoutong Zhang, Xuaner Zhang, Shumian Xin

机构 * Adobe, USA \& York University Canada Adobe USA Adobe, USA \& York University Adobe

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出利用视频扩散模型实现拍摄后重聚焦,生成感知准确的焦点堆栈,提升日常摄影的聚焦编辑能力。

Comments Code and data are available at https://learn2refocus.github.io . SIGGRAPH Asia 2025, Dec. 2025

Journal ref Proceedings of the SIGGRAPH Asia 2025, pp. 1-11, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00019 2025-12-30 eess.IV cs.CV cs.LG 79%

Diffusion MRI with Machine Learning

利用机器学习的扩散磁共振成像

Davood Karimi, Simon K. Warfield

机构 * Harvard Medical School and Boston Children’s Hospital(哈佛医学院和波士顿儿童医院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文探讨了机器学习在扩散磁共振成像分析中的应用,评估了现有方法的优缺点,并提出了未来研究的方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22324 2025-12-30 cs.CV 79%

DeMoGen: Towards Decompositional Human Motion Generation with Energy-Based Diffusion Models

DeMoGen:基于能量扩散模型的分解式人类动作生成

Jianrong Zhang, Hehe Fan, Yi Yang

机构 * ReLER, AAII, University of Technology Sydney(技术悉尼大学) CCAI, Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DeMoGen通过能量扩散模型实现动作分解生成,提出三种训练变体以促进动作分解学习,并构建文本分解数据集支持组合训练。

Comments Project page: https://jiro-zhang.github.io/DeMoGen/

详情

展开后加载摘要…

URL PDF HTML 收藏