Text Dictates, Music Decorates: Energy-based Attention for Editable Dance Motion Generation
文本主导,音乐装饰:基于能量的注意力机制用于可编辑舞蹈动作生成
机构 * University of Maryland, College Park(马里兰大学帕克分校)
专题命中 可控生成 :diffusion(abstract)
AI总结 提出STREAM模型,通过模态解耦的扩散变压器分离文本语义和音乐节奏控制,实现可编辑舞蹈动作生成,并引入新数据集Motorica++和评估指标EDS。
Comments Accepted to ECCV 2026