Empathetic Motion Generation for Humanoid Educational Robots via Reasoning-Guided Vision--Language--Motion Diffusion Architecture
通过推理引导的视觉-语言-运动扩散架构生成 empathetic 动作 for 人类教育机器人
机构 * Department of Computer Science and Engineering(计算机科学与工程系)
专题命中 多模态生成 :multi-modal(abstract)
AI总结 本文提出RG-VLMD框架,通过多模态情感估计、教学推理和教学-动作条件运动合成,生成适应性且语义一致的机器人行为。实验表明,推理引导的指令条件生成提升了教育人机交互中的动作可控性和教学表达性。