Multi-Modal Graph Convolutional Network with Sinusoidal Encoding for Robust Human Action Segmentation
多模态图卷积网络与正弦编码用于鲁棒的人体动作分割
机构 * Institute for Cognitive Systems(认知系统研究所) ; Chair of Media Technology(媒体技术教授职位) ; Machine Vision and Perception Group(机器视觉与感知小组) ; School of Computation, Information and Technology(计算、信息与技术学院)
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.CV
AI总结 本文提出多模态图卷积网络与正弦编码方法,通过融合低帧率和高帧率数据提升人体动作分割的鲁棒性,实验表明在双手动作数据集上显著提高分割准确率。
Comments 8 pages, 5 figures, accepted in IROS25, Hangzhou, China