Fewer Steps, Better Performance: Efficient Cross-Modal Clip Trimming for Video Moment Retrieval Using Language
更少步骤,更优性能:基于语言的高效跨模态视频片段修剪用于视频时刻检索
机构 * Hubei Engineering Research Center on Big Data Security, School of Cyber Science and Engineering, Huazhong University of Science of Technology(湖北大数据安全工程研究中心,网络安全学院,华中科技大学) ; Peking University(北京大学) ; Henan University(河南大学) ; Dalian University of Technology(大连理工大学) ; Sichuan University(四川大学) ; Shenzhen University(深圳大学) ; Huazhong University of Science and Technology(华中科技大学)
AI总结 提出SpotVMR方法,通过可学习的片段搜索模型和低成本语义索引特征,高效修剪查询相关视频片段,作为即插即用模块提升现有VMR方法的效率与性能。
Comments Published in AAAI 2024