Conditional Multi-Event Temporal Grounding in Long-Form Video
长视频中的条件多事件时间定位
机构 * University of Central Florida(中佛罗里达大学) ; Qualcomm AI Research(高通人工智能研究院)
AI总结 提出CoMET-Bench基准和CoMET-Agent框架,解决长视频中基于组合时空条件定位所有事件的任务,F1@0.5提升6.1%。
大厂专区
长视频中的条件多事件时间定位
机构 * University of Central Florida(中佛罗里达大学) ; Qualcomm AI Research(高通人工智能研究院)
AI总结 提出CoMET-Bench基准和CoMET-Agent框架,解决长视频中基于组合时空条件定位所有事件的任务,F1@0.5提升6.1%。