Enrich and Detect: Video Temporal Grounding with Multimodal LLMs
机构 * FAIR, Meta(FAIR、Meta) ; Johns Hopkins University(约翰霍普金斯大学) ; Northeastern University(东北大学)
Comments ICCV 2025 (Highlights)
高校专区
机构 * FAIR, Meta(FAIR、Meta) ; Johns Hopkins University(约翰霍普金斯大学) ; Northeastern University(东北大学)
Comments ICCV 2025 (Highlights)
机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院) ; Xiaohongshu Inc.(小红书公司) ; Renmin University of China(中国人民大学) ; Johns Hopkins University(约翰霍普金斯大学)
Comments Accepted by NeurIPS 2025 (Track on Datasets and Benchmarks)
机构 * Johns Hopkins University, USA(约翰斯·霍普金斯大学) ; HKUST, Hong Kong SAR, China(香港科技大学) ; Johns Hopkins University(约翰斯·霍普金斯大学)
机构 * Stanford University(斯坦福大学) ; Together AI ; Johns Hopkins University(约翰霍普金斯大学) ; Cornell University(康奈尔大学)
机构 * EPFL(苏黎世联邦理工学院) ; Stanford University(斯坦福大学) ; University of California, Berkeley(加州大学伯克利分校) ; Johns Hopkins University(约翰霍普金斯大学)
Comments 19 pages, 4 figures, 9 tables
机构 * Johns Hopkins University(约翰霍普金斯大学) ; Northwestern University(西北大学) ; University of Rochester(罗切斯特大学) ; Brown University(布朗大学)