ELV-Halluc: Benchmarking Semantic Aggregation Hallucinations in Long Video Understanding
机构 * Sensetime(秒氏科技)
专题命中 视频理解 :video understanding(title,abstract);long video(title,abstract);分类 cs.CV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * Sensetime(秒氏科技)
专题命中 视频理解 :video understanding(title,abstract);long video(title,abstract);分类 cs.CV
机构 * National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(国家多媒体信息处理重点实验室,计算机学院,北京大学) ; Peking University(北京大学) ; Salesforce Research(Salesforce 研究) ; Independent Researcher(独立研究者)
专题命中 视频理解 :video understanding(title);long video(title);分类 cs.CV、cs.MM
Comments ACL 2025 Findings. Code: https://github.com/yaolinli/GenS
机构 * Stanford University(斯坦福大学)
专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV
机构 * Hong Kong Institute of Science & Innovation(香港科学与工业创新研究院) ; CAMP, Technische Universität München(CAMP,慕尼黑技术大学) ; Department of Surgery, Faculty of Medicine, The Chinese University of Hong Kong(香港中文大学医学院外科部)
专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV
机构 * Tsinghua University(清华大学) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; OpenRL ; Chongqing University(重庆大学)
专题命中 视频理解 :video understanding(abstract);分类 cs.MM
机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院)
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV、cs.MM
Comments 7 pages, 3 figures
机构 * The Conversational Artificial Intelligence (CoAI) Group, Tsinghua University(清华大学对话人工智能(CoAI)小组) ; Zhipu AI(智谱AI) ; The Knowledge Engineering Group (KEG), Tsinghua University(清华大学知识工程小组(KEG))
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);分类 cs.CV
Comments ICCV 2025
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract)
Comments 8 pages, 8 figures, 1 table
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * Tsinghua University(清华大学) ; Beijing Normal University(北京师范大学) ; Honor Device Co., Ltd(荣誉设备有限公司)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * University of Melbourne(墨尔本大学)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
Comments 26 pages, 30 figures, 2025 ACM Multimedia
机构 * Peking University(北京大学) ; University of California, Los Angeles(美国加州大学洛杉矶分校)
专题命中 动作与事件理解 :long video(abstract);分类 cs.CV
Comments Accepted by ICCV 2025
专题命中 动作与事件理解 :long video(abstract)
机构 * Center for Vision, Speech and Signal Processing (CVSSP) University of Surrey(视觉、语音和信号处理中心(CVSSP)大学学院)
专题命中 长视频与时序推理 :long video(abstract);分类 cs.CV
Comments Accepted at BMVC 2025
机构 * ShanghaiTech University(上海科技大学) ; Yinwang Intelligent Technology Co. Ltd.(英伟达智能科技有限公司)
专题命中 长视频与时序推理 :video generation(abstract);分类 cs.CV
Comments Accepted for 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025)
机构 * OpenGVLab, Shanghai AI Laboratory, China(OpenGVLab,上海人工智能实验室) ; University of Science and Technology of China(中国科学技术大学) ; Honor Device Co.,Ltd(荣耀设备有限公司) ; Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院) ; Nanjing University(南京大学)
专题命中 视频数据与评测 :video understanding(title,abstract);分类 cs.CV
机构 * University of Science and Technology of China(中国科学技术大学) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
专题命中 视频数据与评测 :video understanding(title,abstract);分类 cs.CV
Comments https://videorewardbench.github.io/
机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) ; Ho Chi Minh University of Science(胡志明市科学大学) ; Deakin University(德肯大学)
专题命中 视频数据与评测 :video generation(abstract);video understanding(abstract);分类 cs.CV、cs.MM
Comments Published at ACMMM2025 (Dataset track)