arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-11-21 至 2025-11-21 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频数据与评测 2 篇

2511.16668 2025-11-21 cs.CV 79%

V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models

V-ReasonBench:面向视频生成模型的统一推理基准套件

Yang Luo, Xuanlei Zhao, Baijiong Lin, Lingting Zhu, Liyao Tang, Yuqi Liu, Ying-Cong Chen, Shengju Qian, Xin Wang, Yang You

机构 * NUS(新加坡国立大学) HKUST(GZ)(香港科技大学(广州)) HKU(香港大学) USYD(澳大利亚悉尼大学) CUHK(香港中文大学) LIGHTSPEED Project(LIGHTSPEED项目)

专题命中 视频数据与评测 :video generation(title);video reasoning(abstract);分类 cs.CV

AI总结 V-ReasonBench通过四个维度评估视频生成模型的推理能力,提供可验证任务以衡量结构化问题解决、空间认知、模式推理和物理动态,促进更可靠的推理模型发展。

Comments Project Page: https://oahzxl.github.io/VReasonBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16183 2025-11-21 cs.AI cs.CV 57%

FOOTPASS: A Multi-Modal Multi-Agent Tactical Context Dataset for Play-by-Play Action Spotting in Soccer Broadcast Videos

FOOTPASS:一个多模态多智能体战术上下文数据集,用于足球比赛视频中的 play-by-play 动作识别

Jeremie Ochin, Raphael Chekroun, Bogdan Stanciulescu, Sotiris Manitsaris

机构 * Center for Robotics, Mines Paris - PSL(机器人中心,巴黎-PSL Mines)

专题命中 视频数据与评测 :video understanding(abstract);分类 cs.CV

AI总结 FOOTPASS数据集旨在通过多模态和多智能体战术上下文,实现足球比赛视频中play-by-play动作的自动化识别与可靠提取。

详情

展开后加载摘要…

URL PDF HTML 收藏