arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-03-02 至 2026-03-02 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频理解 2 篇

2602.23709 2026-03-02 cs.CV 79%

EgoGraph: Temporal Knowledge Graph for Egocentric Video Understanding

EgoGraph:用于第一人称视频理解的时序知识图谱

Shitong Sun, Ke Han, Yukai Huang, Weitong Cai, Jifei Song

机构 * Queen Mary University of London(伦敦玛丽女王大学) University of Trento(特伦托大学) University of Surrey(萨里大学)

专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV

AI总结 EgoGraph通过构建动态知识图谱,有效解决超长第一人称视频的时序建模问题,实现更丰富的语义表示和复杂的时序推理。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23553 2026-03-02 cs.CV 79%

LE-NeuS: Latency-Efficient Neuro-Symbolic Video Understanding via Adaptive Temporal Verification

LE-NeuS: 通过自适应时间验证实现低延迟的神经符号视频理解

Shawn Liang, Sahil Shah, Chengwei Zhou, SP Sharan, Harsh Goel, Arnab Sanyal, Sandeep Chinchali, Gourav Datta

机构 * Case Western Reserve University(凯斯西储大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV

AI总结 LE-NeuS通过自适应时间验证优化,实现低延迟的神经符号视频理解,在保持高准确率的同时大幅减少推理延迟。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏