arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-01-01 至 2026-01-01 共收录 1 信号源:cs.CV, eess.IV, cs.MM

1. 动作与事件理解 1 篇

2512.24323 2026-01-01 cs.CV 57%

Robust Egocentric Referring Video Object Segmentation via Dual-Modal Causal Intervention

通过双模态因果干预实现鲁棒的自我参照视频目标分割

Haijing Liu, Zhiyuan Song, Hefeng Wu, Tao Pu, Keze Wang, Liang Lin

机构 * Sun Yat-sen University(中山大学)

专题命中 动作与事件理解 :video understanding(abstract);分类 cs.CV

AI总结 CERES通过双模态因果干预方法,在自我参照视频中实现鲁棒的目标分割,提升对快速运动和遮挡的鲁棒性。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏