arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-12-02 至 2025-12-02 共收录 1 信号源:cs.CV, eess.IV, cs.MM

1. 视频问答 1 篇

2510.20285 2025-12-02 cs.CV cs.MM 62%

DMC$^3$: Dual-Modal Counterfactual Contrastive Construction for Egocentric Video Question Answering

DMC$^3$:双模态反事实对比构建用于第一人称视频问答

Jiayi Zou, Chaofan Chen, Bing-Kun Bao, Changsheng Xu

机构 * Nanjing University of Posts and Telecommunications(南京邮电大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Peng Cheng Laboratory(鹏城实验室) MAIS, Institute of Automation, Chinese Academy of Sciences(自动化所MAIS)

专题命中 视频问答 :video understanding(abstract);分类 cs.CV、cs.MM

AI总结 DMC$^3$通过双模态反事实对比构建方法提升第一人称视频问答性能,实现SOTA效果。

详情

展开后加载摘要…

URL PDF HTML 收藏