arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-08-19 至 2025-08-19 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频问答 2 篇

2507.14784 2025-08-19 cs.CV cs.AI 57%

LeAdQA: LLM-Driven Context-Aware Temporal Grounding for Video Question Answering

Xinxin Dong, Baoyun Peng, Haokai Ma, Yufei Wang, Zixuan Dong, Fei Hu, Xiaodong Wang

专题命中 视频问答 :long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17069 2025-08-19 cs.CV cs.AI 57%

PVChat: Personalized Video Chat with One-Shot Learning

Yufei Shi, Weilong Yan, Gang Xu, Yumeng Li, Yucheng Chen, Zhenxi Li, Fei Richard Yu, Ming Li, Si Yong Yeo

机构 * MedVisAI Lab(MedVisAI实验室) National University of Singapore(新加坡国立大学) Nankai University(南开大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳)) Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李科谦医学院)

专题命中 视频问答 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏