arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2025-10-27 至 2025-10-27 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频理解 2 篇

2506.03525 2025-10-27 cs.CV cs.AI cs.CL 83%

Video-Skill-CoT: Skill-based Chain-of-Thoughts for Domain-Adaptive Video Reasoning

Daeun Lee, Jaehong Yoon, Jaemin Cho, Mohit Bansal

机构 * UNC Chapel Hill(UNC夏洛特山分校) Nanyang Technological University(南洋理工大学)

专题命中 视频理解 :video reasoning(title,abstract);video understanding(abstract);分类 cs.CV

Comments Project website: https://video-skill-cot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21026 2025-10-27 cs.RO 50%

HRT1: One-Shot Human-to-Robot Trajectory Transfer for Mobile Manipulation

Sai Haneesh Allu, Jishnu Jaykumar P, Ninad Khargonkar, Tyler Summers, Jian Yao, Yu Xiang

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) XPeng(小鹏)

专题命中 视频理解 :video understanding(abstract)

Comments 14 pages, 11 figures and 3 tables. Project page is available at \url{https://irvlutd.github.io/HRT1/}

详情

展开后加载摘要…

URL PDF HTML 收藏