Accelerating Streaming Video Large Language Models via Hierarchical Token Compression
通过分层令牌压缩加速流式视频大型语言模型
机构 * EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室) ; Sichuan University(四川大学) ; Huazhong University of Science and Technology(华中科技大学) ; Sun Yat-sen University(中山大学) ; Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)
AI总结 STC通过分层令牌压缩技术,显著降低流式视频大语言模型的处理延迟,同时保持高精度。
Comments Code is avaliable at \url{https://github.com/lern-to-write/STC}