TA-Prompting: Enhancing Video Large Language Models for Dense Video Captioning via Temporal Anchors
TA-Prompting: 通过时间锚点增强视频大语言模型以实现密集视频描述
机构 * Graduate Institute of Communication Engineering, National Taiwan University(国家交通大学通信工程研究所) ; NVIDIA(NVIDIA公司)
AI总结 TA-Prompting通过引入时间锚点提升视频大语言模型的密集视频描述能力,有效解决时间边界识别问题,提升时间感知视频事件理解性能。
Comments 8 pages for main paper (exclude citation pages), 6 pages for appendix, totally 10 figures 7 tables and 2 algorithms. The paper is accepted by WACV 2026
Journal ref IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) 2026