Seeing, Signing, and Saying: A Vision-Language Model-Assisted Pipeline for Sign Language Data Acquisition and Curation from Social Media
机构 * German Research Center for Artificial Intelligence (DFKI GmbH)(德国人工智能研究中心(DFKI GmbH)) ; Saarland Informatics Campus(萨尔兰州信息技术校区) ; Barcelona Supercomputing Center (BSC-CNS)(巴塞罗那超级计算中心(BSC-CNS))
专题命中 VLM训练与架构 :vision-language model(title);vision language model(abstract);VLM(abstract)
Comments Accepted by RANLP 2025