Towards Signboard-Oriented Visual Question Answering: ViSignVQA Dataset, Method and Benchmark
面向路牌的视觉问答:ViSignVQA数据集、方法与基准
机构 * University of Information Technology, Ho Chi Minh City, Vietnam(胡志明市信息技术大学) ; Vietnam National University(越南国家大学)
专题命中 视觉问答 :visual question answering(title,abstract);分类 cs.CV
AI总结 ViSignVQA首次提出大规模越南语路牌多模态数据集,结合OCR与预训练语言模型,提升低资源语言VQA性能。
Comments Dataset paper; code and data will be released