PaddleOCR-VL: Boosting Multilingual Document Parsing via a 0.9B Ultra-Compact Vision-Language Model
PaddleOCR-VL: 通过0.9B超紧凑视觉-语言模型提升多语言文档解析
机构 * PaddlePaddle Team, Baidu Inc.(百度公司)
专题命中 文档图表理解 :vision-language model(title,abstract);VLM(abstract);分类 cs.CV
AI总结 PaddleOCR-VL通过0.9B超紧凑视觉-语言模型实现多语言文档解析的高效准确识别
Comments Github Repo: https://github.com/PaddlePaddle/PaddleOCR