arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~
arXiv 2608.07478cs.CVcs.CL

PragyaDoc:低资源场景下多语种医学文档理解的通用文档智能框架

PragyaDoc: A Universal Document Intelligence Framework for Multilingual Medical Document Understanding in Low-Resource Settings

Jagpal Singh Jhala

首次发表
浏览论文内容

中文总结 AI 辅助

针对低资源场景下多语种医学文档理解问题,提出PragyaDoc通用文档智能框架,采用四层流水线实现医学文档的多语种理解,解决了印度因语言差异导致的医学文档可及性障碍。

中文摘要 AI 辅助

印度的22种官方语言造成了严重的可及性障碍:大部分医学文档仅以英文存在,而最迫切需要这些信息的人群——农村人口、ASHA(社区健康工作者)和患者家属——在功能上被排除在理解这些信息之外。本文提出PragyaDoc,这一通用文档智能框架通过四层流水线解决该问题:并行集成OCR提取层、几何-词汇融合层、确定性领域结构化层以及双LLM医学推理与定位层。

英文摘要

India's 22 official languages create a critical accessibility barrier: the majority of medical documentation exists exclusively in English, yet the patients who most urgently require this information - rural populations, ASHA workers, and patient families - are functionally excluded from understanding it. This paper presents PragyaDoc, a Universal Document Intelligence Framework that addresses this gap through a four-layer pipeline: a parallel ensemble OCR extraction layer, a geometric-lexical fusion layer, a deterministic domain structuring layer, and a dual-LLM medical reasoning and localization layer

补充信息

↑