多语言框架网络语料库
The Multilingual FrameNet Corpus
浏览论文内容
中文总结 AI 辅助
本研究构建了多语言框架网络语料库(mFNC),在其上训练不同架构的模型,在多语言和跨语言场景中超越现有最先进框架语义解析器,凸显多语言训练数据的重要性,相关资源公开可用。
中文摘要 AI 辅助
本文介绍多语言框架网络语料库(Multilingual FrameNet Corpus,简称mFNC),这是一种新型资源,它扩展了英文伯克利框架网络语料库,收集并整合了另外9种语言的现有特定语言语料库,分别是巴西葡萄牙语、中文、荷兰语、法语、德语、意大利语、韩语、拉脱维亚语和瑞典语。通过在mFNC上训练依赖不同架构的模型,我们在多语言和跨语言场景中均始终超越现有的最先进框架语义解析器,凸显了多语言训练数据的重要性。mFNC及我们训练的FSP模型可通过该公开URL获取。
英文摘要
This paper introduces the Multilingual FrameNet Corpus (mFNC), a novel resource that extends the English Berkeley FrameNet corpus by collecting and harmonizing existing language-specific corpora across nine additional languages: Brazilian Portuguese, Chinese, Dutch, French, German, Italian, Korean, Latvian and Swedish. By training models that rely on different architectures on the mFNC, we consistently outperform existing state-of-the-art Frame Semantic Parsers in both multilingual and cross-lingual settings, underscoring the importance of multilingual training data. The mFNC and our trained FSP models are openly available at https://github.com/beatrice-f/mFNC.