Search papers, labs, and topics across Lattice.
The Multilingual FrameNet Corpus (mFNC) enhances the English Berkeley FrameNet by integrating and standardizing language-specific corpora from nine additional languages. This resource significantly improves the performance of Frame Semantic Parsers across multilingual and cross-lingual contexts, demonstrating the critical role of diverse training data in model efficacy. The resulting models not only set new benchmarks but also provide an accessible tool for future research in multilingual semantics.
Multilingual training data can dramatically boost the performance of semantic parsing models, as shown by the mFNC's superior results across nine languages.
This paper introduces the Multilingual FrameNet Corpus (mFNC), a novel resource that extends the English Berkeley FrameNet corpus by collecting and harmonizing existing language-specific corpora across nine additional languages: Brazilian Portuguese, Chinese, Dutch, French, German, Italian, Korean, Latvian and Swedish. By training models that rely on different architectures on the mFNC, we consistently outperform existing state-of-the-art Frame Semantic Parsers in both multilingual and cross-lingual settings, underscoring the importance of multilingual training data. The mFNC and our trained FSP models are openly available at https://github.com/beatrice-f/mFNC.