MasakhaNER: Named entity recognition for African languages - Inria - Institut national de recherche en sciences et technologies du numérique Accéder directement au contenu
Article Dans Une Revue Transactions of the Association for Computational Linguistics Année : 2021

MasakhaNER: Named entity recognition for African languages

Stephen Mayhew
  • Fonction : Auteur
Catherine Gitau
  • Fonction : Auteur
Derguene Mbaye
  • Fonction : Auteur
Davis David
  • Fonction : Auteur
Samba Ngom
  • Fonction : Auteur
Paul Rayson
  • Fonction : Auteur
Mofetoluwa Adeyemi
  • Fonction : Auteur
Emmanuel Anebi
  • Fonction : Auteur
Samuel Oyerinde
  • Fonction : Auteur
Clemencia Siro
  • Fonction : Auteur
Temilola Oloyede
  • Fonction : Auteur
Yvonne Wambui
  • Fonction : Auteur
Victor Akinode
  • Fonction : Auteur
Mouhamadane Mboup
  • Fonction : Auteur
Henok Tilaye
  • Fonction : Auteur
Kelechi Nwaike
  • Fonction : Auteur
Degaga Wolde
  • Fonction : Auteur
Abdoulaye Faye
  • Fonction : Auteur
Ibrahima Thierno
  • Fonction : Auteur
Abdoulaye Diallo
  • Fonction : Auteur
Tendai Marengereke
  • Fonction : Auteur

Résumé

We take a step towards addressing the underrepresentation of the African continent in NLP research by bringing together different stakeholders to create the first large, publicly available, high-quality dataset for named entity recognition (NER) in ten African languages. We detail the characteristics of these languages to help researchers and practitioners better understand the challenges they pose for NER tasks. We analyze our datasets and conduct an extensive empirical evaluation of stateof-the-art methods across both supervised and transfer learning settings. Finally, we release the data, code, and models to inspire future research on African NLP. 1
Fichier principal
Vignette du fichier
adelani_TACL2021.pdf (496.57 Ko) Télécharger le fichier
Origine : Fichiers produits par l'(les) auteur(s)

Dates et versions

hal-03350962 , version 1 (21-09-2021)

Identifiants

Citer

David Ifeoluwa Adelani, Jade Abbott, Graham Neubig, Daniel d'Souza, Julia Kreutzer, et al.. MasakhaNER: Named entity recognition for African languages. Transactions of the Association for Computational Linguistics, 2021, ⟨10.1162/tacl⟩. ⟨hal-03350962⟩

Collections

GENCI
96 Consultations
110 Téléchargements

Altmetric

Partager

Gmail Facebook X LinkedIn More