Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

A Southern African corpus for multilingual name pronunciation

Domaine:

natural language processing

Type de record:

dataset
Créateur:
O GM.H. DavelE.
Éditeur:
unp
Hôte:avatar

Visit

doi.orgwww.researchgate.net

Similaires

The predictability of name pronunciation errors in four South African languagesSouth African Directory Enquiries (SADE) Name CorpusAfrican Multilingual Text CorpusLughaGen Multilingual African Language Corpusumarlamiya/Name-multilingual-nigeria-nlpWAXAL: A Large-Scale Multilingual African Language Speech Corpus

The predictability of name pronunciation errors in four South African languages

South African Directory Enquiries (SADE) Name Corpus

"Audio and tagged orthographic transcriptions of South African names produced by first-language spea

African Multilingual Text Corpus

NLP model training, translation Notes / challenges: Unequal language representation

LughaGen Multilingual African Language Corpus

LughaGen is a curated multilingual corpus for four Kenyan and East African languages: Swahili (sw),

umarlamiya/Name-multilingual-nigeria-nlp

A specialized NLU engine designed to bridge the AI language gap for Hausa, Yoruba, Igbo, Fulfulde, a

WAXAL: A Large-Scale Multilingual African Language Speech Corpus

The advancement of speech technology has predominantly favored high-resource languages, creating a significant digital divide for speakers of most Sub-Saharan African languages. To address this gap, we introduce WAXAL, a large-scale, openly accessible speech datase