Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

A Southern African corpus for multilingual name pronunciation

Domain:

natural language processing

Record type:

dataset
Creator:
O GM.H. DavelE.
Publisher:
unp
Host:avatar

Visit

doi.orgwww.researchgate.net

Similar

The predictability of name pronunciation errors in four South African languagesSouth African Directory Enquiries (SADE) Name CorpusAfrican Multilingual Text CorpusLughaGen Multilingual African Language Corpusumarlamiya/Name-multilingual-nigeria-nlpWAXAL: A Large-Scale Multilingual African Language Speech Corpus

The predictability of name pronunciation errors in four South African languages

South African Directory Enquiries (SADE) Name Corpus

"Audio and tagged orthographic transcriptions of South African names produced by first-language spea

African Multilingual Text Corpus

NLP model training, translation Notes / challenges: Unequal language representation

LughaGen Multilingual African Language Corpus

LughaGen is a curated multilingual corpus for four Kenyan and East African languages: Swahili (sw),

umarlamiya/Name-multilingual-nigeria-nlp

A specialized NLU engine designed to bridge the AI language gap for Hausa, Yoruba, Igbo, Fulfulde, a

WAXAL: A Large-Scale Multilingual African Language Speech Corpus

The advancement of speech technology has predominantly favored high-resource languages, creating a significant digital divide for speakers of most Sub-Saharan African languages. To address this gap, we introduce WAXAL, a large-scale, openly accessible speech datase