Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

VoiceAfrica

Domaine:

natural language processing

Type de record:

dataset
Créateur:
nai
Hôte:
Welcome to the VoiceAfrica dataset. VoiceAfrica is a Lanfrica–Meta collaboration (code-named VoiceAfrica 1) that set out to create authentic, conversational speech and expert-curated transcriptions for 11 under-represented African languages. The dataset contains ~125 hours of speech (about 10 hours per language) across 16,383 audio samples from 118 speakers in four countries.

Visit

huggingface.co

Tasks

speech processing

Languages

Bainouk-GunyaamoloBalanta-KentoheBubeFangGuinea-Bissau CreoleIgalaKanuri, YerwaKaronNupe-Nupe-TakoSerer-Sine+1

Tags

speechafrican-languageslow-resourceasrlanfrica

Licenses

cc-by-nc-sa-4.0