Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

AnonXx/Pidgin_ASR_Dataset_Combined

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Ano
Hôte:
A Foundational Automatic Speech Recognition Corpus for Nigerian Pidgin (Naija, PCM) Naija-ASR-Corpus (NAC-v1.0) is a speech dataset derived from the Universal Dependencies Naija Spoken Corpus (UD_Naija-NSC). The NAC Team processed the original long-form recordings by: Segmenting the audio into sentence-level clips. Transcribing/Aligning the text to create paired audio-text data suitable for ASR training.

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

Pidgin, Nigerian

Tags

audiospeechnaijapidgin

Licenses

cc-by-sa-4.0

Similaires

timniel/Pidgin_ASR_Dataset_Combined

timniel/Pidgin_ASR_Dataset_Combined

A Foundational Automatic Speech Recognition Corpus for Nigerian Pidgin (Naija, PCM) Naija-ASR-Corpu