Logo Lanfrica

NCHLT isiNdebele Auxiliary Speech Corpus

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Febe de WetLaura MartinusJaco Badenhorst
Éditeur:
Charl van HeerderEtienne BarnardMarelie DavelAlta de Waal
Éditeur:
CSIR Meraka InstituteNorth-West University
Hôte:avatar
The corpus contains orthographically transcribed broadband speech in each of South Africa's eleven official languages. Transcriptions are provided in XML format.