A speech dataset of Ghanaian English extracted from Ghanaian news media broadcasts,
designed for training and fine-tuning Automatic Speech Recognition (ASR) models on
West African English accents.
Column
Type
Description
audio
Audio
24 kHz mono WAV audio segment
corrected_text
string
Verbatim transcription of the audio segment
duration_ss
float
Duration of the audio segment in seconds