Combined word-aligned dataset for training Akan/Twi TTS models. Audio encoded with WavTokenizer (75Hz, single codebook, codes 0-4095) and word boundaries from MMS forced alignment.
Total samples
96,615
Total hours
222.9h
Sources
5
Split
Samples
Hours
train
95,165
219.4h
validation
966
2.2h
test
484
1.2h
Source
Samples