Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

Twi Words Speech-Text Parallel Dataset

Domain:

natural language processing

Record type:

dataset
Creator:
mic
Host:
This dataset contains 413463 parallel speech-text pairs for Twi (Akan), a language spoken primarily in Ghana. The dataset consists of audio recordings paired with their corresponding text transcriptions, making it suitable for automatic speech recognition (ASR) and text-to-speech (TTS) tasks. Language: Twi (Akan) - tw Task: Speech Recognition, Text-to-Speech

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processingtext to speech

Languages

AkanBwamu, CwiDinka, SoutheasternTwi

Tags

speechtwiakanghanaafrican-languageslow-resourceparallel-corpus

Licenses

cc-by-4.0

Similar

Twi Trigrams Speech-Text Parallel DatasetTwi Trigrams Speech-Text Parallel DatasetSwahili Words Speech-Text Parallel DatasetKasem Speech-Text Parallel DatasetVai Speech-Text Parallel DatasetGa Speech-Text Parallel Dataset

Twi Trigrams Speech-Text Parallel Dataset

This dataset contains 166156 parallel speech-text pairs for Twi, a language spoken primarily in Ghan

Twi Trigrams Speech-Text Parallel Dataset

This dataset contains 166156 parallel speech-text pairs for Twi, a language spoken primarily in Ghan

Swahili Words Speech-Text Parallel Dataset

This dataset contains 411048 parallel speech-text pairs for Swahili, a widely spoken language in Eas

Kasem Speech-Text Parallel Dataset

This dataset contains 75990 parallel speech-text pairs for Kasem, a language spoken primarily in Gha

Vai Speech-Text Parallel Dataset

This dataset contains 23286 parallel speech-text pairs for Vai, a language spoken primarily in Ghana

Ga Speech-Text Parallel Dataset

This dataset is made available because of Ghana NLP's volunteer driven research work. Please conside