Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Twi-English Parallel Dataset

Domaine:

natural language processing

Type de record:

dataset
Créateur:
mic
Hôte:
This dataset contains a large-scale parallel corpus of Twi-English sentence pairs, featuring synthetically generated Twi sentences with corresponding English paraphrases. The dataset is designed to support machine translation, cross-lingual understanding, and other NLP tasks involving the Twi language (a dialect of Akan spoken in Ghana). Total Size: 47,924,398 parallel sentence pairs

Visit

huggingface.co

Tasks

machine translation

Languages

AkanBwamu, CwiDinka, SoutheasternTwi

Tags

twiakanafrican-languageslow-resourcesynthetic-dataparallel-corpus

Licenses

cc-by-4.0