The Twi Words Dataset is a curated list of over 50,000 unique words in Twi, a major language spoken in Ghana. This dataset aims to support Natural Language Processing (NLP) tasks in Twi, particularly for low-resource language modeling, classification, and lexicon development.
This dataset is created to support:
NLP development for low-resource African languages
Spell checkers and autocorrect models