This repository contains parallel sentence data for English ↔ Tumbuka translation tasks. It includes both training and evaluation splits in CSV format.
Purpose: Training
Size: 232,536 sentence pairs
Content: Mixed-quality bilingual pairs.
Source: Partially adapted from michsethowusu/english-tumbuka_sentence-pairs_mt560