NgoremeNMT is a parallel dataset composed of 8,000 sentences in Swahili and Ngoreme. It is intended to be used for fine-tuning Neural Machine Translation models and Large Language Models for Ngoreme.
Ngoreme is a low-resource Bantu language spoken in Tanzania.