A 48,000 Kinyarwanda English Parallel datasets for machine translation, made by curating and transla
This is a parallel dataset of Naija(Nigerian pidgin) and Igbo languages
Scraping JW.org to create a parallel corpus for Tigrigna - English and Amharic - English # Parall
This dataset contains a curated bilingual parallel corpus developed to support domain-specific neura
A small parallel corpus of French ↔ Medumba (byv) sentence pairs, intended as a seed resource for ma
This dataset contains high-quality parallel sentence pairs, multi-sentence alignments, and paragraph