Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

English Hausa Parallel Corpus

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Loc
Hôte:
This English–Hausa Parallel Corpus is a curated bilingual dataset of 5,000 aligned sentence pairs, translated from English into Hausa and organized into a clean sentence-level format to ensure reliable alignment. The dataset is designed to support machine translation training and evaluation, bilingual lexicon development, and broader linguistic and natural language processing (NLP) research for Hausa, including data-driven language technology development.

Visit

mozilladatacollective.com

Tasks

machine translation

Languages

Hausa

Tags

mdcmozilla data collectiveMTcsv

Licenses

Creative Commons Attribution Non Commercial 4.0 International (CC-BY-NC-4.0)