Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Swahili Translation Exposure v1

Domaine:

natural language processing

Type de record:

dataset
Créateur:
nil
Hôte:
nileagi/swahili-translation-exposure-v1 This dataset contains aligned English-Swahili sentence pairs prepared for translation pretraining/exposure use cases. Total pairs: 229,312 Format: parallel text in two files with line-by-line alignment Languages: English (en) and Swahili (sw) eng.txt: English sentences (one sentence per line)

Visit

huggingface.co

Tasks

machine translation

Languages

Swahili

Similaires

Swahili Large Corpus (v1)codeshujaaa/swahili-model-V1Aletheia-ng/GlotCC-V1-swahiliEngeryx/eryx-swahili-tts-v1mutaician/nllb-swahili-kalenjin-v1mutaician/nllb-kalenjin-swahili-v1

Swahili Large Corpus (v1)

The Swahili Large Corpus (v1) is one of the largest and most diverse open pretraining datasets for t

codeshujaaa/swahili-model-V1

Aletheia-ng/GlotCC-V1-swahili

Engeryx/eryx-swahili-tts-v1

mutaician/nllb-swahili-kalenjin-v1

mutaician/nllb-kalenjin-swahili-v1