Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

SFPC (Sango-French Parallel Corpus)

Domaine:

natural language processing

Type de record:

dataset
Créateur:
ala
Hôte:
The first quality-filtered, verse-aligned Sango-French parallel corpus, constructed for neural machine translation research. This dataset directly addresses the "Sango Problem" identified by Meta's NLLB-200 project — the failure of cross-lingual transfer for a linguistically isolated Creole language. Associated resources: Model: alaminerca/nllb-sango-french Demo: Sango-French Translator

Visit

huggingface.co

Tasks

machine translation

Languages

Sango

Tags

translationparallel-corpusbiblesangoafrican-languageslow-resourcecreolenmt

Licenses

cc-by-4.0

Similaires

Ewondo-French Parallel CorpusFrench-Adja Parallel CorpusFrench–Medumba Parallel CorpusFrench-Fongbe Parallel CorpusBamun-French Parallel Corpus 2.0Bamun-French Parallel Corpus 1.1

Ewondo-French Parallel Corpus

This dataset is a parallel corpus of Ewondo and French texts. The text was obtained by transcribing

French-Adja Parallel Corpus

The first publicly available parallel text corpus for Adja machine translation, targeting an under-r

French–Medumba Parallel Corpus

A small parallel corpus of French ↔ Medumba (byv) sentence pairs, intended as a seed resource for ma

French-Fongbe Parallel Corpus

Ce dataset est un corpus parallèle Français-Fongbe (Bénin) généré par IA et structuré pour l'entraîn

Bamun-French Parallel Corpus 2.0

This dataset is an extended and updated version of the 'Bamun-French Parallel Corpus 1.1' that is pu

Bamun-French Parallel Corpus 1.1

This dataset is the second iteration of the 'Bamun–French parallel corpus' that was initially publis