Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

innadark/topxgen-gemma-3-27b-and-nllb-3.3b

Domaine:

natural language processing

Type de record:

dataset
Créateur:
inn
Hôte:
This dataset is a synthetic parallel dataset for 10 low-resource languages, created by applying the TopXGen pipeline with recent multilingual LLMs. It is designed for machine translation (MT) fine-tuning and few-shot experiments (as a selection pool).The pipeline works as follows:

Visit

huggingface.co

Tasks

machine translation

Languages

HausaIgboKinyarwandaSomaliSwahiliXhosa