Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Afri Code Datasets (A collection of datasets for code generation in African languages)

Domaine:

natural language processing

Type de record:

dataset
Training and evaluating Large Language Models (LLMs) for code generation, building AI-powered coding assistants that understand African languages, research in low-resource NLP, improving developer productivity for non-English speakers. Notes / challenges: This is a collection, not a single dataset, so users must navigate to individual datasets for use. The primary challenge it addresses is the extreme scarcity of parallel code-text data for low-resource African languages. The quality, size, and language coverage may vary significantly between the individual datasets in the collection.

Visit

huggingface.co

Tags

open-data-africaopen-data-africa catalog