Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Kalebu/wikipedia-swahili-corpus

Domaine:

natural language processing

Type de record:

dataset
Créateur:
kal
Hôte:
A Swahili corpus made from Swahili Wikipedia articles # wikipedia-swahili-corpus A Swahili corpus made from swahili wikipedia articles

Visit

github.com

Languages

Swahili

Tags

corpussarufiswahili-corpuswikipedia-swahili-corpus

Licenses

MIT

Similaires

kalebu/sklearn-swahili-sentiment-analysisTigre Wikipedia Corpusrashiedomar/somali-wikipedia-corpusKalebu/kamusiKalebu/mtaaKalebu/pyswahili

kalebu/sklearn-swahili-sentiment-analysis

Tigre Wikipedia Corpus

This repository houses the Tigre Wikipedia Corpus, a foundational linguistic resource containing all

rashiedomar/somali-wikipedia-corpus

Cleaned Somali Wikipedia corpus (~9,500 articles) for NLP, LLM training, and linguistic research #

Kalebu/kamusi

JSON and CSV data for Swahili dictionary with over 16600+ words # kamusi JSON and CSV data for swah

Kalebu/mtaa

A package consisting of all Tanzania locations from region to streets in an easily accessible way #

Kalebu/pyswahili

A Swahili version of programming language to allow Swahili speakers get started with programming #