Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

DanMM96/Tshiluba-dataset

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Dan
Hôte:
This project provides a monolingual text corpus for Tshiluba (Ciluba), a Bantu language spoken by over 7 million people in the Democratic Republic of Congo (DRC). Tshiluba is a low-resource language, with very limited publicly available datasets for Natural Language Processing (NLP).

Visit

huggingface.co

Languages

Luba-Kasai

Similaires

abdouaziiz/tshilubaCode-170k-tshilubaDictionnaire tshiluba-françaiswsjfm/nllb-tshiluba-frenchwsjfm/nllb-tshiluba-french-LoRA“Serial Verb Constructions” In Tshiluba

abdouaziiz/tshiluba

Code-170k-tshiluba

Code-170k-tshiluba is a groundbreaking dataset containing 113,468 programming conversations, origina

Dictionnaire tshiluba-français

First ed. published in 1936 under title: Dictionnaire luba

wsjfm/nllb-tshiluba-french

wsjfm/nllb-tshiluba-french-LoRA

“Serial Verb Constructions” In Tshiluba

Serial verb constructions (SVCs), that is sequences of several consecutive verbs sharing certain fea