Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

NCHLT isiZulu Text Corpora

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Martin PuttkammerMartin SchlemmerWikus PienaarRuan Bekker
Éditeur:
North-West UniversityCentre for Text Technology (CTexT)
Hôte:avatar
Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexicon, frequency list and named-entity lists developed during the NCHLT Text project.

Visit

hdl.handle.net

Tasks

information extractionnamed entity recognition

Languages

Zulu

Licenses

Creative Commons Attribution 2.5 South Africa License: http://creativecommons.org/licenses/by/2.5/za/legalcode

Similaires

NCHLT isiZulu Annotated Text CorporaNCHLT isiXhosa Text CorporaNCHLT Sepedi Text CorporaNCHLT Tshivenda Text CorporaNCHLT English Text CorporaNCHLT Afrikaans Text Corpora

NCHLT isiZulu Annotated Text Corpora

Lemmatised, part of speech tagged and morphologically analysed corpora developed during the NCHLT Te

NCHLT isiXhosa Text Corpora

Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexi

NCHLT Sepedi Text Corpora

Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexi

NCHLT Tshivenda Text Corpora

Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexi

NCHLT English Text Corpora

Collection consisting of a clean corpus, lexicon, frequency list and named-entity lists developed d

NCHLT Afrikaans Text Corpora

Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexi