Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

NCHLT Tshivenda Text Corpora

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Martin PuttkammerMartin SchlemmerWikus PienaarRuan Bekker
Éditeur:
North-West UniversityCentre for Text Technology (CTexT)
Hôte:avatar
Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexicon, frequency list and named-entity lists developed during the NCHLT Text project.

Visit

hdl.handle.net

Languages

Venda

Licenses

Creative Commons Attribution 2.5 South Africa License: http://creativecommons.org/licenses/by/2.5/za/legalcode

Similaires

NCHLT Tshivenda Annotated Text CorporaNCHLT English Text CorporaNCHLT Sepedi Text CorporaNCHLT Setswana Text CorporaNCHLT Sesotho Text CorporaNCHLT Afrikaans Text Corpora

NCHLT Tshivenda Annotated Text Corpora

Lemmatised, part of speech tagged and morphologically analysed corpora developed during the NCHLT Te

NCHLT English Text Corpora

Collection consisting of a clean corpus, lexicon, frequency list and named-entity lists developed d

NCHLT Sepedi Text Corpora

Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexi

NCHLT Setswana Text Corpora

Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexi

NCHLT Sesotho Text Corpora

Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexi

NCHLT Afrikaans Text Corpora

Collection of source text documents, genre classified text documents, raw corpus, clean corpus, lexi