Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Swahili Verbs (Vitenzi) Dataset

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Kon
Éditeur:
Men
Hôte:avatar
The Swahili Verbs Dataset is an extensive and systematically curated resource that captures the intricacies of verb morphology in Swahili, a prominent Bantu language spoken across East Africa. Renowned for its agglutinative structure, Swahili employs a complex system of prefixes affixed to verb roots to encode grammatical categories such as tense, aspect, mood, and subject agreement. This dataset is meticulously organized to include the root form of each verb alongside its fully conjugated variants across multiple tenses and subject agreements. Each dataset entry offers a detailed linguistic analysis, illustrating the application of affixation rules to verb roots, thereby providing valuable insights into the morphological processes underlying Swahili verb conjugation.

Visit

data.mendeley.com

Languages

Swahili

Tags

Artificial IntelligenceData ScienceMachine LearningSwahili Language

Licenses

Creative Commons Attribution 4.0 Internationalhttp://creativecommons.org/licenses/by/4.0

Similaires

Applied Verbs in SwahiliRetrieving monosyllabic verbs from Helsinki Corpus of Swahili 2.0Swahili Corpus DatasetSwahili Thinking DatasetSwahili News DatasetSwahili Corpus Dataset

Applied Verbs in Swahili

Retrieving monosyllabic verbs from Helsinki Corpus of Swahili 2.0

Swahili Corpus Dataset

A large-scale Swahili text corpus for language model pretraining and NLP research. The Swahili Corpu

Swahili Thinking Dataset

Swahili Thinking Dataset is a collection of 20,000 ShareGPT-style chat examples for training and eva

Swahili News Dataset

Text classification, language modeling, machine translation, AI/ML model training Notes / challenge

Swahili Corpus Dataset