Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Adeptschneider/CiviVox-Swahili-text-corpus

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Ade
Hôte:
This dataset contains a comprehensive collection of Swahili text data, derived from the AfriBERTa Corpus. It provides a rich resource for natural language processing tasks focused on the Swahili language. Source: AfriBERTa Corpus (Swahili subset) Language: Swahili Size: [Insert total number of samples here] Format: Hugging Face Dataset The dataset consists of two main columns:

Visit

huggingface.co

Languages

Swahili

Tags

legal

Licenses

apache-2.0

Similaires

Adeptschneider/CiviVox-Swahili-text-corpus-v2.0Adeptschneider/CiviVox-English-Swahili-text-translation-corpusniqqyniqqy/CiviVox-Swahili-text-corpus-v2.0Adeptschneider/llama3-civivox-english-to-swahili-translation

Adeptschneider/CiviVox-Swahili-text-corpus-v2.0

This dataset contains a comprehensive collection of Swahili text data, derived from the AfriBERTa Co

Adeptschneider/CiviVox-English-Swahili-text-translation-corpus

niqqyniqqy/CiviVox-Swahili-text-corpus-v2.0

This dataset contains a comprehensive collection of Swahili text data, derived from the AfriBERTa Co

Adeptschneider/llama3-civivox-english-to-swahili-translation