Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Shona Speech Dataset (SNA)

Domaine:

natural language processing

Type de record:

dataset
Créateur:
man
Hôte:
A cleaned, metadata-rich Shona (sna) speech dataset prepared through a reproducible data engineering pipeline for downstream ASR and TTS workflows. This release is intended as a general-purpose standard corpus: quality metadata is provided, but aggressive opinionated filtering is avoided so users can apply task-specific thresholds. Source dataset: google/WaxalNLP

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

Shona

Tags

audiospeechshonaasrttsafrican-languagelarge datasets from Lanfrica Insights

Licenses

cc-by-4.0