Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Common Voice 17.0 (Swahili, Kenyan Sample)

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Ver
Hôte:
This dataset is a filtered sample of the Mozilla Common Voice 17.0 corpus, focusing on Swahili (sw) speech with Kenyan voices. It has been subsetted for experimentation and prototyping in ASR (Automatic Speech Recognition) models targeting speech-impaired users in Kenya, covering Kenyan English and Kiswahili. Language: Kiswahili (Swahili, sw) Accent/Region: Kenyan speakers

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

SwahiliSwahili, CoastalSwahili, Congo

Tags

swahilispeechkenyanaudiocommon-voiceautomatic-speech-recognition

Licenses

cc0-1.0

Similaires

Common Voice Corpus 17.0EYEDOL/swahili-common-voice-woman_soundCommon Voice Scripted Speech 26.0 - SwahiliBenjamin-png/swahili-common-voice-woman_soundCommon Voice

Common Voice Corpus 17.0

This dataset is an unofficial version of the Mozilla Common Voice Corpus 17. It was downloaded and c

EYEDOL/swahili-common-voice-woman_sound

Common Voice Scripted Speech 26.0 - Swahili

A collection of read speech recordings in Swahili (Kiswahili).

Benjamin-png/swahili-common-voice-woman_sound

Common Voice

Common Voice is Mozilla's initiative to help teach machines how real people speak. The dataset currently consists of 7,335 validated hours of speech in 60 languages, but we’re always adding more voices and languages.