Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

stem-content-ai-project/swahili-speech

Domaine:

natural language processing

Type de record:

dataset
Créateur:
ste
Hôte:
This dataset contains paired audio and text data for training and evaluating speech-to-text models in Swahili. The audio files have been processed to remove silence, converted to 44.1kHz mono FLAC format, and are paired with corresponding transcriptions. audio_*.flac: Audio files in FLAC format, named by their corresponding text corpus ID.

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

Swahili

Licenses

mit

Similaires

stem-content-ai-project/swahili-text-corpus

stem-content-ai-project/swahili-text-corpus

This dataset contains a synthetic Swahili text corpus designed for training Text-to-Speech (TTS) mod