Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Yoruba Speech-Text Parallel Dataset

Domaine:

natural language processing

Type de record:

dataset
Créateur:
mic
Hôte:
This dataset contains 1647022 parallel speech-text pairs for Yoruba, a language spoken primarily in Nigeria and other West African countries. The dataset consists of audio recordings paired with their corresponding text transcriptions, making it suitable for automatic speech recognition (ASR) and text-to-speech (TTS) tasks. Language: Yoruba - yo

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processingtext to speech

Languages

Yoruba

Tags

speechyorubanigeriaafrican-languageslow-resourceparallel-corpus

Licenses

cc-by-4.0