Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Yaka-TTS-Dataset

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Ins
Hôte:
Paired audio and text data on Yaka (also known as West Teke), a language spoken in Congo. The audio corpus consists of 7,648 clips read by one speaker for a total duration of 344 min 40.48 sec. The dataset also contains a mapping file of audio and text with 7,648 lines. Each line begins with the name of an audio file, followed by a tab and then the corresponding text excerpt. This dataset is suitable for TTS tasks.

Visit

mozilladatacollective.com

Tasks

speech processingtext to speech

Languages

Teke-LaaliTeke-TsaayiTeke-TyeeYakaYakaYaka

Tags

mdcmozilla data collectiveTTSWAVTSV

Licenses

Nwulite Obodo Open Data Licence 1.0 (NOODL-1.0)

Similaires

Lexique Yaka-Français, Français-YakaKiswahili Tts DatasetSuundi-TTS-DatasetEwondo-TTS-DatasetBeembe-TTS-DatasetVoTexUg/TTS-dataset

Lexique Yaka-Français, Français-Yaka

Kiswahili Tts Dataset

Kiswahili (Swahili) TTS dataset combining two sub-collections: (1) the 'A Kiswahili Dataset for Deve

Suundi-TTS-Dataset

The dataset consists of paired audio and text data on Suundi (sdj), a language spoken in Congo. The

Ewondo-TTS-Dataset

This dataset comprises high-quality audio recordings of read speech from a single female speaker of

Beembe-TTS-Dataset

The dataset consists of paired audio and text data on Beembe (beq), a language spoken in Congo. The

VoTexUg/TTS-dataset

VoTexUg-TTS dataset VoTexUg-TTS is a large-scale multilingual text-to-speech (TTS) dataset designed