Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

ik/akan-tts-wavtokenizer-combined

Domaine:

natural language processing

Type de record:

dataset
Créateur:
IK
Hôte:
Combined word-aligned dataset for training Akan/Twi TTS models. Audio encoded with WavTokenizer (75Hz, single codebook, codes 0-4095) and word boundaries from MMS forced alignment. Total samples 96,615 Total hours 222.9h Sources 5 Split Samples Hours train 95,165 219.4h validation 966 2.2h test 484 1.2h Source Samples

Visit

huggingface.co

Tasks

speech processingtext to speech

Languages

Akan

Tags

ttsspeechakantwiwavtokenizerword-aligned

Licenses

cc-by-sa-4.0

Similaires

ik/asante-twi-wavtokenizer-alignedToadoum/yoruba-tts-combined

ik/asante-twi-wavtokenizer-aligned

Toadoum/yoruba-tts-combined