Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

thiomi_5k_v1

Domaine:

natural language processing

Type de record:

dataset
Créateur:
thi
Hôte:
This dataset release is part of the data and modeling effort described in: The Thiomi Dataset: A Large-Scale Multimodal Corpus for Low-Resource African Languages The broader Thiomi work focuses on building high-quality multimodal resources for African languages and enabling ASR/MT/TTS research and deployment. Per language config (eng_Latn, kik_Latn, kam_Latn, luo_Latn, mer_Latn, som_Latn):

Visit

huggingface.co

Tasks

speech processing

Languages

DholuoGikuyuKambaKimîîruSomali

Tags

speechaudiottsasrmultilinguallow-resourceafrican-languages