Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

evie-8/kinyarwanda-speech-hackathon

Domaine:

natural language processing

Type de record:

dataset
Créateur:
evi
Hôte:
This dataset contains transcribed Kinyarwanda audio, designed to support training and evaluation of Automatic Speech Recognition (ASR) systems. It is part of a study on how varying training data volumes affect model performance using Whisper-large-v3. The full dataset consists of approximately 263,000 audio samples covering 5 key domains: 🏥 Health 🏛️ Government 💰 Financial Services 🎓 Education 🌾 Agriculture

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

Kinyarwanda

Similaires

evie-8/swahili-speech-dataevie-8/afrivoicesevie-8/kikuyu-dataevie-8/zulu-dataevie-8/afrivoices-imagesKinyarwanda-speech-to-text-ASR/Kinyarwanda-speech-to-text-ASR

evie-8/swahili-speech-data

This dataset contains Swahili speech audio paired with transcriptions.It is split into training, dev

evie-8/afrivoices

This repository contains curated subsets of the Digital Umuganda / AfriVoices dataset for the Shona,

evie-8/kikuyu-data

This dataset contains Kikuyu speech audio with transcriptions, sourced and adapted from the ANV Data

evie-8/zulu-data

The transcriptions in this dataset were generated using the TheirStory/whisper-medium-zulu model. Th

evie-8/afrivoices-images

This repository contains image-only subsets from the original Digital Umuganda / AfriVoices project.

Kinyarwanda-speech-to-text-ASR/Kinyarwanda-speech-to-text-ASR

Kinyarwanda Automatic Speech Recognition Model based on Whisper # KinyaWhisper - Kinyarwanda Automa