Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Lwazi ASR Corpus: Low Resourced Languages

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Lin
Hôte:
This repository contains a curated collection of the Lwazi Automatic Speech Recognition (ASR) Corpus for several low-resourced South African languages. These datasets are designed for use in speech recognition research and development, particularly for underrepresented languages. Corpus Overview

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

NdebeleNdebeleSetswanaSotho, NorthernSotho, SouthernSwatiTsongaVendaXhosaZulu

Licenses

cc-by-3.0

Similaires

Lwazi ASR Corpus: Low Resourced LanguagesLwazi Afrikaans ASR corpusLwazi English ASR corpusLwazi isiZulu ASR corpusLwazi isiNdebele ASR corpusLwazi Sepedi ASR corpus

Lwazi ASR Corpus: Low Resourced Languages

This repository contains a curated collection of the Lwazi Automatic Speech Recognition (ASR) Corpus

Lwazi Afrikaans ASR corpus

Complete audio recordings and orthographic transcriptions used for Lwazi speech recognition systems.

Lwazi English ASR corpus

Complete audio recordings and orthographic transcriptions used for Lwazi speech recognition systems.

Lwazi isiZulu ASR corpus

Complete audio recordings and orthographic transcriptions used for Lwazi speech recognition systems.

Lwazi isiNdebele ASR corpus

Complete audio recordings and orthographic transcriptions used for Lwazi speech recognition systems.

Lwazi Sepedi ASR corpus

Complete audio recordings and orthographic transcriptions used for Lwazi speech recognition systems.