Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

isiXhosa ASR Dataset

Domain:

natural language processing

Record type:

dataset
Creator:
zio
Host:
This dataset contains speech recordings and transcriptions for isiXhosa, one of South Africa's official languages. The dataset has been optimized for use with OpenAI's Whisper ASR models. Number of samples: 789 Language: isiXhosa (Xho) Audio format: WAV, 16kHz, mono, 16-bit Maximum duration: 30 seconds (truncated for Whisper compatibility)

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

NdebeleSetswanaSotho, NorthernSotho, SouthernSwatiTsongaVendaXhosaZulu

Licenses

mit

Similar

isiXhosa ASR Augmented DatasetisiXhosa ASR Augmented DatasetisiXhosa ASR Test DatasetisiXhosa ASR Augmented DatasetisiXhosa ASR Augmented DatasetisiXhosa ASR Train Dataset

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Test Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Train Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri