Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

isiXhosa ASR Test Dataset

Domain:

natural language processing

Record type:

dataset
Creator:
zio
Host:
This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Africa's official languages. The dataset has been optimized for use with OpenAI's Whisper ASR models. Number of samples: 686 Language: isiXhosa (Xho) Audio format: WAV, 16kHz, mono, 16-bit Maximum duration: 30 seconds (truncated for Whisper compatibility)

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

NdebeleSetswanaSotho, NorthernSotho, SouthernSwatiTsongaVendaXhosaZulu

Licenses

mit

Similar

isiXhosa ASR DatasetisiXhosa ASR Augmented DatasetisiXhosa ASR Augmented DatasetisiXhosa ASR Train DatasetisiXhosa ASR Augmented DatasetisiXhosa ASR Augmented Dataset

isiXhosa ASR Dataset

This dataset contains speech recordings and transcriptions for isiXhosa, one of South Africa's offic

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Train Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri