Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

isiXhosa ASR Augmented Dataset

Domain:

natural language processing

Record type:

dataset
Creator:
zio
Host:
This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Africa's official languages. The dataset has been optimized for use with OpenAI's Whisper ASR models. Number of samples: 686 Language: isiXhosa (Xho) Audio format: WAV, 16kHz, mono, 16-bit Maximum duration: 30 seconds (truncated for Whisper compatibility)

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

NdebeleSetswanaSotho, NorthernSotho, SouthernSwatiTsongaVendaXhosaZulu

Licenses

mit

Similar

isiXhosa ASR Augmented DatasetisiXhosa ASR Augmented DatasetisiXhosa ASR Augmented DatasetisiXhosa ASR DatasetisiZulu ASR Augmented DatasetisiZulu ASR Augmented Dataset

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiXhosa, one of South Afri

isiXhosa ASR Dataset

This dataset contains speech recordings and transcriptions for isiXhosa, one of South Africa's offic

isiZulu ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiZulu, one of South Afric

isiZulu ASR Augmented Dataset

This dataset contains augmented speech recordings and transcriptions for isiZulu, one of South Afric