Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Odyssey SA Voice Corpus (V0.4) — Evaluation Preview

Domaine:

natural language processing

Type de record:

dataset
Créateur:
ODY
Hôte:
Odyssey SA Voice Corpus (V0.4) — Evaluation Preview Overview The Odyssey SA Voice Corpus (V0.4) is a 1000-hour multilingual South African speech dataset spanning 8 languages, designed for automatic speech recognition (ASR), code-switching research, and large audio model (LAM) evaluation.

Visit

huggingface.co

Tasks

automatic speech recognitioncode switchingspeech processing

Languages

AfrikaansNdebeleSetswanaXhosaZulu

Tags

multilingualsouth-africacode-switchingspeechaudioasrevaluation

Licenses

cc-by-4.0

Similaires

Odyssey SA Voice Corpus v0.1ODYSSEYAILABS/odyssey-sa-voice-corpus-v0.3ODYSSEYAILABS/odyssey-v0.5.1-16h-eval-preview-public

Odyssey SA Voice Corpus v0.1

language: - en - zu - xh - set - afr license: cc-by-4.0 task_categories: - automatic-speech-recognit

ODYSSEYAILABS/odyssey-sa-voice-corpus-v0.3

license: cc-by-4.0 task_categories: automatic-speech-recognition text-to-speech language: af nr en

ODYSSEYAILABS/odyssey-v0.5.1-16h-eval-preview-public

Odyssey AI Labs presents a 16-hour Enterprise Evaluation Preview of the V0.5 corpus. This release is