Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

UBC-NLP/SimbaBench_dataset

Domaine:

natural language processing

Type de record:

dataset
Créateur:
UBC
Hôte:
To evaluate your model on SimbaBench across all supported tasks (ASR, TTS, and SLID), simply load the corresponding configuration for the task and language you wish to benchmark. Each task is organized by configuration name (e.g., asr_test_afr, tts_test_wol, slid_61_test). Loading a configuration provides the standardized evaluation split for that specific benchmark.Example: from datasets import load_dataset

Visit

huggingface.co

Tasks

automatic speech recognitionlanguage identificationspeech processingtext to speech

Languages

AfrikaansAkanAmazighAmharicBasaaBembaChichewaDholuoÉwéFante+37

Tags

automatic-speech-recognitiontext-to-speechspoken-language-identificationspeechaudioafrican-languagesmultilinguallow-resourcebenchmarksimbabench+1

Licenses

cc-by-4.0

Similaires

UBC-NLP/simbaUBC-NLP/saharaUBC-NLP/serengetiUBC-NLP/afrolidUBC-NLP/EgyHellaSwagUBC-NLP/EgyMMLU

UBC-NLP/simba

## 📑 Table of Contents - Best-in-Class Multilingual Models - 🗣️✍️ Simba-ASR (Automatic Speech Recog

UBC-NLP/sahara

Benchmarking African NLP # SAHARA Benchmark Sahara is a comprehensive benchmark for

UBC-NLP/serengeti

SERENGETI: Massively Multilingual Language Models for Africa Multilingual pretrained language model

UBC-NLP/afrolid

AfroLID, a powerful neural toolkit for African languages identification which covers 517 African lan

UBC-NLP/EgyHellaSwag

Dataset Description Dataset Summary Languages Dataset Structure Data Instances Data Fields Dataset

UBC-NLP/EgyMMLU

Dataset Description Dataset Summary Languages Dataset Structure Data Instances Data Fields Data Spl