Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

linagora/TunisianMMLU

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Lin
Hôte:
TunisianMMLU is an evaluation benchmark designed to assess large language models' (LLM) performance in Tunisian Derja, a variety of Arabic. It consists of 22,027 multiple-choice questions, translated from selected subsets of the Massive Multitask Language Understanding (MMLU), ArabicMMLU and DarijaMMLU benchmarks to measure model performance on 44 subjects in Derja. Task Category: Multiple-choice question answering

Visit

huggingface.co

Tasks

question answering

Languages

Arabic, Tunisian Spoken

Licenses

cc-by-nc-sa-4.0

Similaires

linagora/Tunisian_Derja_Datasetlinagora/fineweb2_Tunisian_Arabiclinagora-labs/ASR_train_kaldi_tunisianlinagora/linto-dataset-audio-ar-tnlinagora/linto-dataset-text-ar-tnlinagora/linto-dataset-audio-ar-tn-augmented

linagora/Tunisian_Derja_Dataset

This is a collection of Tunisian dialect textual documents for Language Modeling. It was used for co

linagora/fineweb2_Tunisian_Arabic

This is the Tunisian Arabic Portion of The FineWeb2 Dataset. This dataset contains a rich collection

linagora-labs/ASR_train_kaldi_tunisian

# ASR_train_kaldi_tunisian ## Training Acoustic Models with Kaldi This script facilitates the trai

linagora/linto-dataset-audio-ar-tn

This is the first packaged version of the datasets used to train the Linto Tunisian dialect with cod

linagora/linto-dataset-text-ar-tn

This is a collection of Tunisian dialect textual documents for Language Modeling. It was used to tra

linagora/linto-dataset-audio-ar-tn-augmented

This is the augmented datasets used to train the Linto Tunisian dialect with code-switching STT lina