Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Nehdi/TuniziBigBench

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Neh
Hôte:
This dataset was created by scraping over 14,000 Tunisian YouTube videos, providing a rich repository of Tunisian language data. It covers a wide range of topics and text types, including politics, news, football, and more. The dataset is particularly valuable for training and fine-tuning natural language processing models specific to Tunisian Arabic and other local dialects.

Visit

huggingface.co

Tasks

language modeling

Languages

Arabic, Tunisian Spoken

Tags

Tuniziarabic

Licenses

creativeml-openrail-m