Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Tunisian Text Data, TTD

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Azi
Hôte:
This dataset is a curated compilation of various Tunisian datasets, aimed at gathering as much Tunisian text data as possible in one place. It combines multiple sources of Tunisian language data, providing a rich resource for research, development of NLP models, and linguistic studies on Tunisian text. Dataset Description

Visit

huggingface.co

Licenses

cc-by-4.0

Similaires

TunArTTS: Tunisian Arabic Text-To-Speech CorpusTunBERT: Pretrained Contextualized Text Representation for Tunisian DialectAutomatic diacritization of Tunisian dialect text using SMT modelYoruba Text DataTunisian Foreign Debt Dataiyedex-labs/tunisian-data

TunArTTS: Tunisian Arabic Text-To-Speech Corpus

TunBERT: Pretrained Contextualized Text Representation for Tunisian Dialect

Pretrained contextualized text representation models learn an effective representation of a natural

Automatic diacritization of Tunisian dialect text using SMT model

Yoruba Text Data

Yoruba Culture and Language Dataset for NLP Tasks

Tunisian Foreign Debt Data

Quarterly data of the Tunisian foreign debt and some other indicators (savings, exchange, current de

iyedex-labs/tunisian-data

Public repository containing Tunisian datasets for use in 3amali and other Tunisian AI projects # 🇹