Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Syrinesmati/tunisian-question-response-dataset

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Syr
Hôte:
A supervised fine-tuning (SFT) dataset of ~31,000 question-answer pairs in Tunisian Arabic dialect (Darija). The dataset was designed to support the development of language models that can understand and generate natural Tunisian dialect, a historically under-resourced Arabic variety with strong French code-switching influence.

Visit

huggingface.co

Tasks

question answering

Languages

Arabic, Algerian SpokenArabic, Tunisian Spoken

Tags

tunisian-dialectarabicinstruction-tuningsftlow-resourcedialectal-arabic

Licenses

cc-by-4.0

Similaires

Syrinesmati/tunisian-dialect-corpusAmQA: Amharic Question Answering DatasetTigrinya Question-Answering Dataset (TiQuAD)Amharic health question answering datasetPidgin Question - English Answer DatasetSwahili Visual Question Answering Dataset

Syrinesmati/tunisian-dialect-corpus

This dataset is a cleaned corpus of Tunisian Arabic dialect text, aggregated from multiple public so

AmQA: Amharic Question Answering Dataset

Question Answering (QA) returns concise answers or answer lists from natural language text given a c

Tigrinya Question-Answering Dataset (TiQuAD)

TiQuAD is a human-annotated question-answering dataset for the Tigrinya language. The dataset contai

Amharic health question answering dataset

The **AmHQA** dataset is an Amharic health question answering corpus curated to support research in

Pidgin Question - English Answer Dataset

The Pidgin Question - English Answer Dataset is a cross-lingual conversational corpus containing 331

Swahili Visual Question Answering Dataset

Swahili Language VQA Dataset