Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

Syrinesmati/tunisian-question-response-dataset

Domain:

natural language processing

Record type:

dataset
Creator:
Syr
Host:
A supervised fine-tuning (SFT) dataset of ~31,000 question-answer pairs in Tunisian Arabic dialect (Darija). The dataset was designed to support the development of language models that can understand and generate natural Tunisian dialect, a historically under-resourced Arabic variety with strong French code-switching influence.

Visit

huggingface.co

Tasks

question answering

Languages

Arabic, Algerian SpokenArabic, Tunisian Spoken

Tags

tunisian-dialectarabicinstruction-tuningsftlow-resourcedialectal-arabic

Licenses

cc-by-4.0

Similar

Syrinesmati/tunisian-dialect-corpusAmQA: Amharic Question Answering DatasetTigrinya Question-Answering Dataset (TiQuAD)Amharic health question answering datasetPidgin Question - English Answer DatasetSwahili Visual Question Answering Dataset

Syrinesmati/tunisian-dialect-corpus

This dataset is a cleaned corpus of Tunisian Arabic dialect text, aggregated from multiple public so

AmQA: Amharic Question Answering Dataset

Question Answering (QA) returns concise answers or answer lists from natural language text given a c

Tigrinya Question-Answering Dataset (TiQuAD)

TiQuAD is a human-annotated question-answering dataset for the Tigrinya language. The dataset contai

Amharic health question answering dataset

The **AmHQA** dataset is an Amharic health question answering corpus curated to support research in

Pidgin Question - English Answer Dataset

The Pidgin Question - English Answer Dataset is a cross-lingual conversational corpus containing 331

Swahili Visual Question Answering Dataset

Swahili Language VQA Dataset