Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

DAH (Dataset Hassaniya)

Domain:

natural language processing

Record type:

dataset
Creator:
has
Host:
DAH is a bilingual dataset created to support translation between Hassaniya dialect and English, with both Arabic script and Arabizi (Latin-transliterated) Hassaniya included. Name: dah Languages: Hassaniya Arabic (in both Arabic and Latin forms), English Creators: Ahlam Abdelkader Emani Babe Oumoukelthoum Sidenna Adapted from: Tatoeba Project parallel sentences

Visit

huggingface.co

Tasks

machine translation

Languages

Hassaniyya

Tags

translationarabichassaniyalow-resource

Similar

HASSANIYA DatasetEmin009/hassaniya-punctuation-datasetHassaniya Stories OCR DatasetMamadou-Aw/Hassaniya-speech-datasetHassan-IA/DAHHASSANIYA-DTCD: A new Dataset for Benchmarking Text Classification Tasks on HASSANIYA Dialect

HASSANIYA Dataset

The attached file is the first Mauritanian dialect dataset called “HASSANIYA” containing two thousan

Emin009/hassaniya-punctuation-dataset

Hassaniya Stories OCR Dataset

Image-to-text OCR pairs extracted from a Hassaniya Arabic stories corpus. Each row couples an image

Mamadou-Aw/Hassaniya-speech-dataset

Hassan-IA/DAH

DAtaset Hassaniya # DAH (DAtaset Hassaniya) ## Project Overview **DAH (DAtaset Hassaniya)** is th

HASSANIYA-DTCD: A new Dataset for Benchmarking Text Classification Tasks on HASSANIYA Dialect

HASSANIYA-DTCD: A new Dataset for Benchmarking Text Classification Tasks on HASSANIYA dialect is the