Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

Luhya Multilingual Dataset

Domain:

natural language processing

Record type:

dataset
Creator:
mam
Host:
Curator: Dr. Moody AmakobeProject: Project Tafsiri — Bridging Indigenous Languages and AIVersion: 2.0License: Creative Commons Attribution 4.0 (CC BY 4.0) This dataset is a comprehensive, structured multilingual corpus for the Luhya language (also written Luyia), a Bantu language cluster spoken primarily in western Kenya by the

Visit

huggingface.co

Languages

LuhyaSwahili

Tags

luhyaluyiakenyan-languagesafrican-languageslow-resourcemultilingualtranslationindigenous-languagesproject-tafsiri

Licenses

cc-by-4.0

Similar

mamakobe/luhya-multilingual-m2m100KenLumachiQuAD - A QA dataset for Kenyan Luhya Lumarachi dialect KenLumachiQuAD – A Question Answering Dataset for Kenyan Luhya Lumarachi Language for Machine LearningLangBridge Multilingual Translation DatasetLangBridge Multilingual Translation Datasetsilomalo/luhya-transformer

mamakobe/luhya-multilingual-m2m100

KenLumachiQuAD - A QA dataset for Kenyan Luhya Lumarachi dialect

KenLumachiQuAD is a result of a project that annotated a total of 1,000 QA pairs based on 137 texts

KenLumachiQuAD – A Question Answering Dataset for Kenyan Luhya Lumarachi Language for Machine Learning

Question-answering (QA) datasets play a crucial role in testing and training machine learning models

LangBridge Multilingual Translation Dataset

This dataset contains parallel translation pairs between Yoruba (yor_Latn), Hausa (hau_Latn), Igbo (

LangBridge Multilingual Translation Dataset

This dataset contains parallel translation pairs between Yoruba (yor_Latn), Hausa (hau_Latn), Igbo (

silomalo/luhya-transformer

# English ↔ Luhya Translator This project fine-tunes a multilingual sequence-to-sequence model to t