Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Fikira Dataset | A Multilingual Reasoning Dataset for African Languages

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Vambo AI
Fikira (Swahili for "thinking/reasoning") is a multilingual reasoning dataset for African languages, developed by Vambo AI. This dataset contains 50,000 reasoning examples across 10 African languages, synthetically generated as part of ongoing experiments at Vambo AI.

Visit

huggingface.colinkedln post

Connected records

company

Languages

AmharicHausaIgboKinyarwandaShonaSwahili, CoastalXhosaYorubaZulu

Tags

vambo aisynthetic datareasoning

Licenses

https://huggingface.co/datasets/vamboai/fikira#license

Similaires

XCOPA: A Multilingual Dataset for Causal Commonsense ReasoningCureMed-Bench: Multilingual Medical Reasoning DatasetTaTA: A Multilingual Table-to-Text Dataset for African LanguagesTaTa: A Multilingual Table-to-Text Dataset for African LanguagesImproving Multilingual Math Reasoning for African LanguagesAfrican Voices: Multilingual Speech Dataset for Low-Resource African Languages

XCOPA: A Multilingual Dataset for Causal Commonsense Reasoning

In order to simulate human language capacity, natural language processing systems must be able to re

CureMed-Bench: Multilingual Medical Reasoning Dataset

CUREMED-BENCH is a multilingual medical reasoning benchmark dataset, designed for evaluating and fin

TaTA: A Multilingual Table-to-Text Dataset for African Languages

TaTA (Table-to-Text in African languages) is the first large multilingual table-to-text datasets with a focus on African languages. The dataset is parallel and covers nine languages, eight of which are spoken in Africa: Arabic, English, French, Hausa, Igbo, Portugu

TaTa: A Multilingual Table-to-Text Dataset for African Languages

Existing data-to-text generation datasets are mostly limited to English. To address this lack of data, we create Table-to-Text in African languages (TaTa), the first large multilingual table-to-text dataset with a focus on African languages. We created TaTa by tran

Improving Multilingual Math Reasoning for African Languages

Researchers working on low-resource languages face persistent challenges due to limited data availab

African Voices: Multilingual Speech Dataset for Low-Resource African Languages

A large-scale multilingual speech dataset developed by Data Science Nigeria. Contains more than 3,000 hours of transcribed audio across four Nigerian languages: Hausa, Igbo, Nigerian Pidgin, and Yorùbá. The dataset supports Automatic Speech Recognition (ASR) and sp