Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Bilingual Personal Health Conversational Dataset for English and Yoruba

Domaine:

natural language processinghealthcare

Type de record:

dataset
Créateur:
Fem
Éditeur:
IEE
Hôte:avatar
This dataset features 26,000 personal health inquiries and responses in a conversational format, in both English and Yoruba. Sourced from reputable health forums such as iCliniq, eHealth Forum, Question Doctors, and WebMD, it is licensed under the MIT license, with all personal identifiers removed to ensure privacy. Certified health professionals addressed all English inquiries. The English dataset was translated into Yoruba using Neural Machine Translation (NMT) via the Google Translate API. The English data was split into chunks of 1,000 samples for translation, utilizing default Google Translate parameters to maintain consistency and accuracy.

Visit

doi.orgieee-dataport.org

Languages

Yoruba

Licenses

Creative Commons Attribution 4.0 Internationalhttps://creativecommons.org/licenses/by/4.0/legalcode

Similaires

Yoruba/english conversational code‐switching as a conversational strategyAnalysing Afrikaans-English bilingual children’s conversational code switchingOwhorode/Bilingual-Chatbot-English-Yoruba-TroubleQA-BE: A Bilingual Troubleshooting Question Answering Dataset for Bangla and EnglishParameter setting and feature mismatch in a Yoruba-English bilingual childCAFE: Algerian Arabic, French, and English Code-Switched Conversational Speech Dataset

Yoruba/english conversational code‐switching as a conversational strategy

Analysing Afrikaans-English bilingual children’s conversational code switching

Owhorode/Bilingual-Chatbot-English-Yoruba-

# Multilingual-Chatbot-English-and-Yoruba- ## Description The **Yoruba Chatbot** is a conversationa

TroubleQA-BE: A Bilingual Troubleshooting Question Answering Dataset for Bangla and English

BTQA is a bilingual troubleshooting question answering dataset created to facilitate research and de

Parameter setting and feature mismatch in a Yoruba-English bilingual child

anguage acquisition studies on bilingual children within the African context are rare. Furthermore,

CAFE: Algerian Arabic, French, and English Code-Switched Conversational Speech Dataset

The CAFE dataset (Code-switching Algerian French English) addresses the lack of publicly available r