Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

SamAbr/Multilingual-Health-Question-Answering-in-Low-Resource-African-Languages

Domaine:

natural language processinghealthcare

Type de record:

project
Créateur:
Sam
Hôte:
# Multilingual Health Question Answering in Low-Resource African Languages This repository contains code, notebooks, and models for building end-to-end question-answering systems in low-resource African languages (Akan, Amharic, Luganda, Swahili, and regional English variants). --- ## 📁 Directory & Project Structure ``` Multilingual-Health-Question-Answering-in-Low-Resource-African-Languages/ ├── data/ │ ├── raw/ # Original raw Zindi datasets │ │ ├── Training set.csv # Training dataset │ │ ├── Validation set.csv# Validation dataset │ │ └── Test set.csv # Test evaluation dataset │ └── processed/ # Preprocessed & augmented datasets ├── notebooks/ # Jupyter Notebooks for analysis & cloud training │ ├── colab_nllb_health_qa.ipynb # Cloud/Colab automated clone & run notebook │ └── multilingual_health_qa_starter_notebook.ipynb # Interactive analysis & hybrid modeling notebook ├── src/ # Modular Python scripts & pipeline algorithms │ ├── __init__.py │ ├── nllb_pipeline.py # NLLB-200 generation, per-language batch sampler & callback │ ├── retrieval.py # TF-IDF, Multilingual Dense Sentence Embeddings & Hybrid RAG │ └── threshold_optimizer.py# Per-subset threshold grid optimization & score calibration ├── models/ │ └── checkpoints/ # Model checkpoints & fine-tuned weights ├── submissions/ # Formatted CSV submission outputs for Zindi ├── LICENSE └── README.md ``` --- ## 🚀 Getting Started ### 1. Requirements & Dependencies Ensure you have PyTorch, Transformers, Sentence-Transformers, Datasets, and evaluate installed: ```bash pip install torch transformers sentence-transformers datasets evaluate scikit-learn pandas numpy rouge-score peft accelerate ``` ### 2. Running in Cloud / Google Colab / Docker Environments Open `notebooks/colab_nllb_health_qa.ipynb` in Google Colab or your cloud Jupyter notebook server. It inclu …

Visit

github.com

Tasks

question answering

Languages

AmharicGandaSwahili

Licenses

MIT

Similaires

sashishjha/Multilingual-Health-Question-Answering-in-Low-Resource-African-Languages-Challenge-by-ITUOffei-op/Multi-Health-Question-Answering-In-Low-Resource-African-LanguagesBhavik-Ardeshna/Question-Answering-for-Low-Resource-LanguagesTowards Automating Healthcare Question Answering in a Noisy Multilingual Low-Resource SettingUhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African LanguagesKERLQA: Knowledge-Enhanced Reinforcement Learning for Question Answering in Low-resource Languages

sashishjha/Multilingual-Health-Question-Answering-in-Low-Resource-African-Languages-Challenge-by-ITU

# AfriQA — Multilingual Health QA Competition **Goal:** Score 0.72+ on Zindi leaderboard | **Deadli

Offei-op/Multi-Health-Question-Answering-In-Low-Resource-African-Languages

# Lalang: multilingual health-QA retrieval and reranking This repository is the reproducible resear

Bhavik-Ardeshna/Question-Answering-for-Low-Resource-Languages

Cascading Adaptors to Leverage English Data to Improve Performance ofQuestion Answering for Low-Reso

Towards Automating Healthcare Question Answering in a Noisy Multilingual Low-Resource Setting

We discuss ongoing work into automating a multilingual digital helpdesk service available via text messaging to pregnant and breastfeeding mothers in South Africa. Our anonymized dataset consists of short informal questions, often in low-resource languages, with un

Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages

Evaluations of Large Language Models (LLMs) on knowledge-intensive tasks and factual accuracy often

KERLQA: Knowledge-Enhanced Reinforcement Learning for Question Answering in Low-resource Languages

Question answering in low-resource languages faces critical challenges when models encounter questio