Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

baggie11/Multilingual-Health-QA-LoRA-Fine-Tuning

Domain:

natural language processinghealthcare

Record type:

software
Creator:
bag
Host:
Healthcare QA quality is often weaker in low-resource languages. This project fine-tunes an African-language base model on language-specific subsets (for example Swa_Ken) using supervised instruction tuning from (input -> output) examples. # Multilingual Health QA (LoRA Fine-Tuning) A reproducible training pipeline for multilingual health question answering using Unsloth, 4-bit quantization, and LoRA adapters. ## Overview Healthcare QA quality is often weaker in low-resource languages. This project fine-tunes an African-language base model on language-specific subsets (for example `Swa_Ken`) using supervised instruction tuning from `(input -> output)` examples. ## Key Features - Subset-specific training via `subset` filtering - Alpaca-style instruction formatting for SFT - Parameter-efficient LoRA fine-tuning - 4-bit model loading for lower GPU memory usage - Step-wise validation with best-checkpoint selection by `eval_loss` ## Approach 1. Load `Train.csv` and `Val.csv` 2. Filter rows by target `subset` 3. Format each sample into instruction/input/response prompt text 4. Build Hugging Face datasets 5. Load base model in 4-bit 6. Attach LoRA adapters to attention/MLP projection layers 7. Train with `trl.SFTTrainer` 8. Save LoRA adapter and tokenizer ## Default Training Configuration - Base model: `vutuka/Llama-3.1-8B-african-aya` - Sequence length: `1024` - LoRA rank/alpha/dropout: `16 / 16 / 0.0` - Epochs: `2` - Per-device train batch size: `2` - Gradient accumulation: `4` (effective batch size `8`) - Learning rate: `2e-4` - Optimizer: `adamw_8bit` - Scheduler: `cosine` ## Repository Structure - `src/mhqa/train.py`: training CLI - `src/mhqa/infer.py`: inference CLI - `src/mhqa/data.py`: data loading and prompt formatting - `src/mhqa/config.py`: default training config and language map - `scripts/train_swahili.sh`: example training command - `configs/train_swahili.example.yaml`: sample settings file - `data/`: dataset location (`Train.csv`, `Val.csv`) ## Setup ```bash python -m venv .venv # Linux/macOS source .venv/bin/activate # Windows PowerShell # .venv\Scripts\Activate.ps1 pip install --upgrade pip pip install -e . ``` Colab-compatible dependency pinning used in experiments: ```bash …

Visit

github.com

Languages

Swahili

Similar

MULTILINGUAL ADAPTIVE FINE-TUNING (MAFT)kgueye001/llama31-african-health-qa-loraleny62/multilingual-health-qaComparison of Intermediate-Task Fine-Tuning and Multilingual Fine-Tuning for Zero-Shot Low-Resource Language AccuracyFine-tuning Multilingual Transformers for Hausa-English Sentiment AnalysisMuen1/multilingual-health-qa-africa

MULTILINGUAL ADAPTIVE FINE-TUNING (MAFT)

We introduce MAFT as an approach to adapt a multi-lingual PLM to a new set of languages. Adapting PLMs has been shown to be effective when adapting to a new domain (Gururangan et al., 2020) or language (Pfeiffer et al., 2020; Alabi et al., 2020; Adelani et al., 202

kgueye001/llama31-african-health-qa-lora

leny62/multilingual-health-qa

This project fine-tunes a multilingual T5 (mT5) model to answer health-related questions in five Afr

Comparison of Intermediate-Task Fine-Tuning and Multilingual Fine-Tuning for Zero-Shot Low-Resource Language Accuracy

Accuracy of English-language Question Answering (QA) systems has improved significantly in recent ye

Fine-tuning Multilingual Transformers for Hausa-English Sentiment Analysis

Muen1/multilingual-health-qa-africa

# Multilingual Health Question Answering in Low-Resource African Languages ## Overview This is a fi