Application d'apprentissage de la langue Yemba de Dschang (Cameroun) basée sur le Data Mining : K-Means, CAH Ward, ACP et arbres de décision C4.5 — 393 mots, 11 665 fichiers audio, 80 locuteurs natifs.
# YembaLearn
Application d apprentissage de la langue Yemba de Dschang
(Region de l Ouest Cameroun) developpee dans le cadre d un
projet de Data Mining.
## Techniques utilisees
- K-Means (k=8, silhouette=0.550)
- CAH Ward (ARI=0.801)
- ACP (74.47% variance expliquee)
- Arbres de decision C4.5 (precision 98.5%)
## Lancer l application
```bash
conda activate yembalearn
streamlit run app/main.py
```
## Datasets (a telecharger separement)
- YembaTones :
data.mendeley.com
- YembaEGRA :
data.mendeley.com
- Kaggle :
kaggle.com
## Auteure
ASSONDJI DJOUFACK Malaika --- Master 1 Informatique
Universite de Dschang --- 2025-2026