Synthèse vocale open-source pour langues africaines — fine-tune TTS models on African language datasets
# AfroTTS
**Synthèse vocale open-source pour les langues africaines.**
AfroTTS produit des modèles de synthèse vocale (text-to-speech) fine-tunés pour les langues africaines sous-représentées dans les systèmes commerciaux. Le projet s'appuie sur les datasets d'AfroLang-Library.
## Mission
Permettre à chaque locuteur d'une langue africaine d'entendre sa langue parlée par une machine. Aujourd'hui, les systèmes TTS couvrent massivement l'anglais, le français, le mandarin — mais quasi aucune langue africaine. AfroTTS commence à combler ce vide.
## Langues cibles (phase 1)
- Mooré (Burkina Faso)
- Wolof (Sénégal)
- Lingala (RDC / Congo)
- Dioula / Bambara (Côte d'Ivoire / Mali)
- Hausa (Nigeria / Niger)
## Architecture
```
AfroTTS/
├── src/
│ ├── afrotts/
│ │ ├── __init__.py
│ │ ├── trainer.py # Fine-tuning Coqui TTS / Piper
│ │ ├── inference.py # Inférence locale + API
│ │ ├── dataset.py # Chargement datasets AfroLang
│ │ └── evaluate.py # MOS, WER, MCD
│ └── app/ # Démo web Streamlit
│ └── streamlit_app.py
├── models/ # Modèles fine-tunés (gitignored, sur HF Hub)
├── notebooks/ # Exploration & prototypage
├── tests/
├── requirements.txt
└── README.md
```
## Stack
- **Modèles** : Coqui TTS (XTTS v2) / Piper / VITS
- **Données** : AfroLang-Library datasets
- **Hébergement modèles** : HuggingFace Hub
- **Démo** : Streamlit / Gradio
## Démarrage rapide
```bash
git clone
github.com
cd AfroTTS
python -m venv .venv && source .venv/bin/activate
pip install -r requirements.txt
# Lancer la démo
streamlit run src/app/streamlit_app.py
```
## Contribuer
Les contributions sont bienvenues. Consultez les issues pour commencer.
Domaines où l'aide est précieuse :
- Fournir / nettoyer des datasets audio pour une langue africaine
- Fine-tuner un modèle TTS sur une nouvelle langue
- Améliorer l'interface de démo
- Évaluer la qualité des sorti …