# Wolof TTS
Petit outil en ligne de commande pour générer de la voix en wolof à partir de texte. Je l'ai développé pour produire des voix off pour mes montages vidéo (CapCut / Filmora), sans avoir à enregistrer ma propre voix ni payer d'API.
Le principe est simple : je tape une phrase en wolof, le script génère un fichier MP3 avec une voix de synthèse.
## Pourquoi ce projet
Je voulais un outil qui tourne en local, gratuit, avec le minimum de dépendances possible. Le wolof est une langue très peu dotée en outils de synthèse vocale, donc l'idée était de m'appuyer sur les modèles open-source déjà entraînés par la communauté (notamment GalsenAI) plutôt que de repartir de zéro.
## Ce que fait le script
`wolof_tts.py` utilise le modèle SpeechT5 fine-tuné en wolof (SpeechT5 + vocodeur HiFi-GAN), et tourne entièrement sur CPU, sans GPU ni clé API.
Concrètement :
1. Le texte est découpé en phrases.
2. Chaque phrase est synthétisée séparément par le modèle.
3. Les segments audio sont recollés avec de petits silences entre eux.
4. Le résultat passe dans une chaîne de post-traitement ffmpeg (compression douce, boost de présence vocale, normalisation de volume) pour un rendu plus propre.
5. Export en MP3.
## Installation
Prérequis : Python 3.10+ et ffmpeg installé et accessible dans le PATH.
```bash
pip install -r requirements.txt
```
## Utilisation
```bash
python wolof_tts.py "Na nga def, jamm ak jamm."
```
Génère `sortie.mp3` dans le dossier courant. Pour choisir le nom du fichier :
```bash
python wolof_tts.py "Na nga def, jamm ak jamm." -o ma_voix.mp3
```
Le premier lancement télécharge le modèle depuis Hugging Face (quelques centaines de Mo), puis il reste en cache localement.
## Difficultés rencontrées
Ce projet n'a pas été un simple `pip install` qui marche du premier coup, et c'est ce qui m'a pris le plus de temps :
- **Génération qui part en boucle** : sur des textes de plusieurs phrases, le modèle rate parfois son "token d'arrêt" et continue à générer …