Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Jeremy-Gitau/kikuyu_tts

Domaine:

natural language processing

Type de record:

model
Créateur:
Jer
Hôte:
# Kikuyu TTS A custom Text-to-Speech (TTS) training pipeline for the Kikuyu language (kik), built on the Piper TTS framework using a VITS neural architecture. ## Overview This project trains a Kikuyu voice model by: 1. Downloading the Kikuyu audio dataset from HuggingFace (`google/WaxalNLP`, `kik_tts` split) 2. Preprocessing and phonemizing text using espeak-ng 3. Fine-tuning a Piper medium-quality (22050 Hz) VITS model 4. Exporting the trained model to ONNX for inference ## Requirements - Python 3.7+ - espeak-ng (system dependency for Kikuyu phonemization) - PyTorch 1.11+ - A pretrained Piper base checkpoint at `./pretrained/base.ckpt` Install espeak-ng: ```bash # macOS brew install espeak-ng # Ubuntu/Debian sudo apt-get install espeak-ng ``` ## Installation ```bash # Clone or navigate to the project cd kikuyu_tts # Create and activate virtual environment python -m venv venv source venv/bin/activate # Install training dependencies cd piper/src/python pip install -e . # Build Cython alignment extension bash build_monotonic_align.sh # Install runtime (optional, for inference) cd ../python_run pip install -e . cd ../../.. # Install project-specific dependencies pip install datasets soundfile librosa ``` ## Training Workflow All scripts are run from the `kikuyu_tts/` subdirectory: ```bash cd kikuyu_tts ``` ### Step 1 — Download and prepare the dataset ```bash python prepare_data.py ``` Downloads audio from HuggingFace, resamples to 22050 Hz, cleans text, and writes: - `dataset/wavs/*.wav` — audio files - `dataset/metadata.csv` — pipe-delimited `wavs/XXXXX.wav|text` pairs ### Step 2 — Validate the dataset (optional) ```bash python validate.py ``` Prints duration statistics (average, min, max, total hours) for the first 100 utterances. ### Step 3 — Resample audio (if needed) ```bash python resample.py ``` Ensures all WAV files are exactly 22050 Hz, overwriting files in place. ### Step 4 — Preprocess for training ```bash python preprocess.py …

Visit

github.com

Languages

Gikuyu

Similaires

Antony-gitau/indaba_2023_documentationAntony-gitau/Fine_tuning_XLS_R_Wav2Vec2_with_Swahili_corpus_v1Jeremy-codes-dope/Geez_Transliterationjeremy-brooks/rwanda-web-clientJeremy-K-coder/diabetes-hypertension-medication-adherenceHomo denisova, Correspondence Spectral Analysis, Finite Sites Reticulate Hierarchical Coalescent Models and the Ron Jeremy Hypothesis

Antony-gitau/indaba_2023_documentation

Talks, practicals, and activities i took part in at Deep Learning Indaba 2023, Accra, Ghana # Indab

Antony-gitau/Fine_tuning_XLS_R_Wav2Vec2_with_Swahili_corpus_v1

# Fine_tuning_XLS_R_Wav2Vec2_with_Swahili_corpus_v1

Jeremy-codes-dope/Geez_Transliteration

This is a simple but power ful project that changes amharic scripts in to englisch letters just in a

jeremy-brooks/rwanda-web-client

repository for the rwanda meteorological agency website rwanda-web-client ================= reposi

Jeremy-K-coder/diabetes-hypertension-medication-adherence

This project builds and evaluates a classical machine learning pipeline to predict medication non-ad

Homo denisova, Correspondence Spectral Analysis, Finite Sites Reticulate Hierarchical Coalescent Models and the Ron Jeremy Hypothesis

This article shows how to fit reticulate finite and infinite sites sequence spectra to aligned data