Mozilla Zazaca Alpha — Zazacanın Açık Kaynak Text-to-Speech Modeli
# Mozilla Zazaca Alpha — Zazacanın Açık Kaynak Text-to-Speech Modeli
Mozilla Zazaca Alpha, VoxCPM2 üzerine LoRA fine-tuning ile eğitilmiş, **Zazaca (zza)** konuşma sentezi modeli. Mozilla'nın açık kaynak Zazaca veri setleri kullanılarak eğitilmiştir. Alpha sürümü, modelin erken doğrulama aşamasında sunulmaktadır.
Henüz veri seti tamamlanmadığı için ALPHA sürüm olarak test amaçlı kullanılabilir. Veriseti büyüdükçe yeni ve tam sürümler yüklenecektir.
| Özellik | Detay |
|---|---|
| Dil | Zazaca (zza) |
| Konuşucu | Tek konuşucu (Mozilla Zazaca veri setinden) |
| Mimari | VoxCPM2 + LoRA (r=32, α=32) |
| Eğitim verisi | ~1.700 segment |
| Eğitim adımı | 2.000 |
| LoRA ağırlıkları | ~70 MB (18,1M parametre, F32) |
| Audio sample rate | 16 kHz (giriş) / 48 kHz (çıkış) |
### Karşılaştırmalı Örnekler
Aşağıda **orijinal referans ses (Gerçek Konuşma)** ile **modelin ürettiği sentez (TTS)** arasındaki farkları duyabilirsiniz:
| # | Orijinal (Gerçek Konuşmacı) | Sentez (model çıktısı) |
|---|---|---|
| **1** | | |
| **2** | | |
| **3** | | |
## ⚡ Hızlı Başlangıç
```bash
# 1. Bu repo'yu klonlayın
git clone
huggingface.co
cd Mozilla_Zazaca_Alpha
# 2. Sanal ortam oluşturun
python -m venv venv
source venv/bin/activate
# 3. Gerekli paketleri yükleyin
pip install -r requirements.txt
# 4. Ses üretin (base model ilk seferde otomatik indirilir, ~4.6 GB)
python inference.py --text "[speaker:spk_tmp_001 language:zza] Pisînge merreyî dima şona"
```
> **Not:** LoRA yüklemesi `voxcpm` paketinin kendi LoRA desteğiyle yapılır — `peft` gerekmez.
## 📖 Kullanım
### Python API ile
```python
import json
import numpy as np
import soundfile as sf
from voxcpm import VoxCPM
from voxcpm.model.voxcpm import LoRAConfig
# 1. LoRA konfigürasyonunu okuyun
with open("lora_config.json") as f:
lc = json.load(f)["lora_config"]
lora_cfg = LoRAConfig(**{k: v for k, v in lc.items() if k in LoRAConfig.model_fields})
# 2. Base model + Mozilla …