Ce dataset contient des enregistrements audio en Darija tunisienne.
5000 fichiers audio WAV (22.05 kHz, mono)
7.1 heures d'audio
Metadonnees pour entraînement XTTS
metadata_train.csv : 4750 segments pour l'entraînement
metadata_eval.csv : 250 segments pour la validation
wavs/ : tous les fichiers audio
import pandas as pd
train_df = pd.read_csv("metadata_train.csv", sep="|")