Logo Lanfrica

YoussefGhozzi/TuniTTS

Domain:

natural language processing

Record type:

dataset
Creator:
You
Host:
Ce dataset contient des enregistrements audio en Darija tunisienne. 5000 fichiers audio WAV (22.05 kHz, mono) 7.1 heures d'audio Metadonnees pour entraînement XTTS metadata_train.csv : 4750 segments pour l'entraînement metadata_eval.csv : 250 segments pour la validation wavs/ : tous les fichiers audio import pandas as pd train_df = pd.read_csv("metadata_train.csv", sep="|")