A high-quality Yoruba speech dataset from female speakers, sourced from OpenSLR 86.
from datasets import load_dataset
dataset = load_dataset("oademuwagun/yoruba-speech-female")
├── metadata.csv
└── wavs/
├── yof_06136_00616155826.wav
├── yof_04310_00085429033.wav
└── ...
Column
Description
file_name
Path to audio file