Logo Lanfrica
fr
Accueil
Atlas
Analyses
Documentation
Sign in
Retour
CMU Wilderness Multilingual Speech Dataset
Domaine:
natural language processing
Type de record:
dataset
Visit
Actions
Share
Report an issue
A dataset of over 700 different languages providing audio, aligned text and word pronunciations. On average each language provides around 20 hours of sentence-lengthed transcriptions. Data is mined from read New Testaments from
bible.is
Visit
github.com
Connected records
paper
Tasks
speech translation
Languages
Abidji
Acholi
Adele
Adioukrou
Aka
Akebu
Akoose
Alur
Amazigh
Anufo
+236
View more
Tags
speech alignment
Licenses