A copy of the WURA dataset (V2 Passages).
langs = {
"Afrikaans": "af",
"Amharic": "am",
"Egyptian Arabic": "ar",
"English": "en",
"French": "fr",
"Hausa": "ha",
"Igbo": "ig",
"Kinyarwanda": "ki",
"Malagasy": "mg",
"Chichewa": "ny",
"Afaan Oromoo": "or",
"Portuguese": "po",
"Somali": "sm",
"Shona": "sn",
"Sesotho": "st",
"Swahili": "sw",