Dataset Summary
This is a cross-lingual knowledge base and question answering dataset for four low-resource South African languages: isiZulu, isiXhosa, Sepedi, and SeSotho. The dataset includes:
Parallel text corpora for alignment
Projected knowledge bases from ConceptNet and DBpedia
Verbalized Triples
Translated question-answer pairs