This dataset investigates three interrelated questions about multilingual ASR performance on tonal languages:
Operational Definition: What does "language support" mean when a model lists 1,600+ languages? Does coverage imply functional accuracy on linguistically meaningful distinctions?