Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

CLEAR-Global/TWB-Voice-1.0

Domain:

natural language processing

Record type:

dataset
Creator:
CLEAR Global
Host:
TWB Voice 1.0 is a multilingual speech corpus containing read speech data in three languages from Nigeria: Hausa, Shuwa Arabic, and Kanuri. This dataset was created as part of the TWB Voice project by CLEAR Global (formerly Translators without Borders) to support automatic speech recognition (ASR) development for underrepresented languages. Languages

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

Arabic, Chadian SpokenBushoongHausaKanembuKanuri, MangaKanuri, Yerwa

Licenses

other

Similar

CLEAR-Global/TWB-Voice-Hausa-TTS-1.0CLEAR-Global/TWB-Voice-Kanuri-TTS-1.0CLEAR-Global/TWB-voice-TTS-Hausa-1.0-samplesetCLEAR-Global/TWB-voice-TTS-Kanuri-1.0-samplesetTWB Voice 1.0 - KanuriTWB Voice 1.0 - Hausa

CLEAR-Global/TWB-Voice-Hausa-TTS-1.0

CLEAR-Global/TWB-Voice-Kanuri-TTS-1.0

CLEAR-Global/TWB-voice-TTS-Hausa-1.0-sampleset

Dataset Summary

CLEAR-Global/TWB-voice-TTS-Kanuri-1.0-sampleset

Dataset Summary

TWB Voice 1.0 - Kanuri

TWB Voice 1.0 - Kanuri is the Kanuri language portion of the TWB Voice 1.0 multilingual speech corpu

TWB Voice 1.0 - Hausa

TWB Voice 1.0 - Hausa is the Hausa language portion of the TWB Voice 1.0 multilingual speech corpus,