Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

maanka2/somali-asr-corpus

Domain:

natural language processing

Record type:

dataset
Creator:
maa
Host:
Somali ASR Corpus is a cleaned Somali speech dataset designed for Automatic Speech Recognition (ASR) and Speech-to-Text (STT) research. The dataset contains transcribed Somali speech recordings processed with noise reduction and audio normalization techniques to improve training quality for speech models. Feature Type text string audio Audio The audio files were processed using:

Visit

huggingface.co

Tasks

automatic speech recognitionspeech processing

Languages

Somali

Tags

somaliasrspeech-recognitionspeech-corpusaudiostttranscribed-speechfemale-voiceclean-audionoise-reduction+2

Licenses

apache-2.0

Similar

maanka2/somali-tts-datasetSomali-asr/Somali-Agriculture-ASRMustafaa4a/ASR-SomaliAbdirahmanX881/somali-alphabetical-ASRMustafaa4a/ASR-Somali-v2ayaazlion/asr-somali-may

maanka2/somali-tts-dataset

Somali-asr/Somali-Agriculture-ASR

Mustafaa4a/ASR-Somali

AbdirahmanX881/somali-alphabetical-ASR

# Somali Alphabet ASR project ## Setup 1. Create virtual environment: python3 -m venv venv 2. Activ

Mustafaa4a/ASR-Somali-v2

ayaazlion/asr-somali-may