Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

AmazingMrBill/ASR-swahili

Domaine:

natural language processing

Type de record:

model
Créateur:
Ama
Hôte:
# Swahili Automatic Speech Recognition (ASR) Model ## Overview This repository contains code and instructions for utilizing a Swahili Automatic Speech Recognition (ASR) model based on the transformers library. The model is pre-trained on Swahili audio data and can be used to transcribe Swahili speech in various applications. ## Instructions ### 1. Install Dependencies Make sure you have the required dependencies installed. You can install them by running the following command: ```bash !pip install transformers ``` ### 2. Set Up the ASR Pipeline ```python from transformers import pipeline from google.colab import drive # Set up the ASR pipeline using the Swahili model # model example is Akash/Swahili_xlrs from hugging face, I also used alamsher/wav2vec2-large-xlsr-53-common-voice-sw pipe = pipeline("automatic-speech-recognition", model="Akashpb13/Swahili_xlsr", device=0) # Mount Google Drive to access your files drive.mount('/content/drive') ``` ### 3. Load and Transcribe Audio Files #### Single Audio File: ```python from IPython.display import Audio # Display an audio file Audio("/content/test/common_voice_sw_27729935.mp3") # Transcribe the audio file pipe("/content/test/common_voice_sw_27729935.mp3") ``` #### Multiple Audio Files: ```python # Create a DataFrame with file paths test = pd.read_csv('/content/drive/MyDrive/Models/SampleSubmission.csv') test["my_path"] = ["/content/test/" + i for i in test.path] # Transcribe multiple audio files pipe(test.my_path.to_list()) ``` ### 4. Save Transcriptions to CSV ```python # Create a submission DataFrame sub = pd.DataFrame() sub["path"] = test.path.to_list() sub["sentence"] = result_list # Save the submission to a CSV file sub.to_csv("ASR_Submission.csv", index=False) ``` ### 5. Perform ASR on Entire Dataset ```python # Perform ASR predictions on the entire dataset res = [] for path in tqdm(test.path): res.append(pipe(f'/content/drive/MyDrive/asr/test_audios/{path}')['text']) # Update the test Data …

Visit

github.com

Tasks

automatic speech recognitionspeech processing

Languages

Swahili

Similaires

Swahili-ASRAnshKhurana/Swahili-ASRElvisGitau/swahili-ASRlyzy/swahili-asr-modelokonp07/Swahili-ASR-solutionAfrivoice ASR Swahili dataset

Swahili-ASR

Swahili-ASR is a 600-hour conversational Swahili speech corpus with fully human-generated verbatim t

AnshKhurana/Swahili-ASR

ASR System for Swahili # Swahili-ASR ASR System for Swahili

ElvisGitau/swahili-ASR

lyzy/swahili-asr-model

okonp07/Swahili-ASR-solution

Swahili asr # Swahili ASR — Offline, On-Device (Zindi Challenge Starter) Colab‑ready baseline + re

Afrivoice ASR Swahili dataset

Domain Total number of hours Total number of transcribed hours Total number of clips Total Size of t