Logo Lanfrica

ashaady/llm-wolof-tts

Domain:

natural language processing

Record type:

softwaremodel
Creator:
ash
Host:
# Système de Traduction Wolof-Français et de Synthèse Vocale (API) ## Introduction Cette API offre un système complet pour la traduction entre le Wolof et le Français, la reconnaissance vocale, et la synthèse vocale (TTS). Elle permet de transcrire des fichiers audio en texte Wolof, de traduire du texte entre le Wolof et le Français, de convertir du texte Wolof en parole, et même d'intégrer une expérience de chat complète avec le modèle de langage LLaMA. Ce projet vise à fournir des ressources technologiques linguistiques pour le Wolof, une langue parlée au Sénégal, en Gambie et en Mauritanie. En combinant des modèles de pointe en ASR, traduction et TTS, cette API ouvre la voie à des applications diverses, notamment la communication multilingue, l'éducation et la création de contenu. ## Fonctionnalités * **Transcription Audio :** Transcrit des fichiers audio en texte Wolof en utilisant un modèle Whisper affiné. * **Traduction Wolof-Français :** Permet la traduction entre le Wolof et le Français à l'aide de modèles NLLB. * **Synthèse Vocale (TTS) :** Synthétise la parole à partir de texte Wolof grâce à un modèle SpeechT5 adapté. * **Chat LLaMA Intégré :** Offre une expérience de chat conversationnelle en Wolof en utilisant le modèle de langage LLaMA, le tout géré par un pipeline de traduction. * **Documentation API :** Fournit une documentation API interactive grâce à Swagger UI et ReDoc. ## Modèles Utilisés L'API s'appuie sur les modèles pré-entraînés suivants de Hugging Face Transformers : * **Reconnaissance Vocale Automatique (ASR) :** `Alwaly/whisper-medium-wolof` (Modèle Whisper optimisé pour le Wolof) * **Traduction Wolof-Français :** * `Lahad/nllb200-francais-wolof` (Français vers Wolof) * `bilalfaye/nllb-200-distilled-600M-wo-fr-en` (Wolof vers Français) * **Synthèse Vocale (TTS) :** * `bilalfaye/speecht5_tts-wolof` (Modèle SpeechT5 optimisé pour la synthèse vocale en Wolof) * `microsoft/speecht5_hifigan` (Vocodeur pour Speech …