Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Représentation de la parole multilingue par apprentissage auto-supervisé dans un contexte subsaharien

Domaine:

natural language processing

Type de record:

papermodeldataset
Créateur:
CauGauthier, Elodie
Éditeur:
OraOraBALMat
Éditeur:
CCSDATA
Hôte:avatar
National audience Les approches auto-supervisées ont conduit à des avancées majeures dans le domaine de l'apprentissage profond. Par l'exploitation d'une grande quantité de données non annotées, ces approches ont notamment permis des améliorations dans des contextes peu dotés. Toutefois, les langues africaines restent majoritairement sous-représentées dans les jeux de données de préentraînement publiquement distribués. Dans ces travaux, nous préentraînons des modèles de parole auto-supervisés multilingues à partir de langues subsahariennes exclusivement. Nous étudions la pertinence des représentations apprises sur la tâche de reconnaissance de parole, en utilisant le jeu d'évaluation FLEURS-102. Notre modèle HuBERT_base obtient des résultats similaires face à l'approche multilingue w2v-bert de FLEURS, tout en étant plus efficient, avec 6 fois moins de paramètres et 7 fois moins de données. Nous présentont aussi un second modèle exploitant une sous-sélection équilibrée des données initiales, obtenant des performances compétitives avec près de 80 fois moins de données de préentraînement.

Visit

inria.hal.science

Tasks

automatic speech recognitionspeech processing

Languages

Notre

Tags

Apprentissage auto-superviséLangues subsaharienneReconnaissance de la parole multilingueHuBERT[INFO.INFO-CL]Computer Science [cs]/Computation and Language [cs.CL]

Licenses

http://creativecommons.org/licenses/by/info:eu-repo/semantics/OpenAccess

Similaires

Compréhension de la parole dans un contexte multilingueSynthèse de la parole arabe par apprentissage profond:Arabic speech synthesis using deep learning

Compréhension de la parole dans un contexte multilingue

Cette thèse s'inscrit dans le cadre de l'Apprentissage Profond appliqué au domaine de la Compréhensi

Synthèse de la parole arabe par apprentissage profond:Arabic speech synthesis using deep learning

Ce sujet de thèse vise à concevoir et à développer un système de synthèse de parole à partir du text