Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

DARTS-ASR: Differentiable Architecture Search for Multilingual Speech Recognition and Adaptation

Domaine:

natural language processing

Type de record:

papermodel
Créateur:
CheHsuLeeLee
Hôte:avatar
In previous works, only parameter weights of ASR models are optimized under fixed-topology architecture. However, the design of successful model architecture has always relied on human experience and intuition. Besides, many hyperparameters related to model architecture need to be manually tuned. Therefore in this paper, we propose an ASR approach with efficient gradient-based architecture search, DARTS-ASR. In order to examine the generalizability of DARTS-ASR, we apply our approach not only on many languages to perform monolingual ASR, but also on a multilingual ASR setting. Following previous works, we conducted experiments on a multilingual dataset, IARPA BABEL. The experiment results show that our approach outperformed the baseline fixed-topology architecture by 10.2% and 10.0% relative reduction on character error rates under monolingual and multilingual ASR settings respectively. Furthermore, we perform some analysis on the searched architectures by DARTS-ASR. Accepted at INTERSPEECH 2020

Visit

arxiv.org

Tasks

automatic speech recognitionspeech processing

Tags

Audio and Speech ProcessingComputation and LanguageMachine LearningSound

Similaires

Multilingual Representations for Low Resource Speech Recognition and Keyword SearchOmnilingual ASR: Open-Source Multilingual Speech Recognition for 1600+ LanguagesEthio-ASR: Joint Multilingual Speech Recognition and Language Identification for Ethiopian LanguagesRapid Language Adaptation for Multilingual E2E Speech Recognition Using Encoder PromptingMultilingual sequence-to-sequence speech recognition: architecture, transfer learning, and language modelingMultilingual Automatic Speech Recognition for Kinyarwanda, Swahili, and Luganda: Advancing ASR in Select East African Languages

Multilingual Representations for Low Resource Speech Recognition and Keyword Search

This paper examines the impact of multilingual (ML) acoustic representations on Automatic Speech Rec

Omnilingual ASR: Open-Source Multilingual Speech Recognition for 1600+ Languages

Automatic speech recognition (ASR) has advanced in high-resource languages, but most of the world's

Ethio-ASR: Joint Multilingual Speech Recognition and Language Identification for Ethiopian Languages

We present Ethio-ASR, a suite of multilingual CTC-based automatic speech recognition (ASR) models jo

Rapid Language Adaptation for Multilingual E2E Speech Recognition Using Encoder Prompting

End-to-end multilingual speech recognition models handle multiple languages through a single model,

Multilingual sequence-to-sequence speech recognition: architecture, transfer learning, and language modeling

Sequence-to-sequence (seq2seq) approach for low-resource ASR is a relatively new direction in speech

Multilingual Automatic Speech Recognition for Kinyarwanda, Swahili, and Luganda: Advancing ASR in Select East African Languages

Multilingual Automatic Speech Recognition for Kinyarwanda, Swahili, and Luganda: Advancing ASR in Select East African Languages

Poster presented at the Deep Learning Indaba 2023 by Samuel Rutunda