Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Decolonizing Linguistic Policies in Automated Speech Recognition: A Framework for Cross-Culturally Competent Speech AI

Domaine:

natural language processing

Type de record:

paper
Créateur:
CunMenMarNet
Éditeur:
arXiv
Hôte:avatar
This paper focuses on automatic speech recognition (ASR) and ASR-mediated voice interfaces that shape access to public services, healthcare, and education. We argue that persistent failures for low-resource, Indigenous, and non-standard language varieties are not only technical errors, but also implicit linguistic policies that reproduce colonial language hierarchies. Drawing on linguistic capital, raciolinguistic ideology, language policy research, and decolonial computing, we show how data, metrics, and model priors determine whose voices become machine-legible. We introduce the Three Harms (3M) taxonomy---Misrecognition, Misalignment, and Mistrust---and a seven-layer situatedness model for linguistic diversity in ASR and ASR-mediated voice interfaces. We then propose a participatory framework and minimum audit protocol for culturally competent ASR, positioning affected communities as co-designers, evaluators, and governance partners. 10 Pages, 2 Figures, 2 Tables, Interspeech 2026 - Sydney, Australia

Visit

doi.org

Tasks

automatic speech recognitionspeech processing

Tags

Computation and Language (cs.CL)Computers and Society (cs.CY)Human-Computer Interaction (cs.HC)FOS: Computer and information sciences

Licenses

Creative Commons Attribution 4.0 Internationalhttps://creativecommons.org/licenses/by/4.0/legalcode

Similaires

Framework for Hausa Speech RecognitionPOTSA: A Cross-Lingual Speech Alignment Framework for Speech-to-Text TranslationQuantum AI in Speech Emotion RecognitionLinguistic disparities in cross-language automatic speech recognition transfer from Arabic to TashlhiytA Noise-Robust End-to-End Framework for Amharic Speech Recognition“I don’t Think These Devices are Very Culturally Sensitive.”—Impact of Automated Speech Recognition Errors on African Americans

Framework for Hausa Speech Recognition

POTSA: A Cross-Lingual Speech Alignment Framework for Speech-to-Text Translation

Speech Large Language Models have achieved breakthroughs in multilingual speech-to-text translation.

Quantum AI in Speech Emotion Recognition

We evaluate a hybrid quantum–classical pipeline for speech emotion recognition (SER) on a custom Afr

Linguistic disparities in cross-language automatic speech recognition transfer from Arabic to Tashlhiyt

Abstract Tashlhiyt is a low-resource language with respect to acoustic databases, language corpora,

A Noise-Robust End-to-End Framework for Amharic Speech Recognition

Abstract End-to-end automatic speech recognition (ASR) offers a streamlined altern

“I don’t Think These Devices are Very Culturally Sensitive.”—Impact of Automated Speech Recognition Errors on African Americans

Automated speech recognition (ASR) converts language into text and is used across a variety of appli