Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Evaluating Robustness of LLMs to Typographical Noise in Yorùbá QA

Domaine:

natural language processing

Type de record:

paper
Créateur:
AssFajJamOke
Éditeur:
Und
Hôte:avatar
Generative AI models are primarily accessed through chat interfaces, where user queries often contain typographical errors. While these models perform well in English, their robustness to noisy inputs in low-resource languages like Yorùbá remains underexplored. This work investigates a Yorùbá question-answering (QA) task by introducing synthetic typographical noise into clean inputs. We design a probabilistic noise injection strategy that simulates realistic human typos. In our experiments, each character in a clean sentence is independently altered, with noise levels ranging from 10% to 40%. We evaluate performance across three strong multilingual models using two complementary metrics: (1) a multilingual BERTScore to assess semantic similarity between outputs on clean and noisy inputs, and (2) an LLM-as-judge approach, where the best Yorùbá-capable model rates fluency, comprehension, and accuracy on a 1–5 scale. Results show that while English QA performance degrades gradually, Yorùbá QA suffers a sharper decline. At 40% noise, GPT-4o experiences over a 50% drop in comprehension ability, with similar declines for Gemini 2.0 Flash and Claude 3.7 Sonnet. We conclude with recommendations for noise-aware training and dedicated noisy Yorùbá benchmarks to enhance LLM robustness in low-resource settings.

Visit

doi.orgunderline.io

Tasks

question answering

Languages

Yoruba

Tags

Computational LinguisticsNatural Language ProcessingArtificial Intelligence

Similaires

Beyond Generalization :Evaluating Multilingual LLMs for Yorùbá Animal Health TranslationCross-lingual NER robustness to label noise under unlabeled data volume variationAfriVox: Probing Multilingual and Accent Robustness of Speech LLMsCross-lingual NER Robustness Under Annotation Projection Noise in Low-Resource SettingsRobustness of Cross-Lingual NER Models Under Annotation Projection Noise in Low-Resource LanguagesSynergistic Optimization Effects on Multilingual Retrieval Robustness in Low-Resource TyDi QA

Beyond Generalization :Evaluating Multilingual LLMs for Yorùbá Animal Health Translation

Machine translation (MT) has advanced significantly for high-resource languages, yet specialized dom

Cross-lingual NER robustness to label noise under unlabeled data volume variation

Cross-lingual Named Entity Recognition (NER) leverages knowledge transfer between languages to ident

AfriVox: Probing Multilingual and Accent Robustness of Speech LLMs

Recent advances in multimodal and speech-native large language models (LLMs) have delivered impressi

Cross-lingual NER Robustness Under Annotation Projection Noise in Low-Resource Settings

Cross-lingual Named Entity Recognition (NER) leverages knowledge transfer between languages to ident

Robustness of Cross-Lingual NER Models Under Annotation Projection Noise in Low-Resource Languages

Cross-lingual Named Entity Recognition (NER) leverages knowledge transfer between languages to ident

Synergistic Optimization Effects on Multilingual Retrieval Robustness in Low-Resource TyDi QA

Information retrieval across different languages is an increasingly important challenge in natural l