Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Performance Gap Dynamics in Cross-Lingual Retrieval Across Multilingual Pre-trained Language Models on XOR-TyDi QA

Domaine:

natural language processing

Type de record:

paper
Créateur:
Ass
Éditeur:
Zenodo
Hôte:avatar
Accuracy of English-language Question Answering (QA) systems has improved significantly in recent years with the advent of Transformer-based models (e.g., BERT). These models are pre-trained in a self-supervised fashion with a large English text corpus and further fine-tuned with a massive English QA dataset (e.g., SQuAD). However, QA datasets on such a scale are not available for most of the other languages. Multi-lingual BERT-based models (mBERT) are often used to transfer knowledge from high-resource languages to low-resource languages. Since these models are pre-trained with huge text corp Research goal: How does the performance gap between high-resource and low-resource languages in cross-lingual retrieval models change when using different multilingual pre-trained language models (e.g., mBERT, XLM-R, mT5) as measured by exact match accuracy on XOR-TyDi QA? Autonomous synthesis report generated by Assignee Research. Tribunal consensus score: 7.6/10. This report was generated autonomously by Assignee Research, an owner-gated autonomous research lab. The content synthesizes findings from peer-reviewed papers. Tribunal score: 7.6/10.

Visit

doi.orgzenodo.org

Tasks

question answering

Tags

performancegaphigh-resourcelow-resourcelanguagescross-lingualretrievalmodels

Licenses

Creative Commons Attribution 4.0 Internationalhttps://creativecommons.org/licenses/by/4.0/legalcode

Similaires

Cross-lingual Knowledge Distillation for Zero-shot XOR-TyDi QA PerformanceImpact of Pre-trained Multilingual Language Models on Zero-shot Cross-lingual NER Transfer PerformanceCross-lingual Zero-shot Retrieval Accuracy of WebFAQ vs. TyDi QA Models on Low-resource XQuAD SubsetsMultilingual Pre-trained Language Models and Cross-lingual NER Robustness in Low-Resource SettingsRobustness of Zero-Shot Cross-Lingual Retrieval Models Trained on Code-Switched Data Across Language FamiliesPerformance of Hybrid Batch-Trained Multilingual Models on XLM-R for Low-Resource Languages in Cross-Lingual Retrieval

Cross-lingual Knowledge Distillation for Zero-shot XOR-TyDi QA Performance

Benefiting from transformer-based pre-trained language models, neural ranking models have made signi

Impact of Pre-trained Multilingual Language Models on Zero-shot Cross-lingual NER Transfer Performance

Multi-lingual language models (LM), such as mBERT, XLM-R, mT5, mBART, have been remarkably successfu

Cross-lingual Zero-shot Retrieval Accuracy of WebFAQ vs. TyDi QA Models on Low-resource XQuAD Subsets

Benefiting from transformer-based pre-trained language models, neural ranking models have made signi

Multilingual Pre-trained Language Models and Cross-lingual NER Robustness in Low-Resource Settings

Cross-lingual Named Entity Recognition (NER) leverages knowledge transfer between languages to ident

Robustness of Zero-Shot Cross-Lingual Retrieval Models Trained on Code-Switched Data Across Language Families

Transferring information retrieval (IR) models from a high-resource language (typically English) to

Performance of Hybrid Batch-Trained Multilingual Models on XLM-R for Low-Resource Languages in Cross-Lingual Retrieval

Pretrained multilingual language models have become a common tool in transferring NLP capabilities t