Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

MIRACL-corpus

Domaine:

natural language processing

Type de record:

dataset
Créateur:
mir
Hôte:
Homepage | Repository: | Paper | ArXiv MIRACL 🌍🙌🌏 (Multilingual Information Retrieval Across a Continuum of Languages) is a multilingual retrieval dataset that focuses on search across 18 different languages, which collectively encompass over three billion native speakers around the world.

Visit

huggingface.co

Tasks

information retrieval

Languages

SwahiliYoruba

Licenses

apache-2.0

Similaires

Optimal Transport Distillation for Cross-Lingual Alignment Robustness in MIRACLMaking a MIRACL: Multilingual Information Retrieval Across a Continuum of LanguagesOptimal Transport Distillation for mBERT Performance Variance Reduction in MIRACL RetrievalHybrid Batch Training for Zero-Shot Retrieval in Low-Resource MIRACL LanguagesHybrid Batch Training Ratios for Zero-Shot MIRACL Retrieval in Low-Resource LanguagesHybrid Batch Training vs. Knowledge Distillation for Low-Resource Zero-Shot Retrieval on MIRACL

Optimal Transport Distillation for Cross-Lingual Alignment Robustness in MIRACL

Benefiting from transformer-based pre-trained language models, neural ranking models have made signi

Making a MIRACL: Multilingual Information Retrieval Across a Continuum of Languages

MIRACL (Multilingual Information Retrieval Across a Continuum of Languages) is a multilingual datase

Optimal Transport Distillation for mBERT Performance Variance Reduction in MIRACL Retrieval

Benefiting from transformer-based pre-trained language models, neural ranking models have made signi

Hybrid Batch Training for Zero-Shot Retrieval in Low-Resource MIRACL Languages

Information retrieval across different languages is an increasingly important challenge in natural l

Hybrid Batch Training Ratios for Zero-Shot MIRACL Retrieval in Low-Resource Languages

Information retrieval across different languages is an increasingly important challenge in natural l

Hybrid Batch Training vs. Knowledge Distillation for Low-Resource Zero-Shot Retrieval on MIRACL

Information retrieval across different languages is an increasingly important challenge in natural l