Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

rasyosef/Amharic-Passage-Retrieval-Dataset-V2

Domaine:

natural language processing

Type de record:

dataset
Créateur:
ras
Hôte:
This dataset is the official benchmark for the paper "The Multilingual Curse at the Retrieval Layer: Evidence from Amharic". It provides a fixed 90/10 train–test split consisting of 68,000 query–passage pairs, specifically designed for evaluating and training dense, late-interaction, learned sparse, and cross-encoder retrieval models for the Amharic language. GitHub Repository: rasyosef/amharic-neural-ir

Visit

huggingface.co

Tasks

information retrieval

Languages

Amharic

Licenses

cc-by-nc-sa-4.0