Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

rasyosef/amharic-sentences-corpus

Domaine:

natural language processing

Type de record:

dataset
Créateur:
ras
Hôte:
This dataset is compiled by Yimam et al. (2021) at LT Group, University of Hamburg, Germany. It comprises a collection of 6.4 million Amharic sentences intended for use in language model pretraining. GitHub uhh-lt/ethiopicmodels Dataset: Amharic corpus Paper: Introducing various Semanti… For citing this dataset, please use the following: @Article{fi13110275,

Visit

huggingface.co

Tasks

language modeling

Languages

Amharic

Similaires

a3xrfgb/amharic-sentences-corpusmikeendale/gpt2-amharic-sentences-corpusrasyosef/bert-amharicrasyosef/amharic-sentimentrasyosef/roberta-medium-amharicrasyosef/embedding-amharic-base

a3xrfgb/amharic-sentences-corpus

This 1.6 million Amharic sentences corpus reflects current Amharic usage as of December 20, 2025, an

mikeendale/gpt2-amharic-sentences-corpus

rasyosef/bert-amharic

BERT transformer models pretrained on amharic text # BERT Amharic This repo contains 4 BERT transf

rasyosef/amharic-sentiment

This dataset contains 2781 cleaned Amharic Tweets, labeled as having either positive or negative sen

rasyosef/roberta-medium-amharic

rasyosef/embedding-amharic-base