Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Amharic LLM Training Dataset

Domaine:

natural language processing

Type de record:

dataset
Créateur:
Yos
Hôte:
Complete production-ready Amharic dataset for large language model training and deployment. from datasets import load_dataset # Load the complete dataset dataset = load_dataset("YoseAli/amharic-llm-training-data") # Access splits train_data = dataset["train"] # 761,501 samples test_data = dataset["test"] # 84,612 samples print(f"Training samples: {len(train_data):,}")

Visit

huggingface.co

Tasks

language modeling

Languages

Amharic

Tags

amharicllmtrainingethiopiainstruction-tuningafrican-languagesdeploymentproduction

Licenses

mit