Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

gashudemman/amharic-sentencepiece-tokenizer

Type de record:

model
Créateur:
gas
Hôte:

Visit

huggingface.co

Languages

Amharic

Licenses

apache-2.0

Similaires

mewaeltsegay/Tigrinya-SentencePiece-Tokenizermisge10/amharic-tokenizerMequanent/amharic-tokenizer-fastBonnief/amharic-nllb-tokenizerdagim19/amharic-tokenizer-bpeAmharic Segmenter and tokenizer

mewaeltsegay/Tigrinya-SentencePiece-Tokenizer

misge10/amharic-tokenizer

Mequanent/amharic-tokenizer-fast

Bonnief/amharic-nllb-tokenizer

dagim19/amharic-tokenizer-bpe

This a code to train a bpe tokenizer using the amharic alphabets and amharic letters. The trained to

Amharic Segmenter and tokenizer

This is a simple script that split an Amharic document into different sentences and tokenes. If you find an issue, please let us know in the GitHub (https://github.com/uhh-lt/amharicprocessor/issues)