Logo Lanfrica

Amharic-English Parallel Corpus

Domain:

natural language processing

Record type:

dataset
This corpus consists of 145,820 Amharic-English parallel sentences (segments) from various sources. This corpus is larger in size than previously compiled corpora. It is released for research purposes and can be used to train or support Amharic-English machine translation systems.