Logo Lanfrica

liboaccn/nmt-parallel-corpus

Domaine:

natural language processing

Type de record:

dataset
Créateur:
lib
Hôte:
We use OpusTools to extract resources from the OPUS project, a renowned platform for parallel corpora, and create a multilingual dataset. Specifically, we collect the parallel corpora from prominent projects within OPUS, including NLLB, CCMatrix, and OpenSubtitles.