Logo Lanfrica

liboaccn/nmt-parallel-corpus

Domain:

natural language processing

Record type:

dataset
Creator:
lib
Host:
We use OpusTools to extract resources from the OPUS project, a renowned platform for parallel corpora, and create a multilingual dataset. Specifically, we collect the parallel corpora from prominent projects within OPUS, including NLLB, CCMatrix, and OpenSubtitles.