Logo Lanfrica

AiMaraLab Parallel Corpus from Anki/Tatoeba

Domain:

natural language processing

Record type:

dataset
Creator:
aim
Host:
Estructura dataset: El dataset está en formato de texto plano (.txt) con valores separados por tabuladores (TSV). Cada línea contiene un par de traducción Aymara-Español. Columna 1: La oración en Aymara (ay). Columna 2: La oración en Español (es). Descripcion de datos: "Este es un corpus paralelo Aymara-Español creado por AiMara Lab. Se utilizó como base el corpus paralelo Español-Inglés de 'manythings.org' (derivado de Tatoeba).