Estructura dataset:
El dataset está en formato de texto plano (.txt) con valores separados por tabuladores (TSV). Cada línea contiene un par de traducción Aymara-Español.
Columna 1: La oración en Aymara (ay).
Columna 2: La oración en Español (es).
Descripcion de datos:
"Este es un corpus paralelo Aymara-Español creado por AiMara Lab. Se utilizó como base el corpus paralelo Español-Inglés de 'manythings.org' (derivado de Tatoeba).