Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

A3-108 Controlling Token Generation in Low Resource Machine Translation Systems

Domaine:

natural language processing

Type de record:

paper
Créateur:
AssShrivastava, ManishYad
Éditeur:
Und
Hôte:avatar
Translating for low-resource languages is challenging due to limited quality data. We improved translation performance by integrating target sentence length as an additional feature to source sentence during training. We developed transformer models and evaluated across 8 language directions (English <=> Assamese, Manipuri, Khasi, and Mizo), using four different length encoding methods. Comparing these models to the baseline, we submitted two systems per language direction and present our findings here.​

Visit

doi.orgunderline.io

Tasks

machine translation

Tags

Computational LinguisticsNatural Language Processing