Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Multi-Method Validation of Large Language Model Medical Translation Across High- and Low-Resource Languages

Domaine:

natural language processinghealthcare

Type de record:

paper
Créateur:
AnyGueLiuKey
Hôte:avatar
Language barriers affect 27.3 million U.S. residents with non-English language preference, yet professional medical translation remains costly and often unavailable. We evaluated four frontier large language models (GPT-5.1, Claude Opus 4.5, Gemini 3 Pro, Kimi K2) translating 22 medical documents into 8 languages spanning high-resource (Spanish, Chinese, Russian, Vietnamese), medium-resource (Korean, Arabic), and low-resource (Tagalog, Haitian Creole) categories using a five-layer validation framework. Across 704 translation pairs, all models achieved high semantic preservation (LaBSE greater than 0.92), with no significant difference between high- and low-resource languages (p = 0.066). Cross-model back-translation confirmed results were not driven by same-model circularity (delta = -0.0009). Inter-model concordance across four independently trained models was high (LaBSE: 0.946), and lexical borrowing analysis showed no correlation between English term retention and fidelity scores in low-resource languages (rho = +0.018, p = 0.82). These converging results suggest frontier LLMs preserve medical meaning across resource levels, with implications for language access in healthcare. 32 references, 5 tables, 2 figures

Visit

arxiv.org

Tasks

machine translation

Tags

Computation and LanguageJ.3; I.2.7

Similaires

Machine Translation Hallucination Detection for Low and High Resource Languages using Large Language ModelsEnabling Medical Translation for Low-Resource LanguagesInteractive Machine Translation with Large Language Models for Low-resource LanguagesEvaluating Large Language Models for Low-Resource Multilingual Machine Translation in the Medical DomainNusaMT-7B: Machine Translation for Low-Resource Indonesian Languages with Large Language ModelsLanguage Ranker: A Metric for Quantifying LLM Performance Across High and Low-Resource Languages

Machine Translation Hallucination Detection for Low and High Resource Languages using Large Language Models

Recent advancements in massively multilingual machine translation systems have significantly enhance

Enabling Medical Translation for Low-Resource Languages

We present research towards bridging the language gap between migrant workers in Qatar and medical s

Interactive Machine Translation with Large Language Models for Low-resource Languages

Large language models (LLM) have been applied to machine translation with notable success. However,

Evaluating Large Language Models for Low-Resource Multilingual Machine Translation in the Medical Domain

This dissertation explores neural machine translation (NMT) in multilingual medical domain, with

NusaMT-7B: Machine Translation for Low-Resource Indonesian Languages with Large Language Models

Large Language Models (LLMs) have demonstrated exceptional promise in translation tasks for high-res

Language Ranker: A Metric for Quantifying LLM Performance Across High and Low-Resource Languages

The development of Large Language Models (LLMs) relies on extensive text corpora, which are often un