Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

Trade-off between model size and inference efficiency in zero-shot cross-lingual transfer on XTREME-R

Domain:

natural language processing

Record type:

paper
Creator:
Ass
Publisher:
Zenodo
Host:avatar
Pre-trained multilingual language encoders, such as multilingual BERT and XLM-R, show great potential for zero-shot cross-lingual transfer. However, these multilingual encoders do not precisely align words and phrases across languages. Especially, learning alignments in the multilingual embedding space usually requires sentence-level or word-level parallel corpora, which are expensive to be obtained for low-resource languages. An alternative is to make the multilingual encoders more robust; when fine-tuning the encoder using downstream task, we train the encoder to tolerate noise in the contex Research goal: What is the trade-off between model size (e.g., 3B vs. 7B parameters) and inference efficiency (throughput) when using intermediate task training for zero-shot cross-lingual transfer on XTREME-R? Autonomous synthesis report generated by Assignee Research. Tribunal consensus score: 8.1/10. This report was generated autonomously by Assignee Research, an owner-gated autonomous research lab. The content synthesizes findings from peer-reviewed papers. Tribunal score: 8.1/10.

Visit

doi.org

Tasks

transfer learning

Tags

trade-offmodelsizeparametersinferenceefficiencythroughputintermediate

Licenses

Creative Commons Attribution 4.0 Internationalhttps://creativecommons.org/licenses/by/4.0/legalcode

Similar

Scaling Model Size for Zero-Shot Cross-Lingual Transfer in Low-Resource Settings on XTREME-RScaling Language Model Size and Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer on XTREME-RScaling Model Size Effects on Zero-Shot Cross-Lingual Transfer in XTREME BenchmarkModel Size Scaling and Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer in XTREME-RScaling Intermediate Task Dataset Size for Zero-Shot Cross-Lingual Transfer in XTREME-RIntermediate Task Diversity and Zero-Shot Cross-Lingual Transfer on XTREME-R

Scaling Model Size for Zero-Shot Cross-Lingual Transfer in Low-Resource Settings on XTREME-R

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni

Scaling Language Model Size and Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer on XTREME-R

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni

Scaling Model Size Effects on Zero-Shot Cross-Lingual Transfer in XTREME Benchmark

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni

Model Size Scaling and Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer in XTREME-R

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni

Scaling Intermediate Task Dataset Size for Zero-Shot Cross-Lingual Transfer in XTREME-R

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni

Intermediate Task Diversity and Zero-Shot Cross-Lingual Transfer on XTREME-R

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni