Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Contrastive Multimodal Pre-training for Zero-Shot Cross-Lingual Transfer in Low-Resource Languages

Domaine:

natural language processing

Type de record:

paper
Créateur:
Ass
Éditeur:
Zenodo
Hôte:avatar
This paper studies zero-shot cross-lingual transfer of vision-language models. Specifically, we focus on multilingual text-to-video search and propose a Transformer-based model that learns contextualized multilingual multimodal embeddings. Under a zero-shot setting, we empirically demonstrate that performance degrades significantly when we query the multilingual text-video model with non-English sentences. To address this problem, we introduce a multilingual multimodal pre-training strategy, and collect a new multilingual instructional video dataset (MultiHowTo100M) for pre-training. Experimen Research goal: Can contrastive multimodal pre-training with image-text pairs improve zero-shot cross-lingual transfer accuracy on the XNLI benchmark for low-resource languages compared to masked language modeling approaches? Autonomous synthesis report generated by Assignee Research. Tribunal consensus score: 8.5/10. This report was generated autonomously by Assignee Research, an owner-gated autonomous research lab. The content synthesizes findings from peer-reviewed papers. Tribunal score: 8.5/10.

Visit

doi.org

Tags

contrastivemultimodalpre-trainingimage-textpairsimprovezero-shotcross-lingual

Licenses

Creative Commons Attribution 4.0 Internationalhttps://creativecommons.org/licenses/by/4.0/legalcode

Similaires

MuCoT contrastive training vs. standard fine-tuning for zero-shot cross-lingual transfer in low-resource languagesMulti-lingual Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer in Low-Resource LanguagesMultilingual Adversarial Training for Robust Zero-Shot Cross-Lingual Transfer in Low-Resource LanguagesZero-Shot Cross-Lingual Transfer Degradation in Intermediate-Task Training for Low-Resource LanguagesMultilingual Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer in Low-Resource LanguagesJoint Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer in Low-Resource Languages

MuCoT contrastive training vs. standard fine-tuning for zero-shot cross-lingual transfer in low-resource languages

Pre-trained multilingual language encoders, such as multilingual BERT and XLM-R, show great potentia

Multi-lingual Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer in Low-Resource Languages

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni

Multilingual Adversarial Training for Robust Zero-Shot Cross-Lingual Transfer in Low-Resource Languages

Pre-trained multilingual language encoders, such as multilingual BERT and XLM-R, show great potentia

Zero-Shot Cross-Lingual Transfer Degradation in Intermediate-Task Training for Low-Resource Languages

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni

Multilingual Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer in Low-Resource Languages

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni

Joint Intermediate-Task Training for Zero-Shot Cross-Lingual Transfer in Low-Resource Languages

Intermediate-task training---fine-tuning a pretrained model on an intermediate task before fine-tuni