Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

ConVerSum: A Contrastive Learning-based Approach for Data-Scarce Solution of Cross-Lingual Summarization Beyond Direct Equivalents

Domaine:

natural language processing

Type de record:

paper
Créateur:
LorRahSha
Hôte:avatar
Cross-lingual summarization (CLS) is a sophisticated branch in Natural Language Processing that demands models to accurately translate and summarize articles from different source languages. Despite the improvement of the subsequent studies, This area still needs data-efficient solutions along with effective training methodologies. To the best of our knowledge, there is no feasible solution for CLS when there is no available high-quality CLS data. In this paper, we propose a novel data-efficient approach, ConVerSum, for CLS leveraging the power of contrastive learning, generating versatile candidate summaries in different languages based on the given source document and contrasting these summaries with reference summaries concerning the given documents. After that, we train the model with a contrastive ranking loss. Then, we rigorously evaluate the proposed approach against current methodologies and compare it to powerful Large Language Models (LLMs)- Gemini, GPT 3.5, and GPT 4o proving our model performs better for low-resource languages' CLS. These findings represent a substantial improvement in the area, opening the door to more efficient and accurate cross-lingual summarizing techniques.

Visit

arxiv.org

Tasks

machine translationnatural language generationsummarization

Tags

Computation and Language

Similaires

Cross-Lingual IPA Contrastive Learning for Zero-Shot NERCrossSum: Beyond English-Centric Cross-Lingual Abstractive Text Summarization for 1500+ Language PairsContrastive Learning for Cross-Lingual Alignment and Robustness in Multimodal ModelsMultilingual Contrastive Learning for Zero-Shot Cross-Lingual Retrieval on XNLIProjection-based Data Transfer versus Direct Multilingual Fine-tuning for Cross-lingual NER PerformanceContrastive Cross-Lingual Calibration for Large Language Models

Cross-Lingual IPA Contrastive Learning for Zero-Shot NER

Existing approaches to zero-shot Named Entity Recognition (NER) for low-resource languages have prim

CrossSum: Beyond English-Centric Cross-Lingual Abstractive Text Summarization for 1500+ Language Pairs

We present CrossSum, a large-scale dataset comprising 1.65 million cross-lingual article-summary samples in 1500+ language-pairs constituting 45 languages. We use the multilingual XL-Sum dataset and align identical articles written in different languages via cross-

Contrastive Learning for Cross-Lingual Alignment and Robustness in Multimodal Models

Pre-trained multilingual language encoders, such as multilingual BERT and XLM-R, show great potentia

Multilingual Contrastive Learning for Zero-Shot Cross-Lingual Retrieval on XNLI

Information retrieval across different languages is an increasingly important challenge in natural l

Projection-based Data Transfer versus Direct Multilingual Fine-tuning for Cross-lingual NER Performance

Cross-lingual Named Entity Recognition (NER) leverages knowledge transfer between languages to ident

Contrastive Cross-Lingual Calibration for Large Language Models

Large language models (LLMs) are increasingly deployed in multilingual settings, yet their probabili