Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Cost-Efficient Cross-Lingual Retrieval-Augmented Generation for Low-Resource Languages: A Case Study in Bengali Agricultural Advisory

Domaine:

natural language processingagriculture

Type de record:

papersoftwaremodel
Créateur:
HosSubMahNab
Hôte:avatar
Access to reliable agricultural advisory remains limited in many developing regions due to a persistent language barrier: authoritative agricultural manuals are predominantly written in English, while farmers primarily communicate in low-resource local languages such as Bengali. Although recent advances in Large Language Models (LLMs) enable natural language interaction, direct generation in low-resource languages often exhibits poor fluency and factual inconsistency, while cloud-based solutions remain cost-prohibitive. This paper presents a cost-efficient, cross-lingual Retrieval-Augmented Generation (RAG) framework for Bengali agricultural advisory that emphasizes factual grounding and practical deployability. The proposed system adopts a translation-centric architecture in which Bengali user queries are translated into English, enriched through domain-specific keyword injection to align colloquial farmer terminology with scientific nomenclature, and answered via dense vector retrieval over a curated corpus of English agricultural manuals (FAO, IRRI). The generated English response is subsequently translated back into Bengali to ensure accessibility. The system is implemented entirely using open-source models and operates on consumer-grade hardware without reliance on paid APIs. Experimental evaluation demonstrates reliable source-grounded responses, robust rejection of out-of-domain queries, and an average end-to-end latency below 20 seconds. The results indicate that cross-lingual retrieval combined with controlled translation offers a practical and scalable solution for agricultural knowledge access in low-resource language settings 5 pages, 3 figures, 1 table

Visit

arxiv.org

Tags

Computation and LanguageArtificial Intelligence

Similaires

Cross-Lingual Retrieval Augmented Prompt for Low-Resource LanguagesKinyaColBERT: A Lexically Grounded Retrieval Model for Low-Resource Retrieval-Augmented GenerationQuery-Augmented vs. Passage-Augmented Cross-Lingual Dense Retrieval on Low-Resource MTrQAParameter-Efficient Tuning vs. Full Fine-Tuning in Cross-Lingual Dense Retrieval for Low-Resource LanguagesCross-Lingual Query Generation Augmentation for Robust Dense Retrieval Against Adversarial Paraphrases in Low-Resource LanguagesQuery Augmentation for Cross-Lingual Dense Retrieval in Low-Resource Languages

Cross-Lingual Retrieval Augmented Prompt for Low-Resource Languages

Multilingual Pretrained Language Models (MPLMs) have shown their strong multilinguality in recent em

KinyaColBERT: A Lexically Grounded Retrieval Model for Low-Resource Retrieval-Augmented Generation

The recent mainstream adoption of large language model (LLM) technology is enabling novel applicatio

Query-Augmented vs. Passage-Augmented Cross-Lingual Dense Retrieval on Low-Resource MTrQA

Effective cross-lingual dense retrieval methods that rely on multilingual pre-trained language model

Parameter-Efficient Tuning vs. Full Fine-Tuning in Cross-Lingual Dense Retrieval for Low-Resource Languages

Effective cross-lingual dense retrieval methods that rely on multilingual pre-trained language model

Cross-Lingual Query Generation Augmentation for Robust Dense Retrieval Against Adversarial Paraphrases in Low-Resource Languages

Effective cross-lingual dense retrieval methods that rely on multilingual pre-trained language model

Query Augmentation for Cross-Lingual Dense Retrieval in Low-Resource Languages

Effective cross-lingual dense retrieval methods that rely on multilingual pre-trained language model