Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

mEdIT: Multilingual Text Editing via Instruction Tuning

Domaine:

natural language processing

Type de record:

papermodeldataset
Créateur:
RahAliKulAlh
Hôte:avatar
We introduce mEdIT, a multi-lingual extension to CoEdIT -- the recent state-of-the-art text editing models for writing assistance. mEdIT models are trained by fine-tuning multi-lingual large, pre-trained language models (LLMs) via instruction tuning. They are designed to take instructions from the user specifying the attributes of the desired text in the form of natural language instructions, such as Grammatik korrigieren (German) or Parafrasee la oración (Spanish). We build mEdIT by curating data from multiple publicly available human-annotated text editing datasets for three text editing tasks (Grammatical Error Correction (GEC), Text Simplification, and Paraphrasing) across diverse languages belonging to six different language families. We detail the design and training of mEdIT models and demonstrate their strong performance on many multi-lingual text editing benchmarks against other multilingual LLMs. We also find that mEdIT generalizes effectively to new languages over multilingual baselines. We publicly release our data, code, and trained models at github.com. Accepted to NAACL 2024 (Main). 23 pages, 8 tables, 11 figures

Visit

arxiv.org

Tasks

grammar error correctionnatural language generation

Tags

Computation and LanguageArtificial IntelligenceI.2.7

Similaires

Dialogue Pidgin Text Adaptation via Contrastive Fine-TuningAya Dataset: An Open-Access Collection for Multilingual Instruction TuningMulti-Task Instruction Tuning via Data Scheduling for Low-Resource Arabic AudioLLMsInstructAlign: High-and-Low Resource Language Alignment via Continual Crosslingual Instruction TuningDN at SemEval-2023 Task 12: Low-Resource Language Text Classification via Multilingual Pretrained Language Model Fine-tuningMURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions

Dialogue Pidgin Text Adaptation via Contrastive Fine-Tuning

The surging demand for multilingual dialogue systems often requires a costly labeling process for each language addition. For low resource languages, human annotators are continuously tasked with the adaptation of resource-rich language utterances for each new doma

Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning

Datasets are foundational to many breakthroughs in modern artificial intelligence. Many recent achievements in the space of natural language processing (NLP) can be attributed to the finetuning of pre-trained models on a diverse set of tasks that enables a large la

Multi-Task Instruction Tuning via Data Scheduling for Low-Resource Arabic AudioLLMs

Audio large language models (LLMs) enable unified speech understanding and generation, but adapting

InstructAlign: High-and-Low Resource Language Alignment via Continual Crosslingual Instruction Tuning

Large language models (LLMs) that are tuned with instructions have demonstrated remarkable capabilit

DN at SemEval-2023 Task 12: Low-Resource Language Text Classification via Multilingual Pretrained Language Model Fine-tuning

In recent years, sentiment analysis has gained significant importance in natural language processing

MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions

Instruction tuning enhances large language models (LLMs) by aligning them with human preferences acr