Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

VIPaint: Image Inpainting with Pre-Trained Diffusion Models via Variational Inference

Type de record:

paper
Créateur:
AgaHopHeoSud
Hôte:avatar
Diffusion probabilistic models learn to remove noise added during training, generating novel data (e.g., images) from Gaussian noise through sequential denoising. However, conditioning the generative process on corrupted or masked images is challenging. While various methods have been proposed for inpainting masked images with diffusion priors, they often fail to produce samples from the true conditional distribution, especially for large masked regions. Many baselines also cannot be applied to latent diffusion models which generate high-quality images with much lower computational cost. We propose a hierarchical variational inference algorithm that optimizes a non-Gaussian Markov approximation of the true diffusion posterior. Our VIPaint method outperforms existing approaches to inpainting, producing diverse high-quality imputations even for state-of-the-art text-conditioned latent diffusion models, and is also effective for other inverse problems like deblurring and superresolution. Proceedings of the 29th International Conference on Artificial Intelligence and Statistics (AISTATS), May 2026, Tangier, Morocco. PMLR Volume 300

Visit

arxiv.org

Tasks

computer vision

Languages

Arabic, Moroccan Spoken

Tags

Computer Vision and Pattern RecognitionArtificial IntelligenceMachine Learning

Similaires

Adapting Pre-trained Language Models to African Languages via Multilingual Adaptive Fine-TuningInvestigating Massive Multilingual Pre-Trained Machine Translation Models for Clinical Domain via Transfer LearningPre-trained models: Galician, Iban, SetswanaArabic Extractive Summarization Using Pre-Trained ModelsMorphosyntactic Tagging with Pre-trained Language Models for Arabic and its DialectsCLIPTrans: Transferring Visual Knowledge with Pre-trained Models for Multimodal Machine Translation

Adapting Pre-trained Language Models to African Languages via Multilingual Adaptive Fine-Tuning

Multilingual pre-trained language models (PLMs) have demonstrated impressive performance on several downstream tasks for both high-resourced and low-resourced languages. However, there is still a large performance drop for languages unseen during pre-training, espe

Investigating Massive Multilingual Pre-Trained Machine Translation Models for Clinical Domain via Transfer Learning

Massively multilingual pre-trained language models (MMPLMs) are developed in recent years demonstrat

Pre-trained models: Galician, Iban, Setswana

wav2vec 2.0 XLSR-128 models (with and without adaptation via continued pre-training)

Arabic Extractive Summarization Using Pre-Trained Models

Automatic Text Summarization (ATS) is a crucial area of study in Natural Language Processing (NLP) d

Morphosyntactic Tagging with Pre-trained Language Models for Arabic and its Dialects

We present state-of-the-art results on morphosyntactic tagging across different varieties of Arabic

CLIPTrans: Transferring Visual Knowledge with Pre-trained Models for Multimodal Machine Translation

There has been a growing interest in developing multimodal machine translation (MMT) systems that en