Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Concrete400: A Multi-Task Pixel-Level Crack Dataset from Urban Infrastructure in Vietnam

Type de record:

dataset
Créateur:
Le,NguVu,Ngu
Éditeur:
Zenodo
Hôte:avatar

Concrete400 is a multi-task image dataset developed for automated visual inspection of concrete infrastructure. The dataset includes 379 full-size crack images with manually prepared pixel-level binary crack masks and crack-region bounding-box annotations prepared using Adobe Photoshop. It also includes 1,502 image patches for binary crack classification, comprising 633 crack patches and 869 no-crack patches.

The release is organised into three task-oriented components:

  • Segmentation: 379 RGB images and 379 corresponding binary crack masks, all at 512 × 512 pixels.
  • Classification: 1,502 image patches, comprising 633 crack patches and 869 no-crack patches.
  • Object detection: 379 text files containing crack-region bounding-box annotations aligned with the released RGB images.

The segmentation images, masks, and object-detection coordinates are standardised to a common resolution of 512 × 512 pixels. The recommended reference partition contains 303 training pairs (image_001–image_303) and 76 validation pairs (image_304–image_379). Under this rule, crack pixels account for 3.07% of image pixels on average, with a median of 2.51% and a range of 0.40%–15.01%.

The photographs preserve realistic variations in illumination, shadows, concrete texture, surface condition, background clutter, and acquisition time. These field conditions, together with the sparse and irregular geometry of cracks, make the dataset suitable for evaluating robust computer-vision methods under realistic class imbalance.

Concrete400 can be reused for crack classification, semantic segmentation, instance segmentation, object detection, weakly supervised and semi-supervised learning, self-supervised representation learning, and crack-image generation. The dataset is intended for research in structural health monitoring, infrastructure inspection, civil engineering, and computer vision.

Visit

doi.org

Tasks

computer visionimage classification

Languages

Ndasa

Licenses

info:eu-repo/semantics/openAccessCreative Commons Attribution 4.0 Internationalhttps://creativecommons.org/licenses/by/4.0/legalcode

Similaires

Amharic Multi-Task NLP DatasetConcrete & Pavement Crack DatasetMulti-Task Sequence Prediction For Tunisian Arabizi Multi-Level AnnotationAlgerian Texts Dataset for Multi-task LearningMULTI3NLU++: A Multilingual, Multi-Intent, Multi-Domain Dataset for Natural Language Understanding in Task-Oriented Dialoguemohammadanwarx/Multi-Modal-Deep-Learning-and-EOFMs-for-Pixel-Level-Forest-Loss-Detection-in-Sudan

Amharic Multi-Task NLP Dataset

Concrete & Pavement Crack Dataset

Title: Crack Detection in Concrete and Pavement using Convolutional Neural Networks Summary: This d

Multi-Task Sequence Prediction For Tunisian Arabizi Multi-Level Annotation

In this paper we propose a multi-task sequence prediction system, based on recurrent neural networks

Algerian Texts Dataset for Multi-task Learning

Dataset evaluating multi-task learning for code-switched Algerian texts.

MULTI3NLU++: A Multilingual, Multi-Intent, Multi-Domain Dataset for Natural Language Understanding in Task-Oriented Dialogue

Task-oriented dialogue (TOD) systems have been widely deployed in many industries as they deliver mo

mohammadanwarx/Multi-Modal-Deep-Learning-and-EOFMs-for-Pixel-Level-Forest-Loss-Detection-in-Sudan

# Multi-Modal Deep Learning and EOFMs for Pixel-Level Forest Loss Detection in Sudan Benchmarking m