Logo Lanfrica
  • Accueil
  • Atlas
  • Analyses
  • Documentation
  • Sign in

© 2026 Lanfrica. Tous droits réservés. Tous les droits d'auteur des ressources affichées sur le site Web Lanfrica appartiennent aux détenteurs de droits d'auteur d'origine, sauf indication contraire explicite.

Reconnaissance de Textes Arabes à Vocabulaire Ouvert

Domaine:

natural language processing

Type de record:

papersoftware
Créateur:
KamEnn
Éditeur:
CCSD
Hôte:avatar
Ce papier fait suite aux travaux initiés dans [Kanoun02] portant sur la reconnaissance de textes arabes imprimés. Le prototype proposé ici s'appuie de la même manière sur l'utilisation d'un moteur de vérification morpho-syntaxique de la langue arabe pour filtrer les hypothèses générées à la suite d'une reconnaissance analytique de chaque mot. L'architecture du système proposée dans ce travail consiste à utiliser les outils de vérification linguistique uniquement en phase de post-traitement et permet de traiter l'ensemble du vocabulaire arabe (mots décomposables et non). Ce système est conçu de manière à permettre des interactions avec l'utilisateur en cas d'échec de la reconnaissance pour alimenter les différents lexiques utilisés. Un tel scénario devrait permettre d'envisager un système de reconnaissance à vocabulaire très large et évolutif en ligne. Pour la reconnaissance, un nouvel algorithme de segmentation, des caractéristiques à base de descripteurs de Fourier et un ensemble de graphèmes de base sont introduits. La validation de ce nouveau prototype a été menée sur une nouvelle base de mots.

Visit

archivesic.ccsd.cnrs.fr

Tasks

computer visionoptical character recognition

Tags

Analyse morpho-syntaxiqueSemaine du Document Numérique (SDN 2004). Conférence Internationale Francophone sur l'Ecrit et le Document (CIFED 04). Reconnaissance de textesAnalyse lexicaleAnalyse morpho-syntaxique.[SHS.INFO.INGE]Humanities and Social Sciences/Library and information sciences/domain_shs.info.inge

Licenses

info:eu-repo/semantics/OpenAccess

Similaires

MÉTHODES DE CLUSTERING DES DOCUMENTS TEXTES ARABES : ÉTUDE COMPARATIVELes syntagmes dans la Catégorisation Automatique de Textes ArabesReconnaissance et traduction automatique de la parole de vidéos arabes et dialectalesAraSeg : un segmenteur semi-automatique des textes arabesContribution au développement d'approches de reconnaissance automatique de caractères imprimés et manuscrits, de textes et de documents AmazighesConstruction d'ontologies à partir de textes : la phase de conceptualisation

MÉTHODES DE CLUSTERING DES DOCUMENTS TEXTES ARABES : ÉTUDE COMPARATIVE

International audience La classification automatique des documents textes arabes devi

Les syntagmes dans la Catégorisation Automatique de Textes Arabes

International audience

Reconnaissance et traduction automatique de la parole de vidéos arabes et dialectales

Les travaux de recherche ont été développés dans le cadre du projet AMIS (Access to Multilingual Inf

AraSeg : un segmenteur semi-automatique des textes arabes

International audience Written in Visual Basic and running on Windows, AraSeg is a te

Contribution au développement d'approches de reconnaissance automatique de caractères imprimés et manuscrits, de textes et de documents Amazighes

Cette thèse a pour sujet principalement la reconnaissance automatique hors ligne de l’écriture amazi

Construction d'ontologies à partir de textes : la phase de conceptualisation

Dans cet article nous nous interrogeons sur la manière d'outiller la phase de concept