Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

Reconnaissance de Textes Arabes à Vocabulaire Ouvert

Domain:

natural language processing

Record type:

papersoftware
Creator:
KamEnn
Publisher:
CCSD
Host:avatar
Ce papier fait suite aux travaux initiés dans [Kanoun02] portant sur la reconnaissance de textes arabes imprimés. Le prototype proposé ici s'appuie de la même manière sur l'utilisation d'un moteur de vérification morpho-syntaxique de la langue arabe pour filtrer les hypothèses générées à la suite d'une reconnaissance analytique de chaque mot. L'architecture du système proposée dans ce travail consiste à utiliser les outils de vérification linguistique uniquement en phase de post-traitement et permet de traiter l'ensemble du vocabulaire arabe (mots décomposables et non). Ce système est conçu de manière à permettre des interactions avec l'utilisateur en cas d'échec de la reconnaissance pour alimenter les différents lexiques utilisés. Un tel scénario devrait permettre d'envisager un système de reconnaissance à vocabulaire très large et évolutif en ligne. Pour la reconnaissance, un nouvel algorithme de segmentation, des caractéristiques à base de descripteurs de Fourier et un ensemble de graphèmes de base sont introduits. La validation de ce nouveau prototype a été menée sur une nouvelle base de mots.

Visit

archivesic.ccsd.cnrs.fr

Tasks

computer visionoptical character recognition

Tags

Analyse morpho-syntaxiqueSemaine du Document Numérique (SDN 2004). Conférence Internationale Francophone sur l'Ecrit et le Document (CIFED 04). Reconnaissance de textesAnalyse lexicaleAnalyse morpho-syntaxique.[SHS.INFO.INGE]Humanities and Social Sciences/Library and information sciences/domain_shs.info.inge

Licenses

info:eu-repo/semantics/OpenAccess

Similar

MÉTHODES DE CLUSTERING DES DOCUMENTS TEXTES ARABES : ÉTUDE COMPARATIVELes syntagmes dans la Catégorisation Automatique de Textes ArabesReconnaissance et traduction automatique de la parole de vidéos arabes et dialectalesAraSeg : un segmenteur semi-automatique des textes arabesContribution au développement d'approches de reconnaissance automatique de caractères imprimés et manuscrits, de textes et de documents AmazighesConstruction d'ontologies à partir de textes : la phase de conceptualisation

MÉTHODES DE CLUSTERING DES DOCUMENTS TEXTES ARABES : ÉTUDE COMPARATIVE

International audience La classification automatique des documents textes arabes devi

Les syntagmes dans la Catégorisation Automatique de Textes Arabes

International audience

Reconnaissance et traduction automatique de la parole de vidéos arabes et dialectales

Les travaux de recherche ont été développés dans le cadre du projet AMIS (Access to Multilingual Inf

AraSeg : un segmenteur semi-automatique des textes arabes

International audience Written in Visual Basic and running on Windows, AraSeg is a te

Contribution au développement d'approches de reconnaissance automatique de caractères imprimés et manuscrits, de textes et de documents Amazighes

Cette thèse a pour sujet principalement la reconnaissance automatique hors ligne de l’écriture amazi

Construction d'ontologies à partir de textes : la phase de conceptualisation

Dans cet article nous nous interrogeons sur la manière d'outiller la phase de concept