Logo Lanfrica
  • Home
  • Atlas
  • Insights
  • Docs
  • Sign in

© 2026 Lanfrica. All rights reserved. All copyrights of the resources shown on the Lanfrica website belong to the original copyright holders, unless explicitly stated otherwise.

Phonotactique prédictive et alignement automatique : Application au corpus MARSEC et perspectives

Domain:

natural language processing

Record type:

paperdatasetsoftware
Creator:
AurBou
Editor:
Lab
Publisher:
CCSDLab
Host:avatar
Autorisation No.2102 :
TIPA est la revue du Laboratoire Parole et Langage This paper presents the methodology used during the generation of Aix-MARSEC, a multi-level aligned corpus (phonemes, sub-syllabic components, syllables, words, stress feet and intonation units). After defining the concepts of alignment and granularity, the main part of this paper details the three phases leading to the aligned phonetic transcription of the corpus : raw dictionary-based grapheme-tophoneme conversion, optimisation by phoneme elision rules and automatic forced Viterbi alignment of the optimised transcription. After the evaluation of both the optimised transcription and the final alignment, perspectives of improvement of these two components are suggested. Cet article présente la méthodologie employée lors de la constitution du corpus aligné (phonèmes, constituants syllabiques, syllabes, mots, pieds accentuels et unités intonatives) Aix-MARSEC. Après avoir défini les concepts d'alignement et de granularité, cet article détaille, dans sa partie centrale, les trois phases menant à la transcription phonétique alignée du corpus : phonétisation automatique brute par dictionnaire, optimisation par règles d'élision et alignement automatique par "force Viterbi" de la transcription optimisée. Après évaluation de la phonétisation optimisée et de l'alignement final, des perspectives d'amélioration de ces deux composantes sont proposées.

Visit

hal.science

Tags

grapheme-to-phoneme conversionelision-prediction rulesphonotactic constraintsalignmentcorpusalignementcontraintes phonotactiquesrègles d'élisionphonétisation[SHS.LANGUE]Humanities and Social Sciences/Linguistics

Licenses

info:eu-repo/semantics/OpenAccess

Similar

la reconnaissance automatique des caractères : application au tifinagh et aux chiffres arabesLa phraséologie au prisme du corpus ESLO : variations sociolinguistiques et apports du traitement automatique du langageTraduction Et Diversite Socio-Linguistique Au Nigeria: Strategies Et PerspectivesConstruction et évaluation pour la TA d'un corpus journalistique bilingue : application au français-somaliCartographie des systèmes agraires au nord et au centre du Bénin par télédétection spatiale et apprentissage automatiqueL'Intelligence Artificielle au Service de l'Éducation au Maroc : Opportunités, Défis et Perspectives

la reconnaissance automatique des caractères : application au tifinagh et aux chiffres arabes

La reconnaissance automatique des caractères est un traitement informatique qui a pour but de tradui

La phraséologie au prisme du corpus ESLO : variations sociolinguistiques et apports du traitement automatique du langage

International audience

Traduction Et Diversite Socio-Linguistique Au Nigeria: Strategies Et Perspectives

Abstract

Construction et évaluation pour la TA d'un corpus journalistique bilingue : application au français-somali

Dans le cadre des travaux en cours pour informatiser un grand nombre de langues « peu dotées », en p

Cartographie des systèmes agraires au nord et au centre du Bénin par télédétection spatiale et apprentissage automatique

Source Agritrop Cirad (https://agritrop.cirad.fr/615836/) * Autres projet

L'Intelligence Artificielle au Service de l'Éducation au Maroc : Opportunités, Défis et Perspectives

Résumé L'article se penche sur l'impact de l'intelligence artificielle (IA) sur le secteur éducati