Logo Lanfrica

Les langues d'Afrique de l'Ouest : de l'imprimante au traitement automatique des langues

Domaine:

natural language processing

Type de record:

paper
Créateur:
Eng
Éditeur:
Lab
Éditeur:
CCSD
Hôte:avatar
22 pages, ISSN 0850-3923 International audience Les langues africaines sont peu présentes sur la toile et leur équipement électronique est insuffisant, tant en ce qui concerne leur facilité d'usage que la production et la mise à disposition de ressources linguistiques. Cette situation peut être en partie expliquée par l'histoire des codages des caractères puisque les caractères spéciaux des langues africaines à base latine étaient absents des premiers codages, ce qui a amené à développer des polices locales. Ces caractères sont maintenant présents dans le standard international Unicode. De nouveaux outils, tels les claviers virtuels, permettent de saisir des textes tout en respectant ce standard international, et donc en bénéficiant de l'usage d'outils informatiques adaptés. Cette évolution permet d'envisager le développement d'outils de Traitement Automatique des Langues Naturelles comme les correcteurs orthographiques, ou encore la synthèse de parole, grâce à la constitution de ressources linguistiques informatisées. Cette progression nécessite une révolution des pratiques des auteurs de textes (institutions, journalistes, écrivains, etc.) que peut favoriser la prise de conscience des bénéfices potentiels. Les chercheurs en informatique linguistique doivent également intégrer ces changements, ce que peut faciliter le travail en réseau et les rencontres virtuelles sur les forum spécialisés. Cet article se conclut par une annexe pratique énonçant les codes des caractères des alphabets de six langues du Sénégal (joola, malinké, pulaar, sereer, soninke, wolof) ainsi que les appuis de touches permettant de les obtenir à l'aide du clavier virtuel AFRO.