Logo Lanfrica

Constitution de Corpus d'Apprentissage et étiquetage simple sur des blogues interculturels

Domaine:

natural language processingeducation

Type de record:

paperdataset
Créateur:
LauCha
Éditeur:
Lab
Éditeur:
CCSD
Hôte:avatar
Ce document est une réponse pour l'appel à contributions dans le cadre de l'atelier : "Traitement Automatique des Langues et EIAH : objets de recherche et objets d'étude". Thème 5 du GDR I3. Au cours de nos travaux de recherche en EIAH (Environnements informatiques pour l'apprentissage humain), nous avons besoin d'analyser des formations en ligne afin de répondre à plusieurs questions : la formation a-t-elle été efficace, les apprenants ont-ils interagi et comment l'ont-ils fait ? Pour ce faire, nous recueillons les traces des interactions, l'ensemble des ressources et les métadonnées associées à une formation donnée. Ensuite, nous les organisons, de façon systématique au sein de structures appelées corpus d'apprentissage ou LETEC (LEarning and TEaching Corpus). Ces LETEC sont stockés dans la banque de corpus en ligne Mulce (MUltimodal contextualized Learner Corpus Exchange). Nous souhaitons mettre en évidence l'importance de cette structuration et les possibilités d'analyses qui en découlent notamment en utilisant des stratégies de TAL (Traitement Automatique du Langage). Nous prenons ici l'exemple d'un étiquetage automatique simple des messages issus des blogues de la formation Infral qui est le sujet d'un des LETEC de la banque de corpus Mulce.

Similaires