Le traitement automatique du langage (TAL), ou Natural Language Processing (NLP), désigne l’ensemble des méthodes informatiques et statistiques permettant à une machine d’analyser, de comprendre, de produire ou de transformer le langage humain sous sa forme écrite ou orale. Situé au croisement de la linguistique, de l’informatique et de l’apprentissage automatique, il vise à convertir des données textuelles non structurées — par nature ambiguës, contextuelles et variables — en représentations exploitables par le calcul.
Les tâches usuelles du traitement automatique du langage se répartissent selon l’opération effectuée sur le texte : catégoriser (classification thématique, analyse de sentiment), extraire de l’information (reconnaissance d’entités nommées, codification automatique de réponses ouvertes ou de professions), rechercher et apparier (similarité sémantique, rapprochement d’enregistrements).
Traitement automatique du langage
Publications
Gendered Teacher Feedback, Students’ Math Performance and Enrollment Outcomes : A Text Mining Approach
À niveau égal, appréciation égale ? Comment les appréciations scolaires varient en fonction du sexe des élèves