Lorsque l'on s'intéresse au traitement automatique des données en langue naturelle (écrites ou orales), une des problématiques principales consiste à transposer des modèles linguistiques en code informatique. Nous verrons dans ce cours comment l'on peut implanter des modèles phonétiques et syntaxiques en langage Python. Ce cours fera appel aux notions de Logique et de Codage des données textuelles enseignées en Epistémologie de l'informatique. Nous étudierons les modèles phonétiques et syntaxiques sous-jacents aux aux principales applications de Traitement des Langues. Parmi les applications traités figurera l'Extraction d'Information qui vise à partir d'énoncés en langue naturelle à extraire une représentation structurée sous forme de base de connaissances.
Nous aborderons par ce biais l'interface syntaxe/sémantique afin de préparer les étudiants au semestre suivant de programmation.
Bibliographie :
Mohamed Zakaria KURDI, Traitement automatique des langues et linguistique informatique 1, ISTE 2017
- Enseignant.e: Gael Lejeune
- Enseignant.e: François Olivier