3. Techniques
Une panoplie de traitements est mise en œuvre sur les textes au cours de leur exploitation. Délimiter les mots du texte, leur attribuer une étiquette linguistique, identifier les relations syntaxiques qui s’établissent entre eux constituent des traitements préalables à l’exploitation des données dans les applications que nous venons de décrire. La chaîne de traitement standard (figure
6
) transforme le texte brut en une liste de mots présentés ligne par ligne (texte segmenté et verticalisé), auxquels on associe dans un second temps des indications de catégorie lexicale (texte catégorisé). La phase finale d’identification des relations syntaxiques (texte analysé) se limite la plupart du temps à un simple parenthésage de groupes de mots
Cet article est réservé aux abonnés
Cet article est réservé aux abonnés. Il vous reste 92 % à découvrir.
Déjà abonné ?
Se connecter
Lecture en cours
Techniques