4. Ressources pour le traitement automatique des textes
Les systèmes de TAL s'appuient sur des ressources de plusieurs types :
les
ressources textuelles
; les données textuelles, appelées
corpus
, sont utilisées pour réaliser des bancs d'essai, pour entraîner les systèmes d'apprentissage, pour extraire des données lexicales, etc. ;
les
ressources lexicales
; les lexiques constituent le cœur des informations linguistiques qu'exploite un système. Ils sont de nature variée selon les applications, et incorporent des informations plus ou moins complexes, depuis de simples listes de mots jusqu'à des ressources sémantiques structurées. En raison du coût engendré par la construction du lexique pour une application donnée, la tendance est à la...
Cet article est réservé aux abonnés
Cet article est réservé aux abonnés. Il vous reste 92 % à découvrir.
Déjà abonné ?
Se connecter
Lecture en cours
Ressources pour le traitement automatique des textes