3. Modèles de documents
Nous avons vu dans le paragraphe précédent l’extrême complexité d’un système de reconnaissance de documents. La plupart des traitements nécessitent pour leur bon fonctionnement un apport d’informations contextuelles, dépendantes du type du document analysé. Ces informations sont fournies par ce que nous convenons d’appeler globalement les
modèles de documents
.
En réalité, plusieurs étapes de la reconnaissance nécessitent ce genre de connaissances : un logiciel de reconnaissance de caractères utilisera par exemple une base de données de spécimens (caractères de référence) ou des dictionnaires linguistiques ; la reconnaissance de fontes aura besoin d’une base de connaissance des caractéristiques des fontes considérées et la segmentation utilisera des valeurs de seuils adaptées à la taille d’écriture.
...
Cet article est réservé aux abonnés
Cet article est réservé aux abonnés. Il vous reste 92 % à découvrir.
Déjà abonné ?
Se connecter
Lecture en cours
Modèles de documents