RÉSUMÉ
La parole est un moyen privilégié de communication entre un être humain et un système automatique. Cet article présente un état des techniques et des applications en reconnaissance automatique de la parole, domaine recouvrant l'ensemble des méthodes permettant de commander une machine à la voix. Les unités acoustiques (phonèmes, diphones, syllabes) sont représentées à l'aide de modèles de Markov cachés ou de leurs dérivés. Les modèles de langage (syntaxique ou sémantique), quant à eux, se fondent sur des modèles n-grammes mémorisant les probabilités conditionnelles de séquences d'unités linguistiques. Les travaux actuels tendent essentiellement à augmenter la robustesse des systèmes pour leur permettre de fonctionner dans des conditions difficiles (présence de bruit ambiant, locuteurs avec accents, etc.). Les applications actuelles concernent surtout la dictée vocale, la transcription de médias et la télématique vocale.
Lire cet article issu d'une ressource documentaire complète, actualisée et validée par des comités scientifiques.
Lire l'article
INTRODUCTION
L'utilisation de la parole comme mode de communication entre un homme et une machine a été largement étudiée au cours des dernières décennies. Nous nous intéressons dans ce dossier à la
reconnaissance automatique de la parole (RAP)
, c'est-à-dire à l'ensemble des techniques permettant de
communiquer oralement avec une machine
. La RAP présente un intérêt pratique indéniable, dans certaines conditions d'utilisation (accès à distance, charge de travail importante, handicapés, etc.). Des produits commerciaux existent depuis plus de trente ans, d'abord essentiellement pour la reconnaissance de mots isolés et enchaînés puis maintenant pour des phrases prononcées continûment. La plupart sont fondés sur des algorithmes de programmation dynamique et des modèles stochastiques (sources de Markov). Néanmoins, des problèmes restent à résoudre pour accroître la robustesse de ces systèmes et pour étendre leurs capacités de dialogue. Les recherches menées actuellement portent ainsi sur la reconnaissance de parole bruitée, le traitement d'énoncés incomplets ou incorrects, la définition de procédures de dialogue, etc.
Cet article est réservé aux abonnés
Cet article est réservé aux abonnés. Il vous reste 92 % à découvrir.
Déjà abonné ?
Se connecter
MOTS-CLÉS
| RAP
|
|
|
|
| Modéle de Markov
| Modéle n-grammes
VERSIONS
Il existe d'autres versions de cet article :
CET ARTICLE SE TROUVE ÉGALEMENT DANS :
Lecture en cours
Reconnaissance automatique de la parole