Synthèse de la parole à partir du texte

Ajouter à la bibliothèque

H7288 V2 Article de référence

Synthèse de la parole à partir du texte

Auteur(s) : Christophe D'ALESSANDRO, Gaël RICHARD

Date de publication : 10 novembre 2013 | Read in english

Ajouter à la bibliothèque Ajouter à la bibliothèque

Logo Techniques de l'Ingenieur Cet article est réservé aux abonnés
Pour explorer cet article plus en profondeur Consulter un extrait gratuit

Déjà abonné ?

Présentation

RÉSUMÉ

L’objet de cet article est de proposer une vue d’ensemble de la synthèse de la parole à partir du texte (ou TTS, Text-To-Speech en Anglais), le but étant de calculer automatiquement le signal de parole correspondant à un texte donné. Les différentes étapes permettant de réaliser un tel système sont décrites tout en incluant les techniques les plus récentes, dont celles exploitant les modèles de Markov cachés. Les différentes applications de la synthèse vocale ainsi que l’offre des principaux acteurs du domaine sont également discutées.

Lire cet article issu d'une ressource documentaire complète, actualisée et validée par des comités scientifiques.

Lire l'article

AUTEUR(S)

  • Christophe D'ALESSANDRO : Directeur de Recherches LIMSI-CNRS, Orsay, France

  • Gaël RICHARD : Professeur Institut Mines-Télécom, Télécom ParisTech, CNRS-LTCI, Paris, France - Cet article est la réédition actualisée de l'article du même titre, paru en 2003 et rédigé par Gaël Richard et Olivier Cappé

 INTRODUCTION

L'objet de la synthèse de la parole à partir du texte (ou TTS, Text-To-Speech ) est de calculer automatiquement le signal de parole correspondant à un texte donné. Le texte lui-même peut provenir de diverses sources : journaux, livres, systèmes de réponse vocale, de dialogue ou traduction automatique (borne interactive, assistant personnel), base de données d'un système d'information, jeu vidéo, courriers électroniques, SMS, documents butinés sur la toile, ou tout simplement texte saisi au clavier d'un ordinateur.

La réponse vocale sous sa forme la plus simple peut être un ensemble de messages préenregistrés (ou «  prompts  »). L'ambition de la synthèse de la parole à partir du texte est plus grande : il s'agit de calculer automatiquement les échantillons sonores correspondant à un énoncé écrit quelconque, qui n'est pas connu d'avance et qui peut être de grande taille.

Les deux versants de la synthèse de la parole sont d'une part, l'analyse et l'interprétation du texte, d'autre part, la prédiction des paramètres acoustico- phonétiques du son et la synthèse du signal proprement dite :

  • Analyse du texte : la première étape de la transformation d'un texte en parole implique la capacité d'analyser, de comprendre le texte écrit, ses nuances et ses connotations, la situation du discours et l'acte de parole à effectuer. En plus du texte, le contexte peut être spécifié (style de parole, émotion, attitude, type de personnage, voix spécifique...) ;

  • Synthèse du signal  : une fois le texte analysé, il s'agit de calculer le signal acoustique qui interprète au mieux le contenu linguistique, avec une voix aussi naturelle que possible, ressemblant à un locuteur particulier, et avec les nuances d'attitude, voire d'émotion que le texte réclame. En plus du signal audio, le synthétiseur peut fournir des indications pour synchroniser le mouvement des lèvres d'un avatar ou personnage vidéo, ou les mouvements d'un robot.

Cet article est réservé aux abonnés
Logo Techniques de l'Ingenieur

Cet article est réservé aux abonnés. Il vous reste 92 % à découvrir.

Cet article est réservé aux abonnés Consulter un extrait gratuit

Déjà abonné ?


MOTS-CLÉS

Traitement du signal   |   linguistique

VERSIONS

Il existe d'autres versions de cet article :

DOI (DIGITAL OBJECT IDENTIFIER)

https://doi.org/10.51257/a-v2-h7288

Lecture en cours
Synthèse de la parole à partir du texte

Article inclus dans l'offre

"Documents numériques Gestion de contenu"

( 114 articles )

Une base complète d’articles

Actualisée et enrichie d’articles validés par nos comités scientifiques.

Services

Quiz, médias, tableaux, formules, vidéos, etc.

Des modules pratiques

Opérationnels et didactiques, pour garantir l'acquisition des compétences transverses.

Des avantages inclus

Un ensemble de services exclusifs en complément des ressources.

Voir le détail de l'offre

Dans les ressources documentaires

Modèles de Markov cachés pour l’étiquetage de séquences

Les modèles markoviens cachés sont un outil essentiel pour le traitement, l’exploration, la classificatio...

Reconnaissance en-ligne d'écriture manuscrite

Dans cet article, est exposé un panorama de la recherche sur la reconnaissance de l'écriture manuscrite, ...

Traitement automatique des textes - Techniques linguistiques

Cet article est consacré à la présentation des techniques de traitement automatique des textes qui sont u...

Transformer : des réseaux de neurones pour le traitement automatique des langues

Cet article présente un survol de l'état de l'art en traitement automatique des langues, en explorant une...

WhitePaper
4 janvier 2023
Introduction à l’intelligence artificielle

l\'IA s\'emploie à résoudre les problématiques qui relèvent de diverses activités humaines (perception, prise de décision, planification, diagnostic, interpréta...

Tous les livres blancs
Article Vers un nouveau record des cyberattaques ?
25 septembre 2019
Vers un nouveau record des cyberattaques ?

Année après année, c’est toujours le même constat : peu ou mal protégées, les entreprises et les administrations sont de plus en plus nombreuses à être victimes...

Toutes les actualités

Inscrivez-vous aux newsletters !

Contactez-nous