Enfin lorsque l’on évoque le terme IA et plus particulièrement le mot robot ils nous vient instantanément en tête l’idée que celui ci doit être constitué d’une certaine forme d’intelligence lui permettant de comprendre ce que lui demande un humain et d’agir ou de répondre par la suite. C’est pour cela qu’il doit être  capable de communiquer avec son interlocuteur en ayant une voix la plus proche de celle de l’homme,ainsi une nouvelle synthèse vocale (bien plus performante que la méthode de  concaténation d’extraits sonores préenregistrés ou  l’utilisation d’un vocodeur afin de synthétiser une voix entièrement artificielle) a été créé par GOOGLE.Là encore la méthode utilisé est le deep learning  en effet on fournit à l’algorithme une base de données contenant des spectres sonores dont les motifs et les  intonations typiques de certaines langues sont pris en compte,il va par la suite analyser ces spectres  sonores (phase d’entraînement)puis les décortiquer avant de  les reproduire  échantillon par échantillon.Ceci est une véritable prouesse car plus de 16000 échantillons peuvent être distingués dans la voix humaine.Après cela il suffira de fournir du texte à la machine ou plutôt que la machine soit capable d’exprimer ces idées dans un langage naturelle.

Bonus:

Voici trois extraits sonores issues de synthèses vocales différentes,avec une voix presque humaine pour la synthèse vocale utilisant le deep learning:

La synthèse vocale utilisant la concaténation d’extraits préenregistrés

La synthèse vocale utilisant un vocodeur pour synthétiser une voix

La synthèse vocale utilisant le deep learning 

Concevoir un site comme celui-ci avec WordPress.com
Commencer