CourionAI
FR
Newsletter
← Glossaire Terme

Synthèse vocale

Une technologie qui transforme le texte écrit en audio parlé, désormais suffisamment performante pour être difficile à distinguer d'un enregistrement.

La synthèse vocale, souvent abrégée en TTS, est l’image miroir de la synthèse vocale : mots entrants, sortie audio. Il existe depuis des décennies sous forme robotique plate et constitue la couche située sous les lecteurs d’écran, les instructions de navigation par satellite et les versions audio des articles. Ce qui a changé récemment, c’est la qualité. Les systèmes modernes gèrent suffisamment bien les pauses, l’emphase et les émotions pour qu’un court clip soit véritablement difficile à distinguer d’une personne lisant à haute voix.

Cette amélioration a fait passer TTS d’une fonctionnalité d’accessibilité à un format de publication. Les plateformes génèrent désormais automatiquement des versions parlées du contenu écrit, et les livres audio, les podcasts et les narrations vidéo commencent de plus en plus sous forme de texte. La même qualité qui le rend utile fait également du clonage vocal un réel problème, c’est pourquoi les produits responsables étiquetent clairement la narration synthétique.