Sintesi vocale
Tecnologia che trasforma il testo scritto in audio parlato, ora abbastanza buono da essere difficile da distinguere da una registrazione.
La sintesi vocale, spesso abbreviata in TTS, è l’immagine speculare della sintesi vocale: parole in ingresso, audio in uscita. Esiste da decenni in forma robotica piatta ed è lo strato sottostante ai lettori di schermo, alle indicazioni del navigatore satellitare e alle versioni audio degli articoli. Ciò che è cambiato recentemente è la qualità. I sistemi moderni gestiscono le pause, l’enfasi e le emozioni abbastanza bene che un breve clip è davvero difficile da distinguere da una persona che legge ad alta voce.
Questo miglioramento ha spostato TTS da una funzionalità di accessibilità a un formato di pubblicazione. Le piattaforme ora generano automaticamente versioni parlate di contenuti scritti e audiolibri, podcast e narrazioni video iniziano sempre più spesso come testo. La stessa qualità che lo rende utile rende anche la clonazione della voce un vero problema, motivo per cui i prodotti responsabili etichettano chiaramente la narrazione sintetica.