Definizione
Speech-to-Text (STT)
Lo Speech-to-Text (STT), o riconoscimento vocale, è una tecnologia che converte automaticamente il linguaggio parlato di un segnale audio in testo scritto.
I modelli STT moderni sono multilingue e resistenti a dialetti e rumore di fondo. Costituiscono lo stadio d'ingresso dei voicebot e permettono la trascrizione di riunioni; per lo svizzero tedesco la precisione resta limitata secondo il modello.