Generative AI & LLMs beginner

Speech-to-Text

Also called: ASR, automatic speech recognition

Turning spoken audio into written text.

Lo speech-to-text moderno è abbastanza accurato sulla maggior parte degli accenti e in condizioni rumorose da poter essere usato senza supervisione per le bozze. Sta alla base di note di riunione, sottotitoli e interfacce vocali. L’accuratezza cala ancora sul gergo di settore, sui parlanti sovrapposti e sulle lingue poco rappresentate.

In pratica: Una call di un’ora trascritta e riassunta prima che tu esca dalla stanza.

Where this comes up