Generative AI & LLMs beginner

Speech-to-Text

Also called: ASR, automatic speech recognition

Turning spoken audio into written text.

La conversión de voz a texto actual es lo bastante precisa en la mayoría de los acentos y en condiciones ruidosas como para usarse sin supervisión en borradores. Sostiene las notas de reuniones, los subtítulos y las interfaces por voz. La precisión todavía cae con la jerga de un dominio, los hablantes superpuestos y los idiomas poco representados.

En la práctica: Una llamada de una hora transcrita y resumida antes de que salgas de la sala.

Where this comes up