Generative AI & LLMs beginner

Speech-to-Text

Also called: ASR, automatic speech recognition

Turning spoken audio into written text.

O speech-to-text moderno é preciso o bastante na maioria dos sotaques e em condições ruidosas para ser usado sem supervisão em rascunhos. Ele sustenta atas de reunião, legendas e interfaces de voz. A acurácia ainda cai com jargão de domínio, falas sobrepostas e idiomas pouco representados.

Na prática: Uma ligação de uma hora transcrita e resumida antes de você sair da sala.

Where this comes up