Speech-to-Text
Also called: ASR, automatic speech recognition
Turning spoken audio into written text.
La reconnaissance vocale moderne est assez précise, sur la plupart des accents et dans des conditions bruyantes, pour être utilisée sans supervision sur des brouillons. Elle sous-tend les comptes rendus de réunion, les sous-titres et les interfaces vocales. La précision baisse encore sur le jargon métier, les locuteurs qui se chevauchent et les langues sous-représentées.
En pratique : Un appel d’une heure transcrit et résumé avant même que vous n’ayez quitté la salle.