Skip to main content

Sprachtechnologie

Automatic Speech RecognitionASR

Auch genannt: Spracherkennung

Automatic Speech Recognition (ASR) ist die Technologie, die gesprochene Sprache in Text umwandelt. ASR und Speech-to-Text (STT) sind dieselbe Fähigkeit — ASR ist der wissenschaftliche/technische Begriff, STT der Produktbegriff.

Die ASR-Qualität wird anhand der Word Error Rate (WER) gemessen. Für Sprachagenten ist Streaming-ASR (schrittweises Transkribieren während des Sprechens) wichtiger als Batch-Genauigkeit, weil es schnelles Turn-Taking ermöglicht.

Sehen Sie Automatic Speech Recognition in einem echten Anruf.

Buchen Sie eine 30-minütige Demo und sehen Sie, wie Finn eingehende und ausgehende Anrufe durchgehend bearbeitet — ohne Stack zusammenzustellen.