Skip to main content

Sprachtechnologie

Speech-to-TextSTT

Auch genannt: Automatic Speech Recognition · ASR · Spracherkennung

Speech-to-Text (STT), auch Automatic Speech Recognition (ASR) genannt, transkribiert gesprochenes Audio in Text. In einem Sprachagenten ist STT der erste Schritt — es wandelt die Sprache des Anrufers während des Sprechens in Text um, mit dem das Sprachmodell arbeiten kann.

Echtzeit-STT muss Akzente, Hintergrundgeräusche, Übersprechen und Code-Switching zwischen Sprachen bewältigen. Seine Genauigkeit und Geschwindigkeit setzen die Obergrenze für das gesamte Gespräch: Verhört sich der Agent, ist alles Nachfolgende falsch.

Im Produkt ansehen

Sehen Sie Speech-to-Text in einem echten Anruf.

Buchen Sie eine 30-minütige Demo und sehen Sie, wie Finn eingehende und ausgehende Anrufe durchgehend bearbeitet — ohne Stack zusammenzustellen.