Sprachtechnologie
Speech-to-TextSTT
Auch genannt: Automatic Speech Recognition · ASR · Spracherkennung
Speech-to-Text (STT), auch Automatic Speech Recognition (ASR) genannt, transkribiert gesprochenes Audio in Text. In einem Sprachagenten ist STT der erste Schritt — es wandelt die Sprache des Anrufers während des Sprechens in Text um, mit dem das Sprachmodell arbeiten kann.
Echtzeit-STT muss Akzente, Hintergrundgeräusche, Übersprechen und Code-Switching zwischen Sprachen bewältigen. Seine Genauigkeit und Geschwindigkeit setzen die Obergrenze für das gesamte Gespräch: Verhört sich der Agent, ist alles Nachfolgende falsch.
Im Produkt ansehen
Verwandte Begriffe
Sehen Sie Speech-to-Text in einem echten Anruf.
Buchen Sie eine 30-minütige Demo und sehen Sie, wie Finn eingehende und ausgehende Anrufe durchgehend bearbeitet — ohne Stack zusammenzustellen.