Spraaktechnologie
Automatic speech recognitionASR
Ook wel genoemd: spraakherkenning
Automatic speech recognition (ASR) is de technologie die gesproken taal omzet in tekst. ASR en speech-to-text (STT) zijn dezelfde functionaliteit — ASR is de academische/technische term, STT de productterm.
De kwaliteit van ASR wordt gemeten met word error rate (WER). Voor voice-agents is streaming ASR (incrementeel transcriberen terwijl de persoon praat) belangrijker dan batchnauwkeurigheid, omdat het snel beurtwisselen mogelijk maakt.
Gerelateerde termen
Speech-to-textTechnologie die gesproken audio in realtime omzet in tekst. Via STT begrijpt een voice-agent wat de beller zegt.Natural language understandingHet deel van AI dat uitzoekt wat een persoon bedoelt — de intentie en de belangrijkste details — op basis van natuurlijke taal, niet alleen de letterlijke woorden.EndpointingDetecteren wanneer de beller is uitgesproken, zodat de agent weet dat het zijn beurt is om te reageren. Slechte endpointing veroorzaakt ongemakkelijke pauzes of onderbrekingen.
Zie Automatic speech recognition in een echt gesprek.
Plan een demo van 30 minuten en zie Finn inbound- en outbound-gesprekken van begin tot eind afhandelen — geen stack om samen te stellen.
Try Finn for free