Skip to main content

Tecnologia vocale

Riconoscimento vocale automaticoASR

Detto anche: riconoscimento del parlato

Il riconoscimento vocale automatico (ASR) è la tecnologia che converte il linguaggio parlato in testo. ASR e speech-to-text (STT) sono la stessa capacità — ASR è il termine accademico/ingegneristico, STT quello di prodotto.

La qualità dell'ASR si misura con il word error rate (WER). Per gli agenti vocali, l'ASR in streaming (che trascrive in modo incrementale mentre la persona parla) conta più dell'accuratezza in batch, perché consente turni di parola rapidi.

Vedi Riconoscimento vocale automatico in una chiamata reale.

Prenota una demo di 30 minuti e guarda Finn gestire chiamate in entrata e in uscita end to end — nessuno stack da assemblare.