Tecnologia de fala
Reconhecimento automático de falaASR
Também chamado de: reconhecimento de fala
Reconhecimento automático de fala (ASR) é a tecnologia que converte linguagem falada em texto. ASR e speech-to-text (STT) são a mesma capacidade — ASR é o termo acadêmico/de engenharia, e STT é o termo de produto.
A qualidade do ASR é medida pela taxa de erro de palavras (WER). Para agentes de voz, o ASR em streaming (transcrevendo de forma incremental à medida que a pessoa fala) importa mais do que a precisão em lote, porque permite uma troca de turnos rápida.
Termos relacionados
Speech-to-textTecnologia que transcreve áudio falado em texto em tempo real. O STT é como um agente de voz entende o que quem liga está dizendo.Compreensão de linguagem naturalA parte da IA que descobre o que uma pessoa quer dizer — sua intenção e os detalhes principais — a partir da linguagem natural, e não apenas das palavras literais.EndpointingDetectar quando quem liga terminou de falar para que o agente saiba que é a vez dele de responder. Um endpointing ruim causa pausas ou interrupções constrangedoras.
Veja Reconhecimento automático de fala em uma ligação real.
Agende uma demonstração de 30 minutos e veja o Finn conduzir ligações de entrada e de saída de ponta a ponta — sem nenhuma stack para montar.
Try Finn for free