Skip to main content

Tecnologia de fala

Speech-to-textSTT

Também chamado de: reconhecimento automático de fala · ASR · reconhecimento de voz

Speech-to-text (STT), também chamado de reconhecimento automático de fala (ASR), transcreve áudio falado em texto. Em um agente de voz, o STT é a primeira etapa — ele transforma a fala de quem liga em texto sobre o qual o modelo de linguagem pode agir, à medida que a pessoa fala.

O STT em tempo real precisa lidar com sotaques, ruído de fundo, sobreposição de vozes e alternância entre idiomas. Sua precisão e velocidade definem o teto de toda a conversa: se o agente entende errado, tudo o que vem depois fica errado.

Veja no produto

Veja Speech-to-text em uma ligação real.

Agende uma demonstração de 30 minutos e veja o Finn conduzir ligações de entrada e de saída de ponta a ponta — sem nenhuma stack para montar.