Tecnologia de fala
Speech-to-textSTT
Também chamado de: reconhecimento automático de fala · ASR · reconhecimento de voz
Speech-to-text (STT), também chamado de reconhecimento automático de fala (ASR), transcreve áudio falado em texto. Em um agente de voz, o STT é a primeira etapa — ele transforma a fala de quem liga em texto sobre o qual o modelo de linguagem pode agir, à medida que a pessoa fala.
O STT em tempo real precisa lidar com sotaques, ruído de fundo, sobreposição de vozes e alternância entre idiomas. Sua precisão e velocidade definem o teto de toda a conversa: se o agente entende errado, tudo o que vem depois fica errado.
Veja no produto
Termos relacionados
Veja Speech-to-text em uma ligação real.
Agende uma demonstração de 30 minutos e veja o Finn conduzir ligações de entrada e de saída de ponta a ponta — sem nenhuma stack para montar.