Skip to main content
Inteligência de voz

Voz que pensa.Na velocidade de uma batida do coração.

Latência abaixo de um segundo. 47 idiomas. Chamada de funções, RAG e detecção de fala em tempo real — o substrato sobre o qual todo agente Finn roda.

Book a demo
<400msLatência ponta a ponta
46Idiomas ativos hoje
99,99%Disponibilidade da inferência
Chamadas simultâneas

Capacidades centrais

Cinco primitivas.Toda conversa construída sobre elas.

A camada do modelo é uma commodity. A infraestrutura ao redor não é — e é aí que o Finn faz por merecer a ligação.

01

Loop de voz abaixo de um segundo

ASR + LLM + TTS em streaming, num único pipeline aquecido. Sem atraso a cada turno. Os clientes ouvem uma cadência humana, não um robô.

02

Chamada de funções, durante a chamada

Puxe do seu CRM, dispare webhooks, execute lógica de negócio no meio da conversa. O agente nunca diz 'um momento, por favor.'

03

Multilíngue por padrão

Troque de idioma durante a chamada. Do hindi ao inglês ao tâmil — mesmo agente, mesma persona de voz, mesmo contexto.

04

Base de conhecimento + RAG

Envie PDFs, sitemaps, FAQs. O Finn embasa cada resposta nos seus dados. Sem SLAs alucinados.

05

Biblioteca de vozes

Mais de 100 vozes em diversos sotaques e idiomas. Clone a voz da sua marca em menos de um minuto.

06

Detecção de fala em tempo real

Tratamento de interrupções, detecção de silêncio, distinção de caixa postal — integrados, não acoplados por fora.

o loop de voz

ASR, LLM e TTS em streaming num único canal aquecido.

A maioria das stacks encadeia provedores em série e paga o imposto da latência a cada salto. O Finn roda fala-para-texto em streaming, inferência do modelo e texto-para-fala num pipeline único e fundido — abaixo de 400 ms de ponta a ponta. Os clientes ouvem uma cadência real, não um para-e-espera.

  • ASR em streaming via Deepgram, AssemblyAI ou próprio
  • GPT-4o, Claude, Gemini ou Llama auto-hospedado por baixo
  • ElevenLabs, PlayHT, Cartesia e mais de 100 vozes prontas
  • Tratamento de interrupções + detecção de caixa postal de fábrica

conhecimento, durante a chamada

Respostas embasadas. Sem SLAs alucinados.

Envie PDFs, sitemaps, FAQs, documentos internos. O Finn incorpora, divide em trechos e recupera a passagem certa a cada turno. Citações de fonte se anexam a cada resposta para revisão humana.

  • PDFs, URLs, Notion, Confluence — mesmo fluxo de importação
  • Bases de conhecimento por Finn, isoladas por workspace
  • Reindexação automática ao alterar documentos, sem reconstruções manuais
  • Atribuição de link de fonte exibida no PCA

vozes e idiomas

47 idiomas. Mais de 100 vozes. Troque durante a chamada.

Multilíngue não é um recurso — é o padrão. Escolha uma voz, escolha um idioma, entregue em qualquer região. Clone a voz da sua marca em menos de um minuto.

  • Hindi, tâmil, espanhol, português, árabe — e mais de 40 outros
  • Clonagem da voz da marca a partir de uma amostra de 60 segundos
  • Troca de idioma no meio da conversa, mesma persona
  • Biblioteca de prévia de vozes, marcada por sotaque e equilibrada por gênero

Por baixo do capô

Feito para o mundo real.Não para a demonstração.

Cada componente acima é avaliado com tráfego de produção — mais de 50 milhões de minutos entregues, mais de 250 chamadas simultâneas de pico, clientes em cinco continentes.

Book a demo30-min trial · No card

Audited + compliant

SOC 2 Type IIHIPAA BAAGDPRISO 27001DPDPNIST CSF