Skip to main content

Voz y turnos de palabra

Interrumpe a Finn.Finn cede.

Turnos de palabra naturales: cuando quien llama habla por encima de Finn, Finn se detiene a media palabra. Sin hablar unos sobre otros. Sin pausas incómodas.

Book a demo

Prueba gratuita de 30 minutos. Sin tarjeta. Sin compras.

<80 msLatencia de cesión
NaturalTraspaso a media palabra
Sin recortesRetoma limpio
Por turnoUmbrales ajustables

Cómo funciona

Escucha inclusomientras habla.

Arrastre, conecte, publique. Cada paso es reversible y cada guardado crea una versión.

01 / 03

Flujo de audio bidireccional

El micrófono de Finn permanece abierto durante la síntesis. El VAD detecta la voz de quien llama en cuanto empieza.

Analítica de desplieguesBucle de voz por debajo del segundoCorrecto

p50

384ms

p95

412ms

p99

538ms

ASRDeepgram Nova 2 streaming
84ms
LLMGPT-4o function-calling pass
192ms
TTSElevenLabs streaming synthesis
96ms
Last 24h · 12,840 calls384ms avg
02 / 03

Cede a media palabra

Menos de 80 ms desde la voz detectada hasta el corte del TTS. Sin colisiones a mitad de frase.

Analítica de desplieguesBucle de voz por debajo del segundoCorrecto

p50

384ms

p95

412ms

p99

538ms

ASRDeepgram Nova 2 streaming
84ms
LLMGPT-4o function-calling pass
192ms
TTSElevenLabs streaming synthesis
96ms
Last 24h · 12,840 calls384ms avg
03 / 03

Retoma con conciencia del contexto

Reconoce la interrupción, procesa lo que dijo quien llama y retoma el hilo adecuado. Sin 'como iba diciendo'.

OrquestaciónFlujo multiagenteLive
T
01

Triaje

Enrutador de entrada

DONE
R
02

Reserva

Especialista en agenda

ACTIVE
C
03

Confirmar

SMS follow-up

QUEUED

Shared context · call IN-44219

caller.name      = "Aarav Singh"
caller.intent    = "follow-up booking"
captured.slot    = "Tue 14:00"
captured.doctor  = "DR. Patel"
captured.insurer = "BCBS"

Se percibe como una conversación real

Quien llama lidera.Finn sigue.

Sin añadidos. Sin una segunda plataforma. Cada primitiva viene con el editor.

Cesión en menos de 80 ms

Más rápido que el tiempo de reacción humano. Finn cede la palabra antes de que quien llama note que le está hablando por encima.

Retoma limpio

Rastrea lo que se dijo y lo que se cortó. Reconoce y se adapta. Sin un robótico 'un momento, por favor'.

Umbral de barge-in ajustable

Sensibilidad del VAD por flujo. Quien llama en voz baja en una sala tranquila frente a un centro de contacto ruidoso: ambos funcionan.

Resistente a falsos positivos

Entrenado para distinguir la voz de quien llama del ruido ambiente, la música y las conversaciones cruzadas. Finn no cede ante un estornudo.

En producción

Equipos reales, resultados reales.

TOFA lanzó una campaña nacional con Finn: más de 10.000 llamadas al día y derivaciones a personas sin fricción.
Alice Smith

Alice Smith

Ingeniera sénior, Gofts · TOFA

Confianza y ecosistema

Se integra. Supera auditorías.

Se conecta a su pila actual con más de 100 conectores. Conforme desde el primer día en las cargas de trabajo que lo exigen.

Twilio logoTwilioPlivo logoPlivoElevenLabsOpenAIMicrosoft Teams logoMicrosoft Teams

Don't see yours? Finn plugs into any system via REST + webhooks.

AuditedSOC 2 Type IIHIPAA BAAGDPRISO 27001DPDPNIST CSF

Preguntas frecuentes

Preguntas y respuestas.

¿Cuál es la latencia técnica del barge-in?+

Menos de 80 ms desde el inicio de la voz detectada hasta la detención del TTS. Más rápido de lo que quien llama puede percibir su propia interrupción.

¿Cómo gestiona Finn el contenido de la interrupción?+

Captura lo que dijo quien llama, lo procesa según el contexto de la conversación y responde adecuadamente: disculpa, aclaración, ramificación a un tema nuevo, lo que encaje.

¿Puedo ajustar la sensibilidad por flujo?+

Sí. Las llamadas de soporte entrantes tranquilas usan un umbral bajo. Las salidas ruidosas a usuarios móviles usan un umbral más alto para ignorar el ruido ambiente.

¿Y las conversaciones cruzadas en conexiones malas?+

La cancelación de eco y la clasificación de la voz de quien llama filtran las conversaciones cruzadas y el ruido de línea. Finn no cede ante su propia voz rebotando de vuelta.

¿Esto funciona con todos los proveedores de telefonía?+

Sí: Twilio, Plivo, troncal SIP BYOC. Requiere audio en streaming bidireccional, que todos los principales proveedores admiten.

Conversación, no monólogo

Cede como una persona.No como un quiosco.

Detección de interrupción (barge-in) en tiempo real: Finn cede la palabra en el instante en que quien llama habla. Se acabó el 'pulse 1 para interrumpir'.

Book a demoPrueba de 30 min · Sin tarjeta