Operaciones y cumplimiento
Prueba A/B
de flujos completos.
Divide el tráfico entre dos versiones de flujo, mide la conversión y el sentimiento por rama y publica el ganador. Significancia estadística integrada.
Prueba gratuita de 30 minutos. Sin tarjeta. Sin compras.
Cómo funciona
Divide.
Mide. Publica.
Drag, wire, deploy. Each step is reversible — every save creates a versioned snapshot.
Crea la variante
Clona el flujo en vivo, cambia lo que quieras probar: redacción del prompt, voz, ramificación, secuencia. Instantánea versionada.
Divide el tráfico
División de % configurable (50/50, 90/10 para cambios arriesgados). Asignación aleatoria por llamada, nadie ve ambas.
Triage
Inbound router
DONEBooking
Scheduling specialist
ACTIVEConfirm
SMS follow-up
QUEUEDShared context · call IN-44219
caller.name = "Aarav Singh" caller.intent = "follow-up booking" captured.slot = "Tue 14:00" captured.doctor = "DR. Patel" captured.insurer = "BCBS"
Mide + decide
El panel en vivo muestra conversión, CSAT, duración de la llamada y tasa de abandono por rama. Significancia estadística autodetectada. Publica el ganador con un clic.
Evals passing
4 / 5
Avg score
88.8
+1.2
Calls evaluated
12,840
Itera con pruebas
Mejora real.
No intuiciones.
No bolt-ons. No second platform. Every primitive ships with the editor.
Seguimiento multimétrica
Conversión, sentimiento, duración de la llamada, tasa de abandono, tasa de escalado: todo medido por rama automáticamente.
Detección de significancia estadística
Sig. estadística integrada con chi-cuadrado / prueba t. Muestra 'la variante B gana (95 % de confianza)' cuando llegan suficientes datos.
Asignación aleatoria por llamada
Cada persona que llama recibe una rama de forma coherente. Nadie experimenta ambas durante la prueba.
Promoción con un clic
Elige el ganador desde el panel. Promociona automáticamente la variante al 100 % del tráfico y retira la perdedora.
Shipped in production
Real teams, real outcomes.
“Conversion rate up from 65% to 82%. Agent workload reduced by 40%. Lead response time under 2 minutes.”
Ayush Pateria
CEO & Cofounder, Snazzy · Snazzy
Trust + ecosystem
Plugs in. Audits clean.
Wires into your existing stack via 100+ connectors. Compliant from day one across the workloads that demand it.
Don't see yours? Finn plugs into any system via REST + webhooks.
FAQ
Questions and answers.
¿Qué puedo probar en A/B?+
Cualquier cambio de flujo: redacción del prompt, persona de voz, lógica de ramificación, orden de captura, reglas de escalado. Incluso flujos enteros si gestionan la misma intención.
¿Cómo se calcula la significancia estadística?+
Chi-cuadrado integrado (para métricas binarias como la conversión) + prueba t (para métricas continuas como la duración de la llamada). Muestra 'la variante B gana con un 95 % de confianza' cuando llegan suficientes datos.
¿La misma persona que llama recibe alguna vez ambas variantes?+
No: la asignación aleatoria por llamada es fija al ID del contacto. Quienes vuelven a llamar reciben la misma rama de forma coherente entre llamadas.
¿Cuánto duran normalmente las pruebas?+
Depende del volumen y del tamaño del efecto. Pruebas de efecto pequeño en flujos de bajo volumen = semanas. Pruebas de efecto grande en campañas de alto volumen = horas. El panel estima el tiempo hasta la significancia en vivo.
¿Puedo ejecutar más de 2 variantes?+
Sí: se admiten divisiones de N vías (A/B/C/D). La estadística de significancia tiene en cuenta la corrección por comparaciones múltiples automáticamente.
Mejora con método científico
Deja de adivinar.
Empieza a probar.
Las pruebas A/B de flujos publican variantes en paralelo y miden lo que de verdad funciona. Se acabó el 'creo que este prompt es mejor'.