Capacità e scalabilità
Quante chiamate simultanee — e come crescere.
La risposta breve: migliaia di chiamate simultanee, decine di migliaia di chiamate al giorno, centinaia di migliaia al mese. La piattaforma è progettata per scalare orizzontalmente. Questa pagina spiega cosa significano questi numeri nella pratica, i limiti di ciascun piano e come crescere senza sorprese.
Non ottimizzare in anticipo per la scalabilità. La maggior parte degli account gestisce meno di 100 chiamate simultanee in produzione. Anche i clienti mid-market raggiungono raramente 500 chiamate contemporanee. Se non sai quale sarà il tuo picco, inizia, misura e scala in seguito. I piani si aggiornano facilmente.
I limiti in sintesi
| Piano | Chiamate simultanee max (per Finn) | Chiamate simultanee max (per account) | Chiamate max al giorno | Chiamate max al mese |
|---|---|---|---|---|
| Starter | 5 | 5 | 1.000 | 10.000 |
| Growth | 50 | 200 | 25.000 | 250.000 |
| Scale | 500 | 1.000 | 100.000 | 2.000.000 |
| Enterprise | Personalizzato | Personalizzato (5.000+) | Personalizzato | Personalizzato |
I limiti per Finn esistono perché un singolo Finn equivale a un unico punto di contatto nella mente del tuo pubblico. Oltre qualche centinaio di chiamate simultanee da una sola identità, si creano volumi di chiamata poco realistici. Usa più Finn o pool di numeri per superare il limite per Finn.
Cosa significa davvero "chiamate simultanee"
Quando la piattaforma indica "200 chiamate simultanee", significa 200 conversazioni attive in contemporanea. Ogni chiamata utilizza in modo dedicato:
- un'istanza di inferenza LLM (elabora la conversazione)
- un'istanza di streaming TTS (genera l'audio vocale)
- un'istanza STT (trascrive il parlato del chiamante)
- un canale di telefonia (la connessione telefonica vera e propria)
La piattaforma scala ciascuno di questi elementi in modo indipendente. Non devi preoccuparti del provisioning: funziona e basta.
Come stimare il tuo carico di picco
Alcuni calcoli approssimativi:
Campagne outbound
peak concurrent calls ≈ (calls per hour) × (avg duration in minutes) / 60
Esempio: 1.000 chiamate da effettuare, durata media di 2 minuti, distribuite su 4 ore = 250 chiamate/ora × 2/60 = ~8 di picco concorrente.
Inbound
peak concurrent calls ≈ (calls per hour at peak time) × (avg duration in minutes) / 60
Esempio: una clinica riceve 30 chiamate/ora nel picco di mezzogiorno, durata media di 4 minuti = 30 × 4/60 = 2 di picco concorrente.
La maggior parte delle aziende si stupisce di quanto sia basso il loro reale picco concorrente. Anche un Finn receptionist molto attivo raramente supera le 10-20 chiamate concorrenti.
Quando i deployment paralleli aumentano i numeri
I deployment paralleli (Enterprise) sono diversi: massimizzano esplicitamente la composizione concorrente per completare rapidamente un elenco ampio.
Esempio: 50.000 contatti, chiamata media di 90 secondi, completamento desiderato in 4 ore = 50.000 chiamate / (4 × 3600/90) = ~313 concorrenti in media; picchi al doppio = ~625 concorrenti.
Per i deployment paralleli servono sia la capacità del piano SIA la capacità del pool di numeri. Un singolo numero non può fisicamente supportare più di ~50 chiamate outbound simultanee (limiti dell'operatore).
Pool di numeri e capacità concorrente
Per l'outbound ad alta concorrenza, il fattore limitante sono di solito i numeri di telefono, non la capacità della piattaforma.
Limiti per numero
| Regione | Massimo di chiamate outbound concorrenti per numero |
|---|---|
| USA/Canada | ~50 |
| Regno Unito | ~30 |
| UE (maggior parte) | ~20 |
| India | ~10 |
| Altro | variabile (spesso ~5-15) |
Sono limiti imposti dall'operatore, non dalla piattaforma. Superarli comporta il rifiuto delle chiamate da parte dell'operatore di destinazione.
Regola pratica per dimensionare il pool
pool size ≈ peak concurrent calls / per-number limit × 1.5 (safety margin)
Esempio: previsione di 500 chiamate outbound concorrenti negli USA = 500/50 × 1,5 = 15 numeri nel pool.
Acquista più numeri di quelli che ritieni necessari. I numeri costano poco ($1-$5/mese); le chiamate fallite per pool sottodimensionati costano care (risposte perse + danno al marchio per gli errori "numero non raggiungibile").
Latenza e qualità su larga scala
L'obiettivo di latenza della piattaforma è <800 ms dalla fine del parlato dell'utente all'inizio della risposta di Finn. Vale sia con 1 chiamata sia con 1.000 chiamate concorrenti: il sistema è progettato per scalare orizzontalmente, non solo in throughput ma anche nella qualità per chiamata.
Cosa può degradare la qualità su larga scala:
| Causa | Effetto | Soluzione |
|---|---|---|
| Chiamate cross-region (es. un Finn negli USA che chiama numeri UE) | +100-300 ms di latenza dovuti al salto di rete | Configurare account regionali (Enterprise) o accettare la latenza |
| Livello voce premium sotto carico | Stessa latenza target ma varianza TTS maggiore | Le voci standard sono più costanti sotto carico |
| Knowledge base con oltre 500 MB di contenuti | Recupero leggermente più lento | Riduci la KB a file più piccoli e mirati |
| Traffico a picchi (0 → 100 chiamate simultanee in pochi secondi) | Picco di latenza a freddo sulle prime chiamate | Pre-riscalda con piccole chiamate di test pianificate prima del picco reale |
Limiti di frequenza
Oltre ai limiti di chiamate simultanee, la piattaforma applica limiti di frequenza delle richieste su:
| Azione | Limite (predefinito) | Override per livello di piano |
|---|---|---|
| Richieste API (per chiave) | 100 req/min | Fino a 1.000/min su Scale, illimitate su Enterprise |
| Consegne webhook (per endpoint) | 50 req/sec | Fino a 500/sec su Scale |
| Importazioni massive di audience | 100.000 contatti per caricamento | Superiore su Scale+ |
| Chiamate di test (per Finn) | 30/ora | Uguale su tutti i piani |
| Nuovi deployment avviati | 10/ora | 50/ora su Scale+ |
Le risposte con limite di frequenza restituiscono 429 Too Many Requests con un header Retry-After che indica quando riprovare.
Multi-regione e residenza dei dati
Per casi d'uso sensibili alla latenza o requisiti di conformità, puoi scegliere in quale regione opera il tuo account.
| Regione | Dove risiedono i tuoi dati | Ideale per |
|---|---|---|
| US (predefinita) | Virginia (us-east-1) | Nord America, LATAM |
| UE | Francoforte (eu-central-1) | UE/UK, GDPR rigoroso |
| India | Mumbai (ap-south-1) | India, Asia meridionale, Medio Oriente |
| Asia-Pacifico | Singapore (Enterprise) | Sud-est asiatico, Australia, NZ |
Scegli la regione alla creazione dell'account. Non può essere modificata in seguito senza una migrazione dei dati. Se il tuo target sono clienti UE, scegli UE durante la registrazione.
I dati non lasciano mai la regione scelta. Registrazioni, trascrizioni, record dell'audience, analisi post-chiamata — tutto resta nella regione.
Capacità di burst
A volte serve un picco una tantum oltre i limiti del piano (campagne elettorali, lancio di prodotto, risposta a eventi meteo).
- Burst pre-autorizzato — contatta il supporto 48h prima indicando il picco previsto. Noi predisponiamo la capacità, tu paghi solo l'utilizzo effettivo oltre il tuo tier.
- Burst soft — la piattaforma consente fino al 20% oltre il limite di chiamate concorrenti del tuo piano per brevi picchi (meno di 15 minuti). Usalo con parsimonia; il burst prolungato viene limitato.
Quando raggiungi un limite
Se superi il limite di chiamate concorrenti, le nuove chiamate in uscita vengono messe in coda anziché fallire. La coda si svuota man mano che le chiamate attive terminano.
Per le chiamate in entrata, superare il limite significa che le nuove chiamate ricevono un tono di "occupato" o vengono inoltrate alla segreteria di fallback (configurabile per numero).
In entrambi i casi, la dashboard mostra un banner di avviso giallo. Se lo vedi più che occasionalmente, passa a un piano superiore.
Benchmark di performance dalla produzione
Numeri reali da clienti che operano su larga scala (anonimizzati):
| Profilo cliente | Chiamate giornaliere | Picco di concorrenza | Durata media | Piano |
|---|---|---|---|---|
| Gruppo di cliniche sanitarie (5 sedi) | 800 | 12 | 3,5 min | Growth |
| Potenziamento SDR vendite B2B | 3.500 | 80 | 2,1 min | Growth |
| Raccolta sinistri assicurativi | 1.200 | 25 | 7 min | Growth |
| Recupero crediti (mid-market) | 18.000 | 300 | 1,8 min | Scale |
| Campagna elettorale (una tantum) | 250.000 | 2.000 | 0,9 min | Picco enterprise |
| Ciclo di rinnovo abbonamenti | 45.000/giorno | 600 | 1,5 min | Scale |
Se i numeri previsti rientrano in questi intervalli o sono inferiori, la piattaforma li gestisce senza problemi. Oltre la riga superiore, contatta il reparto vendite per la pianificazione della capacità.
Come scalare in sicurezza
Fase 1 — Pilota (1-50 chiamate/giorno)
- Un solo Finn, un solo deployment.
- Esegui con il piano Starter o con la prova del piano Growth.
- Misura: tasso di successo, tasso di completamento, costo per esito.
Fase 2 — Lancio in produzione (50-1.000 chiamate/giorno)
- Stessa configurazione di Finn; aggiungi il monitoraggio.
- Imposta limiti di spesa per deployment.
- Registra l'ID chiamante, configura la soppressione automatica.
Fase 3 — Scale (1.000-10.000 chiamate/giorno)
- Aggiungi un pool di numeri (5-15 numeri).
- Valuta la segmentazione multi-Finn (Finn diversi per segmenti di pubblico diversi).
- Configura avvisi Slack per i deployment falliti.
- Passa al piano Scale.
Fase 4 — Grande scala (oltre 10.000 chiamate/giorno)
- Deployment paralleli.
- Pool di numeri più ampi (50+).
- Stream webhook per analisi in tempo reale nei tuoi sistemi.
- Piano Enterprise con CSM dedicato + SLA.
Fase 5 — Scala massiva (oltre 100.000 chiamate/giorno)
- Infrastruttura dedicata (Enterprise).
- Multi-regione per l'ottimizzazione della latenza.
- Limiti di frequenza personalizzati, integrazioni personalizzate.
- Linea diretta con il team di progettazione per la pianificazione dei picchi.
Domande frequenti
D: Qual è il limite tecnico reale sulle chiamate simultanee? R: Non è un numero pubblicato. Abbiamo eseguito stress test oltre 50.000 chiamate simultanee. In pratica, il limite che raggiungerai è quello del tuo piano o della dimensione del tuo pool di numeri, non la capacità della piattaforma.
D: Se supero il limite del mio piano, viene aggiornato automaticamente? R: No — sarebbe la ricetta perfetta per bollette a sorpresa. La piattaforma mette in coda o rifiuta le chiamate e mostra un avviso. L'aggiornamento lo esegui manualmente quando sei pronto.
D: Le chiamate costano di più nelle ore di punta? R: No. Il prezzo è fisso al minuto, indipendentemente da quando avviene la chiamata.
D: Posso eseguire Finn diversi con volumi di chiamate simultanee diversi? R: Sì. Ogni Finn ha il proprio limite individuale e il limite a livello di account è condiviso tra tutti i Finn. Puoi eseguire contemporaneamente un qualificatore a 100 chiamate simultanee e un receptionist a 20 senza problemi.
D: Con quale rapidità posso scalare un nuovo deployment? R: La maggior parte dei deployment raggiunge il numero di chiamate simultanee previsto entro 2-5 minuti dal lancio. Aumenti molto ampi (oltre 1.000 chiamate simultanee in meno di 1 minuto) richiedono un coordinamento preventivo con il supporto.
Avanti
- Numeri di telefono → Pool di numeri — come configurare i pool per la scalabilità.
- Fatturazione → — quanto costa ogni piano.
- Campagne e deployment → Deployment paralleli — per outbound ad alta concorrenza.
Was this page helpful?
Still stuck or have feedback?
Email [email protected] or use the chat bubble in the bottom-right corner — it's a Finn that knows the Academy cold.