Skip to main content

Capaciteit en schaal

Hoeveel gelijktijdige gesprekken — en hoe je groeit.

9 min read

Het korte antwoord: duizenden gelijktijdige gesprekken, tienduizenden gesprekken per dag, honderdduizenden per maand. Het platform is ontworpen om horizontaal te schalen. Deze pagina beschrijft wat die aantallen in de praktijk betekenen, de limieten per plan en hoe je kunt groeien zonder verrassingen.

Optimaliseer niet vooraf voor schaal. De meeste accounts draaien in productie minder dan 100 gelijktijdige gesprekken. Zelfs midmarketklanten halen zelden 500 tegelijk. Weet je niet zeker wat je piek wordt — begin, meet en schaal later op. Plannen zijn eenvoudig te upgraden.


Limieten in één oogopslag

PlanMax. gelijktijdige gesprekken (per Finn)Max. gelijktijdige gesprekken (accountbreed)Max. gesprekken per dagMax. gesprekken per maand
Starter551.00010.000
Growth5020025.000250.000
Scale5001.000100.0002.000.000
EnterpriseAangepastAangepast (5.000+)AangepastAangepast

Limieten per Finn bestaan omdat één Finn = één contactpunt in de beleving van je doelgroep. Boven een paar honderd gelijktijdige oproepen vanaf één identiteit ontstaan onrealistische gesprekspatronen. Gebruik meerdere Finns of nummerpools om verder te schalen dan de limiet per Finn.


Wat "gelijktijdige gesprekken" precies betekent

Als het platform "200 gelijktijdige gesprekken" zegt, betekent dat 200 actieve gesprekken die tegelijk plaatsvinden. Elk gesprek gebruikt een eigen:

  • LLM-inferentie-instantie (verwerkt het gesprek)
  • TTS-streaminginstantie (genereert de spraakaudio)
  • STT-instantie (transcribeert wat de beller zegt)
  • Telefoniekanaal (de daadwerkelijke telefoonverbinding)

Het platform schaalt elk van deze onderdelen onafhankelijk. Je hoeft niet na te denken over provisioning — het werkt gewoon.


Je piekbelasting inschatten

Enkele ruwe berekeningen:

Uitgaande campagnes

peak concurrent calls ≈ (calls per hour) × (avg duration in minutes) / 60

Voorbeeld: 1.000 te maken gesprekken, gemiddelde duur 2 minuten, verspreid over 4 uur = 250 gesprekken/uur × 2/60 = ~8 gelijktijdig op piek.

Inkomend

peak concurrent calls ≈ (calls per hour at peak time) × (avg duration in minutes) / 60

Voorbeeld: een kliniek ontvangt 30 gesprekken/uur tijdens de lunchpiek, gemiddelde duur 4 minuten = 30 × 4/60 = 2 gelijktijdig op piek.

De meeste bedrijven zijn verrast door hoe laag hun werkelijke gelijktijdige piek is. Zelfs een drukke receptie-Finn heeft zelden meer dan 10-20 gelijktijdige gesprekken nodig.

Wanneer parallelle deployments de aantallen opdrijven

Parallelle deployments (Enterprise) zijn anders — die maximaliseren bewust het gelijktijdig bellen om een grote lijst snel af te ronden.

Voorbeeld: 50.000 contacten, gemiddeld gesprek van 90 seconden, af te ronden binnen 4 uur = 50.000 gesprekken / (4 × 3600/90) = ~313 gelijktijdig gemiddeld; pieken van 2x zoveel = ~625 gelijktijdig.

Voor parallelle deployments heb je zowel plancapaciteit ALS nummerpoolcapaciteit nodig. Losse nummers kunnen fysiek niet meer dan ~50 gelijktijdige uitgaande gesprekken aan (limieten van de provider).


Nummerpools en gelijktijdige capaciteit

Bij uitgaand bellen met hoge gelijktijdigheid is de beperkende factor meestal het aantal telefoonnummers — niet de platformcapaciteit.

Limieten per nummer

RegioMax. gelijktijdige uitgaande gesprekken per nummer
VS/Canada~50
VK~30
EU (meeste)~20
India~10
Overigvarieert (vaak ~5-15)

Deze limieten worden opgelegd door providers, niet door het platform. Bij overschrijding worden gesprekken geweigerd door de provider van de bestemming.

Vuistregel voor poolgrootte

pool size ≈ peak concurrent calls / per-number limit × 1.5 (safety margin)

Voorbeeld: 500 gelijktijdige uitgaande gesprekken naar de VS gepland = 500/50 × 1,5 = 15 nummers in de pool.

Koop meer nummers dan je denkt nodig te hebben. Nummers zijn goedkoop ($1-$5/mnd); mislukte gesprekken door een te kleine pool zijn duur (gemiste antwoorden + imagoschade door "dit nummer is niet bereikbaar"-fouten).


Latency en kwaliteit op schaal

De latencydoelstelling van het platform is <800 ms tussen het einde van de spraak van de gebruiker en het begin van het antwoord van Finn. Dit geldt of je nu 1 gesprek of 1.000 gelijktijdige gesprekken voert — het systeem is ontworpen om horizontaal te schalen, niet alleen qua doorvoer maar ook qua kwaliteit per gesprek.

Wat de kwaliteit op schaal kan verslechteren:

OorzaakEffectOplossing
Bellen tussen regio's (bijv. een Finn in de VS die EU-nummers belt)+100-300 ms latency door netwerk-hopStel regionale accounts in (Enterprise) of accepteer de latency
Premium spraakniveau onder belastingZelfde doellatentie maar hogere TTS-variantieStandaardstemmen zijn consistenter onder belasting
Kennisbank met meer dan 500 MB aan inhoudIets tragere opvragingKennisbank inkorten tot gerichte, kleinere bestanden
Piekverkeer (0 → 100 gelijktijdig in seconden)Cold-start-latentiepiek bij de eerste paar gesprekkenVooraf opwarmen met geplande kleine testgesprekken vóór je echte piek

Rate limits

Naast limieten op gelijktijdige gesprekken hanteert het platform ook limieten op de aanvraagsnelheid voor:

ActieLimiet (standaard)Afwijkingen per abonnement
API-aanvragen (per sleutel)100 req/minTot 1.000/min op Scale, onbeperkt op Enterprise
Webhook-afleveringen (per endpoint)50 req/secTot 500/sec op Scale
Bulkimports van doelgroepen100.000 contacten per uploadMeer op Scale+
Testgesprekken (per Finn)30/uurGelijk voor alle abonnementen
Nieuw gelanceerde deployments10/uur50/uur op Scale+

Bij een overschreden limiet volgt 429 Too Many Requests met een Retry-After-header die aangeeft wanneer je opnieuw kunt proberen.


Multiregio en dataresidentie

Voor latentiegevoelige use cases of compliancevereisten kun je kiezen in welke regio je account draait.

RegioWaar je data staatGeschikt voor
VS (standaard)Virginia (us-east-1)Noord-Amerika, LATAM
EUFrankfurt (eu-central-1)EU/VK, GDPR strikt
IndiaMumbai (ap-south-1)India, Zuid-Azië, Midden-Oosten
Azië-PacificSingapore (Enterprise)Zuidoost-Azië, Australië, Nieuw-Zeeland

Kies de regio bij het aanmaken van het account. Kan later niet worden gewijzigd zonder datamigratie. Richt je je op klanten in de EU, kies dan EU tijdens de registratie.

Data verlaat nooit de door jou gekozen regio. Opnames, transcripties, audiencegegevens, analyse na afloop van gesprekken — alles blijft in de regio.


Burstcapaciteit

Soms heb je eenmalig een piek nodig boven je abonnementslimieten (verkiezingscampagnes, productlanceringen, reactie op noodweer).

  • Vooraf geautoriseerde burst — neem 48 uur van tevoren contact op met support met de verwachte piek. Wij leveren de capaciteit, jij betaalt alleen voor het werkelijke gebruik boven je tier.
  • Zachte burst — het platform staat tot 20% boven de gelijktijdigheidslimiet van je abonnement toe bij korte pieken (minder dan 15 minuten). Spaarzaam gebruiken; aanhoudende burst wordt afgeknepen.

Wanneer je een limiet bereikt

Overschrijd je de limiet voor gelijktijdige gesprekken, dan komen nieuwe uitgaande gesprekken in de wachtrij in plaats van dat ze mislukken. De wachtrij loopt leeg zodra actieve gesprekken eindigen.

Bij inkomend verkeer betekent overschrijding van de limiet dat nieuwe inkomende gesprekken een bezettoon krijgen of naar de fallback-voicemail gaan (per nummer instelbaar).

In beide gevallen toont het dashboard een gele waarschuwingsbanner. Zie je die vaker dan af en toe, upgrade dan je abonnement.


Prestatiebenchmarks uit de praktijk

Echte cijfers van klanten die op schaal draaien (geanonimiseerd):

KlantprofielGesprekken per dagPiek gelijktijdigGemiddelde duurAbonnement
Groep zorgklinieken (5 locaties)800123,5 minGrowth
B2B-sales SDR-ondersteuning3.500802,1 minGrowth
Schade-intake verzekeringen1.200257 minGrowth
Incasso (mid-market)18.0003001,8 minScale
Verkiezingscampagne (eenmalig)250.0002.0000,9 minEnterprise burst
Sweep voor abonnementsverlengingen45.000/dag6001,5 minScale

Als je verwachte aantallen binnen deze marges of lager liggen, verwerkt het platform ze zonder problemen. Boven de bovenste rij: neem contact op met sales voor capaciteitsplanning.


Veilig opschalen

Fase 1 — Pilot (1-50 gesprekken/dag)

  • Eén Finn, één deployment.
  • Draai op een proefversie van Starter of Growth.
  • Meet: slagingspercentage, voltooiingspercentage, kosten per resultaat.

Fase 2 — Productielancering (50-1.000 gesprekken/dag)

  • Zelfde Finn-configuratie; voeg monitoring toe.
  • Stel uitgavenlimieten per deployment in.
  • Registreer beller-ID, stel automatische onderdrukking in.

Fase 3 — Opschalen (1.000-10.000 gesprekken/dag)

  • Voeg een nummerpool toe (5-15 nummers).
  • Overweeg segmentatie met meerdere Finns (verschillende Finns voor verschillende doelgroepsegmenten).
  • Stel Slack-meldingen in voor mislukte deployments.
  • Stap over op het Scale-abonnement.

Fase 4 — Grootschalig (10.000+ gesprekken/dag)

  • Parallelle deployments.
  • Grotere nummerpools (50+).
  • Webhook-stream voor realtime analyses in je eigen systemen.
  • Enterprise-abonnement met toegewijde CSM + SLA.

Fase 5 — Massale schaal (100.000+ gesprekken/dag)

  • Toegewijde infrastructuur (Enterprise).
  • Multiregio voor latentieoptimalisatie.
  • Aangepaste rate limits, aangepaste integraties.
  • Directe lijn met engineering voor piekplanning.

Veelgestelde vragen

V: Wat is de daadwerkelijke technische limiet voor gelijktijdige gesprekken? A: Geen gepubliceerd getal. We hebben stresstests gedaan boven 50.000 gelijktijdig. In de praktijk loop je eerder tegen je plantier of de omvang van je nummerpool aan dan tegen de capaciteit van het platform.

V: Als ik mijn planlimiet overschrijd, wordt er dan automatisch geüpgraded? A: Nee — dat zou een recept zijn voor onverwachte rekeningen. Het platform zet gesprekken in de wachtrij of weigert ze en toont een waarschuwing. Je upgradet handmatig wanneer je er klaar voor bent.

V: Kosten gesprekken meer tijdens piekuren? A: Nee. De prijs is vast per minuut, ongeacht wanneer het gesprek plaatsvindt.

V: Kan ik verschillende Finns op verschillende gelijktijdige volumes draaien? A: Ja. Elke Finn heeft zijn eigen limiet per Finn, en de accountbrede limiet wordt gedeeld door alle Finns. Je kunt zonder problemen tegelijk een qualifier met 100 gelijktijdige gesprekken en een receptionist met 20 draaien.

V: Hoe snel kan ik een nieuwe deployment opschalen? A: De meeste deployments bereiken hun doelaantal gelijktijdige gesprekken binnen 2-5 minuten na de start. Zeer grote opschalingen (1.000+ gelijktijdig in <1 minuut) vereisen voorafgaande afstemming met support.


Volgende

Was this page helpful?

Still stuck or have feedback?

Email [email protected] or use the chat bubble in the bottom-right corner — it's a Finn that knows the Academy cold.