Capacité & Montée en charge
Combien d'appels simultanés — et comment grandir.
Réponse courte : des milliers d'appels simultanés, des dizaines de milliers d'appels par jour, des centaines de milliers par mois. La plateforme est conçue pour évoluer horizontalement. Cette page décrit ce que ces chiffres représentent concrètement, les limites de chaque formule et comment monter en charge sans mauvaise surprise.
N'optimisez pas la montée en charge à l'avance. La plupart des comptes exécutent moins de 100 appels simultanés en production. Même les clients mid-market dépassent rarement 500 appels simultanés. Si vous ne connaissez pas votre pic : démarrez, mesurez, augmentez ensuite. Les formules se mettent à niveau facilement.
Les limites en un coup d'œil
| Formule | Appels simultanés max (par Finn) | Appels simultanés max (sur tout le compte) | Appels max par jour | Appels max par mois |
|---|---|---|---|---|
| Starter | 5 | 5 | 1 000 | 10 000 |
| Growth | 50 | 200 | 25 000 | 250 000 |
| Scale | 500 | 1 000 | 100 000 | 2 000 000 |
| Enterprise | Personnalisé | Personnalisé (5 000+) | Personnalisé | Personnalisé |
Les limites par Finn existent parce qu'un Finn = un seul point de contact dans l'esprit de votre audience. Au-delà de quelques centaines d'appels simultanés depuis une même identité, vous créez des volumes d'appels irréalistes. Utilisez plusieurs Finn ou des pools de numéros pour dépasser la limite par Finn.
Ce que signifie vraiment « appels simultanés »
Quand la plateforme indique « 200 appels simultanés », cela signifie 200 conversations actives en même temps. Chaque appel mobilise :
- une instance d'inférence LLM (traitement de la conversation)
- une instance de streaming TTS (génération de la voix)
- une instance STT (transcription de la parole de l'interlocuteur)
- un canal de téléphonie (la connexion téléphonique elle-même)
La plateforme fait évoluer chacun de ces éléments indépendamment. Aucun provisionnement à prévoir de votre côté : tout est automatique.
Comment estimer votre charge de pointe
Quelques calculs approximatifs :
Campagnes sortantes
peak concurrent calls ≈ (calls per hour) × (avg duration in minutes) / 60
Exemple : 1 000 appels à passer, durée moyenne de 2 minutes, répartis sur 4 heures = 250 appels/heure × 2/60 = ~8 appels simultanés en pic.
Entrant
peak concurrent calls ≈ (calls per hour at peak time) × (avg duration in minutes) / 60
Exemple : une clinique reçoit 30 appels/heure au pic du déjeuner, durée moyenne de 4 minutes = 30 × 4/60 = 2 appels simultanés en pic.
La plupart des entreprises sont surprises de constater à quel point leur pic réel de simultanéité est faible. Même un Finn réceptionniste très sollicité dépasse rarement 10 à 20 appels simultanés.
Quand les déploiements parallèles font monter les chiffres
Les déploiements parallèles (Enterprise) sont différents : ils maximisent explicitement la numérotation simultanée pour traiter rapidement une longue liste.
Exemple : 50 000 contacts, appel moyen de 90 secondes, objectif de traitement en 4 heures = 50 000 appels / (4 × 3600/90) = ~313 appels simultanés en moyenne ; pics à 2× ce chiffre = ~625 simultanés.
Pour les déploiements parallèles, il faut à la fois de la capacité de forfait ET de la capacité de pool de numéros. Un numéro seul ne peut physiquement pas supporter plus de ~50 appels sortants simultanés (limites des opérateurs).
Pools de numéros et capacité simultanée
Pour les appels sortants à forte simultanéité, le facteur limitant est généralement le nombre de numéros de téléphone, pas la capacité de la plateforme.
Limites par numéro
| Région | Nombre max d'appels sortants simultanés par numéro |
|---|---|
| États-Unis/Canada | ~50 |
| Royaume-Uni | ~30 |
| UE (majorité) | ~20 |
| Inde | ~10 |
| Autre | variable (souvent ~5-15) |
Ces limites sont imposées par les opérateurs, pas par la plateforme. Les dépasser entraîne le rejet des appels par l'opérateur de destination.
Règle empirique de dimensionnement du pool
pool size ≈ peak concurrent calls / per-number limit × 1.5 (safety margin)
Exemple : pour 500 appels sortants simultanés aux États-Unis = 500/50 × 1,5 = 15 numéros dans le pool.
Achetez plus de numéros que vous ne le pensez nécessaire. Les numéros coûtent peu (1 à 5 $/mois) ; les appels échoués dus à un pool sous-dimensionné coûtent cher (réponses perdues + atteinte à l'image liée aux erreurs « ce numéro n'est pas joignable »).
Latence et qualité à grande échelle
L'objectif de latence de la plateforme est de <800 ms entre la fin de la parole de l'utilisateur et le début de la réponse de Finn. Cela vaut aussi bien pour 1 appel que pour 1 000 appels simultanés : le système est conçu pour évoluer horizontalement, non seulement en débit mais aussi en qualité par appel.
Ce qui peut dégrader la qualité à grande échelle :
| Cause | Effet | Solution |
|---|---|---|
| Appels inter-régions (ex. un Finn américain appelant des numéros européens) | +100-300 ms de latence dues au saut réseau | Configurer des comptes régionaux (Enterprise) ou accepter la latence |
| Niveau de voix premium en charge | Latence cible identique mais variance TTS plus élevée | Les voix standard sont plus régulières en charge |
| Base de connaissances de plus de 500 Mo de contenu | Récupération légèrement plus lente | Réduisez la base de connaissances à des fichiers ciblés et plus petits |
| Trafic en rafale (0 → 100 appels simultanés en quelques secondes) | Pic de latence au démarrage à froid sur les premiers appels | Préchauffez avec de petits appels de test planifiés avant votre pic réel |
Limites de débit
Au-delà des limites d'appels simultanés, la plateforme applique des limites de débit de requêtes sur :
| Action | Limite (par défaut) | Dérogations par niveau de plan |
|---|---|---|
| Requêtes API (par clé) | 100 req/min | Jusqu'à 1 000/min sur Scale, illimité sur Enterprise |
| Livraisons de webhooks (par point de terminaison) | 50 req/s | Jusqu'à 500/s sur Scale |
| Imports groupés d'audience | 100 000 contacts par téléversement | Plus sur Scale+ |
| Appels de test (par Finn) | 30/heure | Identique sur tous les plans |
| Nouveaux déploiements lancés | 10/heure | 50/heure sur Scale+ |
Les réponses limitées en débit renvoient 429 Too Many Requests avec un en-tête Retry-After indiquant quand réessayer.
Multi-région et résidence des données
Pour les cas d'usage sensibles à la latence ou les exigences de conformité, vous pouvez choisir la région dans laquelle votre compte s'exécute.
| Région | Où résident vos données | Idéal pour |
|---|---|---|
| US (par défaut) | Virginie (us-east-1) | Amérique du Nord, LATAM |
| UE | Francfort (eu-central-1) | UE/Royaume-Uni, RGPD strict |
| Inde | Mumbai (ap-south-1) | Inde, Asie du Sud, Moyen-Orient |
| Asie-Pacifique | Singapour (Enterprise) | Asie du Sud-Est, Australie, Nouvelle-Zélande |
Choisissez la région à la création du compte. Impossible à modifier ensuite sans migration de données. Si vous ciblez des clients de l'UE, choisissez l'UE à l'inscription.
Les données ne quittent jamais la région choisie. Enregistrements, transcriptions, fiches d'audience, analyse post-appel — tout reste dans la région.
Capacité en pic
Il arrive que vous ayez besoin d'un pic ponctuel au-delà des limites de votre offre (campagne électorale, lancement de produit, réponse à un événement météo).
- Pic pré-autorisé — contactez le support 48 h à l'avance avec le pic attendu. Nous provisionnons la capacité, vous ne payez que l'usage réel au-delà de votre palier.
- Pic souple — la plateforme autorise jusqu'à 20 % au-dessus de la limite d'appels simultanés de votre offre pour de courts pics (moins de 15 minutes). À utiliser avec parcimonie ; un pic prolongé est limité.
Quand vous atteignez une limite
Si vous dépassez votre limite d'appels simultanés, les nouveaux appels sortants sont mis en file d'attente plutôt que rejetés. La file se vide à mesure que les appels actifs se terminent.
En entrant, dépasser la limite signifie que les nouveaux appels entrants reçoivent une tonalité « occupé » ou basculent vers une messagerie vocale de secours (configurable par numéro).
Dans les deux cas, le tableau de bord affiche une bannière d'avertissement jaune. Si elle apparaît plus qu'occasionnellement, passez à une offre supérieure.
Benchmarks de performance en production
Chiffres réels de clients à grande échelle (anonymisés) :
| Profil client | Appels quotidiens | Pic de simultanéité | Durée moyenne | Offre |
|---|---|---|---|---|
| Groupe de cliniques (5 sites) | 800 | 12 | 3,5 min | Growth |
| Renfort SDR commercial B2B | 3 500 | 80 | 2,1 min | Growth |
| Réception de déclarations de sinistres | 1 200 | 25 | 7 min | Growth |
| Recouvrement de créances (marché intermédiaire) | 18 000 | 300 | 1,8 min | Scale |
| Campagne électorale (ponctuelle) | 250 000 | 2 000 | 0,9 min | Pic entreprise |
| Campagne de renouvellement d'abonnements | 45 000/jour | 600 | 1,5 min | Scale |
Si vos chiffres prévisionnels se situent dans ces plages ou en dessous, la plateforme les gère sans problème. Au-delà de la première ligne, contactez le service commercial pour planifier la capacité.
Comment monter en charge en toute sécurité
Étape 1 — Pilote (1 à 50 appels/jour)
- Un seul Finn, un seul déploiement.
- Exécutez sur une version d'essai du forfait Starter ou Growth.
- Mesurez : taux de réussite, taux de complétion, coût par résultat.
Étape 2 — Mise en production (50 à 1 000 appels/jour)
- Même configuration de Finn ; ajoutez la supervision.
- Définissez des plafonds de dépenses par déploiement.
- Enregistrez l'identifiant d'appelant, configurez la suppression automatique.
Étape 3 — Montée en charge (1 000 à 10 000 appels/jour)
- Ajoutez un pool de numéros (5 à 15 numéros).
- Envisagez une segmentation multi-Finn (des Finn différents pour des segments d'audience différents).
- Configurez des alertes Slack en cas d'échec de déploiement.
- Passez au forfait Scale.
Étape 4 — Grande échelle (plus de 10 000 appels/jour)
- Déploiements parallèles.
- Pools de numéros plus larges (50+).
- Flux webhook pour l'analyse en temps réel dans vos propres systèmes.
- Forfait Enterprise avec CSM dédié et SLA.
Étape 5 — Échelle massive (100 000+ appels/jour)
- Infrastructure dédiée (Enterprise).
- Multi-région pour optimiser la latence.
- Limites de débit et intégrations personnalisées.
- Ligne directe avec l'ingénierie pour planifier les pics.
Questions fréquentes
Q : Quelle est la limite technique réelle d'appels simultanés ? R : Aucun chiffre publié. Nous avons testé en charge au-delà de 50 000 appels simultanés. En pratique, la limite que vous atteindrez sera celle de votre forfait ou de la taille de votre pool de numéros, pas la capacité de la plateforme.
Q : Si je dépasse la limite de mon forfait, la mise à niveau est-elle automatique ? R : Non — ce serait la garantie de factures surprises. La plateforme met les appels en file d'attente ou les rejette et affiche un avertissement. Vous effectuez la mise à niveau manuellement, quand vous êtes prêt.
Q : Les appels coûtent-ils plus cher aux heures de pointe ? R : Non. La tarification est forfaitaire à la minute, quel que soit le moment de l'appel.
Q : Puis-je faire tourner différents Finns à des volumes simultanés différents ? R : Oui. Chaque Finn a sa propre limite individuelle, et la limite globale du compte est partagée entre tous les Finns. Vous pouvez faire tourner un qualifieur à 100 appels simultanés et un standardiste à 20 sans aucun problème.
Q : À quelle vitesse puis-je monter en charge sur un nouveau déploiement ? R : La plupart des déploiements atteignent leur volume simultané cible en 2 à 5 minutes après le lancement. Les montées en charge très importantes (1 000+ appels simultanés en moins d'une minute) nécessitent une coordination préalable avec le support.
Suite
- Numéros de téléphone → Pools de numéros — comment configurer des pools pour passer à l'échelle.
- Facturation → — le coût de chaque niveau de forfait.
- Campagnes et déploiements → Déploiements parallèles — pour l'outbound à forte concurrence.
Was this page helpful?
Still stuck or have feedback?
Email [email protected] or use the chat bubble in the bottom-right corner — it's a Finn that knows the Academy cold.