Base de connaissances
Apprenez à votre Finn tout sur votre entreprise.
La base de connaissances est l'endroit où vous stockez tout ce que votre Finn doit savoir sur votre entreprise. Menu, tarifs, horaires, politiques, FAQ — tout ce que les appelants pourraient demander. Lorsqu'un appelant pose une question, le Finn y puise la réponse.
Ne compliquez pas. La plupart des utilisateurs commencent par téléverser un seul PDF (leur FAQ ou une brochure produit), et cela suffit au Finn pour traiter 80 % des questions des appelants. Vous pourrez toujours en ajouter par la suite.
Confidentialité : tout ce que vous placez dans la base de connaissances est consultable lors de chaque appel traité par ce Finn. N'y mettez pas de données propres à un appelant (solde de compte, statut de commande) — utilisez plutôt un webhook de consultation de données en direct.
Où configurer
Create New Finn → onglet Knowledge Base. Modifiable ensuite via View All Finn → [Finn] → Edit → Knowledge Base.
Trois sources, un seul index
Vous pouvez combiner trois types de contenu source :
- Fichiers téléversés — PDF, DOCX, Markdown, texte brut.
- Texte collé — copiez-collez le contenu directement dans l'éditeur.
- Imports de sites web — fournissez une URL, la plateforme explore et indexe les pages.
Les trois alimentent un index unique consultable par Finn. Au moment de l'appel, le Finn ne sait pas (et n'a pas besoin de savoir) d'où provient un extrait.
Fichiers téléversés
Formats pris en charge
| Format | Remarques |
|---|---|
| Idéal pour les manuels produit, documents de politique, brochures | |
| DOCX | Connaissances modifiables tenues à jour par l'équipe |
| Markdown (.md) | Parfait pour la documentation technique |
| Texte brut (.txt) | Simple et fiable |
Limites
- Taille maximale : 25 Mo par fichier.
- Nombre maximal de fichiers par Finn : 100.
- Taille indexée totale : 500 Mo par Finn (variable selon le forfait).
Ce qui est indexé
La plateforme extrait le texte, les tableaux et les titres. Les images et les PDF issus d'une numérisation seule (sans couche de texte intégrée) sont ignorés — passez-les d'abord par un OCR externe.
Bonnes pratiques
- Plusieurs fichiers courts valent mieux qu'un seul PDF volumineux. Le système de recherche est plus performant sur des documents ciblés.
- Supprimez le superflu — en-têtes, pieds de page et numéros de page ajoutent du bruit.
- Un sujet par fichier — plus facile à mettre à jour sans tout réindexer.
Texte collé
Pour du contenu rapide qui ne mérite pas un fichier. Limites : 100 000 caractères par collage, 10 collages par Finn.
À utiliser pour :
- Des extraits de FAQ.
- De courtes descriptions de produits.
- Des données changeant chaque jour (code promo du jour, temps d'attente actuels) — même si, pour des données vraiment en direct, mieux vaut une tâche Webhook.
Imports de sites web
Indiquez une URL. La plateforme explore le site et indexe les pages.
Configuration
| Option | Par défaut | Remarques |
|---|---|---|
| Profondeur max | 2 | Nombre de niveaux de liens à suivre depuis la racine. |
| Pages max | 100 | Plafond strict, quelle que soit la profondeur. |
| Chemins inclus | * | Glob de liste blanche (par ex. /help/*). |
| Chemins exclus | /login*, /cart* | Glob de liste noire. |
| Fréquence de réexploration | hebdomadaire | Ou manuelle. |
Ce qui fonctionne bien
- Centres d'aide publics et pages FAQ.
- Catalogues produits au HTML propre.
- Pages marketing rendues en statique.
Ce qui ne fonctionne pas
- Sites nécessitant une connexion.
- Applications monopage lourdes dont le contenu est rendu en JS après le chargement de la page (utilisez plutôt l'import de fichiers).
- Sites qui bloquent les robots via robots.txt (la plateforme le respecte).
Fonctionnement de la recherche pendant l'appel
Lorsque l'appelant pose une question :
- Le Finn formule une requête à partir de l'énoncé de l'appelant.
- La plateforme interroge l'index (hybride vectoriel + mots-clés).
- Les N meilleurs extraits correspondants sont injectés dans le prompt du LLM.
- Le Finn produit une réponse fondée sur ces extraits.
Vous pouvez inspecter ce qui a été récupéré pour chaque appel dans l'onglet Data Extractor Sidebar → Knowledge. Utile pour comprendre « pourquoi le Finn a-t-il dit cela ? »
Réglage de la recherche
Si le Finn donne des réponses erronées ou hors sujet :
- Ajoutez du contenu plus précis. Si « quelle est votre politique de remboursement ? » renvoie des réponses vagues, ajoutez un fichier dédié à la politique de remboursement.
- Supprimez les contradictions. Deux fichiers qui se contredisent perturbent la recherche. Auditez et harmonisez.
- Renforcez les garde-fous du message d'accueil. Indiquez explicitement au Finn ce qui relève de son périmètre. « Vous répondez uniquement aux questions de planification. Pour tout le reste, transférez à un humain. »
- Reclassement. Les plans Premium permettent de définir une priorité par source : les fichiers récents prévalent sur les anciens.
Quand ne pas utiliser la base de connaissances
Certaines données n'ont pas leur place ici :
- Données propres à l'appelant (soldes de compte, statut de commande) — utilisez une tâche Webhook pour les consulter en direct.
- Données sensibles (numéros de sécurité sociale, numéros de carte bancaire complets) — ne les collez jamais ici. La base de connaissances est consultable sur tous les appels.
- Contenu très dynamique (tarifs qui changent toutes les heures) — également une tâche webhook.
La base de connaissances sert au contexte général identique pour tous les appelants. Tout ce qui est propre à l'appelant ou sensible au temps doit faire l'objet d'une consultation en direct.
Réindexation
La plateforme réindexe :
- Automatiquement — lorsque vous ajoutez, supprimez ou modifiez une source.
- Selon un calendrier — pour les imports de sites web, selon la fréquence de re-crawl.
- Manuellement — Base de connaissances → Réindexer maintenant. Force une reconstruction complète.
La réindexation prend généralement quelques secondes (petites bases) à quelques minutes (500 Mo).
Coût
Le stockage et les requêtes de la base de connaissances sont inclus dans votre plan jusqu'aux limites de taille ci-dessus. Au-delà, une mise à niveau du plan est nécessaire — voir Facturation →.
Étapes suivantes
- Workflows → — quand la recherche libre n'est pas assez structurée.
- Intégrations → — consultations de données en direct via webhooks.
Was this page helpful?
Still stuck or have feedback?
Email [email protected] or use the chat bubble in the bottom-right corner — it's a Finn that knows the Academy cold.