Wissensdatenbank
Bringen Sie Ihrem Finn Ihr Unternehmen bei.
Die Wissensdatenbank ist der Ort, an dem Sie alles speichern, was Ihr Finn über Ihr Unternehmen wissen muss. Speisekarte, Preise, Öffnungszeiten, Richtlinien, FAQs — alles, wonach Anrufer fragen könnten. Wenn ein Anrufer eine Frage stellt, holt sich der Finn die Antwort von hier.
Machen Sie es sich nicht zu kompliziert. Die meisten Nutzer laden zunächst ein PDF hoch (ihre FAQ oder eine Produktbroschüre), und das reicht dem Finn bereits, um 80 % der Anruferfragen zu beantworten. Sie können jederzeit weitere Inhalte ergänzen.
Datenschutz: Alles, was Sie in die Wissensdatenbank einstellen, ist über jeden Anruf durchsuchbar, den dieser Finn bearbeitet. Legen Sie hier keine anruferbezogenen Daten ab (etwa Kontostände oder Bestellstatus) — nutzen Sie dafür einen Webhook für Live-Datenabfragen.
Wo konfigurieren
Create New Finn → Tab Knowledge Base. Später auch bearbeitbar über View All Finn → [Finn] → Edit → Knowledge Base.
Drei Quellen, ein Index
Sie können drei Arten von Quellmaterial beliebig kombinieren:
- Hochgeladene Dateien — PDF, DOCX, Markdown, reiner Text.
- Eingefügter Text — Inhalte direkt in den Editor kopieren.
- Website-Importe — Sie geben eine URL an, die Plattform crawlt und indexiert die Seiten.
Alle drei fließen in einen einzigen durchsuchbaren Index pro Finn. Zum Zeitpunkt des Anrufs weiß der Finn nicht (und es spielt keine Rolle), woher ein Textausschnitt stammt.
Hochgeladene Dateien
Unterstützte Formate
| Format | Hinweise |
|---|---|
| Am besten für Produkthandbücher, Richtliniendokumente, Broschüren | |
| DOCX | Vom Team gepflegtes, bearbeitbares Wissen |
| Markdown (.md) | Ideal für technische Dokumentation |
| Reiner Text (.txt) | Einfach und zuverlässig |
Grenzwerte
- Maximale Dateigröße: 25 MB pro Datei.
- Maximale Dateianzahl pro Finn: 100.
- Gesamter indexierter Umfang: 500 MB pro Finn (je nach Tarif).
Was indexiert wird
Die Plattform extrahiert Text, Tabellen und Überschriften. Bilder und rein gescannte PDFs (ohne eingebettete Textebene) werden übersprungen — führen Sie vorab extern eine OCR durch.
Best Practices
- Mehrere kleinere Dateien > ein riesiges PDF. Das Retrieval funktioniert bei fokussierten Dokumenten besser.
- Textbausteine entfernen — Kopf- und Fußzeilen sowie Seitenzahlen erzeugen Rauschen.
- Ein Thema pro Datei — so lässt sich leichter aktualisieren, ohne alles neu zu indexieren.
Eingefügter Text
Für schnelle Inhalte, für die sich keine eigene Datei lohnt. Grenzwerte: 100.000 Zeichen pro Einfügung, 10 Einfügungen pro Finn.
Verwenden Sie ihn für:
- FAQ-Ausschnitte.
- Kurze Produktbeschreibungen.
- Täglich wechselnde Daten (heutiger Aktionscode, aktuelle Wartezeiten) — für wirklich aktuelle Daten nutzen Sie jedoch eine Webhook-Aufgabe.
Website-Importe
URL angeben. Die Plattform crawlt die Website und indexiert die Seiten.
Konfiguration
| Option | Standard | Hinweise |
|---|---|---|
| Maximale Tiefe | 2 | Wie viele Linkebenen ausgehend vom Root verfolgt werden. |
| Maximale Seitenzahl | 100 | Hartes Limit unabhängig von der Tiefe. |
| Pfade einschließen | * | Glob-Muster für die Whitelist (z. B. /help/*). |
| Pfade ausschließen | /login*, /cart* | Glob-Muster für die Blacklist. |
| Häufigkeit des erneuten Crawlings | wöchentlich | Oder manuell. |
Was gut funktioniert
- Öffentliche Hilfecenter und FAQ-Seiten.
- Produktkataloge mit sauberem HTML.
- Statisch gerenderte Marketingseiten.
Was nicht funktioniert
- Websites, die einen Login erfordern.
- Aufwendige Single-Page-Apps, deren Inhalte nach dem Laden per JavaScript gerendert werden (stattdessen Datei-Upload nutzen).
- Websites, die Crawler per robots.txt blockieren (die Plattform beachtet sie).
So funktioniert das Retrieval zur Anrufzeit
Wenn der Anrufer eine Frage stellt:
- Der Finn bildet aus der Äußerung des Anrufers eine Suchanfrage.
- Die Plattform durchsucht den Index (hybrid aus Vektor- und Stichwortsuche).
- Die Top-N passenden Snippets werden in den LLM-Prompt eingefügt.
- Der Finn formuliert eine Antwort, die auf diesen Snippets basiert.
Was pro Anruf abgerufen wurde, lässt sich im Tab Data Extractor Sidebar → Knowledge einsehen. Nützlich, um zu klären: „Warum hat der Finn das gesagt?"
Retrieval optimieren
Wenn der Finn falsche oder unpassende Antworten gibt:
- Konkretere Inhalte hinzufügen. Wenn „Wie lautet Ihre Rückerstattungsrichtlinie?" vage Antworten liefert, eine eigene Datei zur Rückerstattungsrichtlinie ergänzen.
- Widersprüche entfernen. Zwei Dateien mit unterschiedlichen Aussagen stören das Retrieval. Prüfen und angleichen.
- Guardrails in der Begrüßungsnachricht schärfen. Dem Finn explizit sagen, was im Themenbereich liegt. „Du beantwortest nur Fragen zur Terminplanung. Alles andere an einen Menschen weiterleiten."
- Neu ranken. In Premium-Tarifen lässt sich die Priorität pro Quelle festlegen – neuere Dateien schlagen ältere.
Wann die Wissensdatenbank nicht geeignet ist
Manche Daten gehören nicht hierher:
- Anruferspezifische Daten (Kontostände, Bestellstatus) – per Webhook-Task live abrufen.
- Sensible Daten (Sozialversicherungsnummern, vollständige Kreditkartennummern) – niemals hier einfügen. Die Wissensdatenbank ist über alle Anrufe hinweg durchsuchbar.
- Stark veränderliche Inhalte (stündlich wechselnde Preise) – ebenfalls ein Fall für einen Webhook.
Die Wissensdatenbank ist für Hintergrundwissen gedacht, das für jeden Anrufer gleich ist. Alles Anruferspezifische oder Zeitkritische sollte live abgerufen werden.
Neuindizierung
Die Plattform indiziert neu:
- Automatisch – wenn Sie eine Quelle hinzufügen, entfernen oder bearbeiten.
- Nach Zeitplan – bei Website-Importen gemäß der Crawl-Frequenz.
- Manuell – Wissensdatenbank → Jetzt neu indizieren. Erzwingt einen vollständigen Neuaufbau.
Die Neuindizierung dauert in der Regel Sekunden (kleine Wissensdatenbanken) bis wenige Minuten (500 MB).
Kosten
Speicher und Abfragen der Wissensdatenbank sind bis zu den oben genannten Größenbeschränkungen im Tarif enthalten. Bei Überschreitung ist ein Tarif-Upgrade erforderlich – siehe Abrechnung →.
Weiter
- Workflows → – wenn freie Abfragen nicht strukturiert genug sind.
- Integrationen → – Live-Datenabfragen per Webhook.
Was this page helpful?
Still stuck or have feedback?
Email [email protected] or use the chat bubble in the bottom-right corner — it's a Finn that knows the Academy cold.