Eine Stimme, die denkt.
Im Takt eines Herzschlags.
Latenz unter einer Sekunde. 47 Sprachen. Funktionsaufrufe, RAG und Echtzeit-Spracherkennung – das Substrat, auf dem jeder Finn-Agent läuft.
Kernfähigkeiten
Fünf Grundelemente.
Jedes Gespräch darauf aufgebaut.
Die Modellebene ist Massenware. Die Infrastruktur drumherum nicht – und genau da verdient sich Finn den Anruf.
Voice-Loop in unter einer Sekunde
Streaming-ASR + LLM + TTS in einer einzigen heißen Pipeline. Keine Verzögerung von Runde zu Runde. Kunden hören eine menschliche Kadenz, keinen Roboter.
Funktionsaufrufe, im Anruf
Ziehen Sie aus Ihrem CRM, feuern Sie Webhooks, führen Sie Geschäftslogik mitten im Gespräch aus. Der Agent sagt nie 'Einen Moment bitte.'
Standardmäßig mehrsprachig
Sprache mitten im Anruf wechseln. Hindi zu Englisch zu Tamil – derselbe Agent, dieselbe Stimm-Persona, derselbe Kontext.
Wissensdatenbank + RAG
Laden Sie PDFs, Sitemaps, FAQs hoch. Finn verankert jede Antwort in Ihren Daten. Keine erfundenen SLAs.
Stimmbibliothek
100+ Stimmen über Akzente und Sprachen hinweg. Klonen Sie Ihre eigene Markenstimme in unter einer Minute.
Echtzeit-Spracherkennung
Unterbrechungsbehandlung, Stilleerkennung, Voicemail-Unterscheidung – von Haus aus dabei, nicht angeschraubt.
der Voice-Loop
Streaming-ASR, -LLM und -TTS in einer einzigen heißen Leitung.
Die meisten Stacks verketten Anbieter in Reihe und zahlen bei jedem Sprung die Latenzsteuer. Finn führt Streaming-Speech-to-Text, Modellinferenz und Text-to-Speech in einer verschmolzenen Pipeline aus – unter 400 ms von Ende zu Ende. Kunden hören eine echte Kadenz, kein Stop-and-Wait.
- Streaming-ASR über Deepgram, AssemblyAI oder hauseigen
- GPT-4o, Claude, Gemini oder selbst gehostetes Llama unter der Haube
- ElevenLabs, PlayHT, Cartesia und 100+ Stimmen bereit
- Unterbrechungsbehandlung + Voicemail-Erkennung von Haus aus
Wissen, im Anruf
Fundierte Antworten. Keine erfundenen SLAs.
Laden Sie PDFs, Sitemaps, FAQs, interne Dokumente hoch. Finn bettet ein, zerlegt in Chunks und ruft in jeder Runde die richtige Passage ab. Quellenangaben werden für die menschliche Prüfung an jede Antwort angehängt.
- PDFs, URLs, Notion, Confluence – derselbe Import-Flow
- Wissensdatenbanken pro Finn, pro Workspace isoliert
- Automatische Neu-Indexierung bei Dokumentänderung, keine manuellen Neuaufbauten
- Quellenlink-Attribution in der PCA zutage gefördert
Stimmen und Sprachen
47 Sprachen. 100+ Stimmen. Mitten im Anruf wechseln.
Mehrsprachigkeit ist kein Feature – sie ist der Standard. Wählen Sie eine Stimme, wählen Sie eine Sprache, rollen Sie in jede Region aus. Klonen Sie Ihre eigene Markenstimme in unter einer Minute.
- Hindi, Tamil, Spanisch, Portugiesisch, Arabisch – und 40+ mehr
- Markenstimmen-Klonen aus einer 60-Sekunden-Probe
- Sprachwechsel mitten im Gespräch, dieselbe Persona
- Stimm-Vorschaubibliothek, akzent-getaggt und geschlechterausgewogen
Unter der Haube
Für die echte Welt gebaut.
Nicht für die Demo.
Jede Komponente oben wird an Produktions-Traffic gemessen – 50 Mio.+ ausgelieferte Minuten, 250+ gleichzeitige Anrufe zu Spitzenzeiten, Kunden auf fünf Kontinenten.
Audited + compliant
Mehr Plattform