Skip to main content

Stimme & Sprecherwechsel

Finn unterbrechen.Finn gibt nach.

Natürlicher Sprecherwechsel – wenn der Anrufer Finn ins Wort fällt, stoppt Finn mitten im Wort. Kein Durcheinanderreden. Keine peinlichen Pausen.

Book a demo

30-minütige kostenlose Testphase. Keine Karte. Keine Beschaffung.

<80 msNachgeb-Latenz
NatürlichÜbergabe mitten im Wort
Ohne AbschneidenNimmt sauber wieder auf
Pro RundeJustierbare Schwellen

So funktioniert's

Zuhören, selbstwährend des Sprechens.

Ziehen, verbinden, ausrollen. Jeder Schritt ist umkehrbar, jedes Speichern erzeugt eine Version.

01 / 03

Bidirektionaler Audio-Stream

Finns Mikrofon bleibt während der Synthese offen. Die VAD erkennt die Stimme des Anrufers, sobald er zu sprechen beginnt.

Auswertung der AusrollungenSprachschleife unter einer SekundeIn Ordnung

p50

384ms

p95

412ms

p99

538ms

ASRDeepgram Nova 2 streaming
84ms
LLMGPT-4o function-calling pass
192ms
TTSElevenLabs streaming synthesis
96ms
Last 24h · 12,840 calls384ms avg
02 / 03

Mitten im Wort nachgeben

Unter 80 ms von der erkannten Stimme bis zum TTS-Stopp. Keine Kollisionen mitten im Satz.

Auswertung der AusrollungenSprachschleife unter einer SekundeIn Ordnung

p50

384ms

p95

412ms

p99

538ms

ASRDeepgram Nova 2 streaming
84ms
LLMGPT-4o function-calling pass
192ms
TTSElevenLabs streaming synthesis
96ms
Last 24h · 12,840 calls384ms avg
03 / 03

Kontextbewusst wieder aufnehmen

Erkennt die Unterbrechung an, verarbeitet, was der Anrufer gesagt hat, und nimmt den richtigen Faden wieder auf. Kein 'Wie ich schon sagte.'

OrchestrierungAblauf mit mehreren AgentenLive
V
01

Vorsortierung

Verteiler für Eingehendes

DONE
B
02

Buchung

Fachkraft Terminplanung

ACTIVE
B
03

Bestätigen

SMS follow-up

QUEUED

Shared context · call IN-44219

caller.name      = "Aarav Singh"
caller.intent    = "follow-up booking"
captured.slot    = "Tue 14:00"
captured.doctor  = "DR. Patel"
captured.insurer = "BCBS"

Liest sich wie ein echtes Gespräch

Der Anrufer führt.Finn folgt.

Keine Zusatzmodule. Keine zweite Plattform. Jede Grundfunktion kommt mit dem Editor.

Nachgeben in unter 80 ms

Schneller als die menschliche Reaktionszeit. Finn gibt das Wort ab, bevor der Anrufer merkt, dass er dazwischenredet.

Sauberes Wiederaufnehmen

Verfolgt, was gesagt wurde + was abgeschnitten wurde. Erkennt an + passt sich an. Kein roboterhaftes 'Einen Moment bitte.'

Justierbare Barge-in-Schwelle

VAD-Empfindlichkeit pro Workflow. Leiser Anrufer in einem ruhigen Raum vs. geschäftiges Callcenter – beides funktioniert.

Resistent gegen Fehlalarme

Darauf trainiert, die Stimme des Anrufers von Umgebungsgeräuschen, Musik, Übersprechen zu unterscheiden. Finn gibt nicht bei einem Niesen nach.

Im Produktivbetrieb

Echte Teams, echte Ergebnisse.

TOFA startete mit Finn eine landesweite Kampagne — über 10.000 Anrufe täglich und reibungslose Übergaben an Menschen.
Alice Smith

Alice Smith

Senior Engineer, Gofts · TOFA

Vertrauen und Ökosystem

Fügt sich ein. Besteht Audits.

Verbindet sich über mehr als 100 Konnektoren mit Ihrem bestehenden Stack. Ab dem ersten Tag regelkonform bei den Workloads, die es verlangen.

Twilio logoTwilioPlivo logoPlivoElevenLabsOpenAIMicrosoft Teams logoMicrosoft Teams

Don't see yours? Finn plugs into any system via REST + webhooks.

AuditedSOC 2 Type IIHIPAA BAAGDPRISO 27001DPDPNIST CSF

FAQ

Fragen und Antworten.

Wie hoch ist die technische Latenz beim Barge-in?+

Unter 80 ms vom erkannten Stimmeinsatz bis zum TTS-Halt. Schneller, als der Anrufer seine eigene Unterbrechung wahrnehmen kann.

Wie geht Finn mit dem Inhalt der Unterbrechung um?+

Erfasst, was der Anrufer gesagt hat, verarbeitet es gegen den Gesprächskontext und antwortet passend – Entschuldigung, Klärung, Verzweigung zu einem neuen Thema, was auch immer passt.

Kann ich die Empfindlichkeit pro Workflow justieren?+

Ja. Ruhige eingehende Support-Anrufe verwenden eine niedrige Schwelle. Lautes Outbound zu Mobilnutzern verwendet eine höhere Schwelle, um Umgebungsgeräusche zu ignorieren.

Was ist mit Übersprechen bei schlechten Verbindungen?+

Echounterdrückung + Klassifizierung der Anruferstimme filtern Übersprechen + Leitungsrauschen. Finn gibt nicht bei seiner eigenen, zurückgeworfenen Stimme nach.

Funktioniert das über alle Telefonieanbieter hinweg?+

Ja – Twilio, Plivo, BYOC-SIP-Trunk. Erfordert bidirektionales Streaming-Audio, das alle großen Anbieter unterstützen.

Konversation, kein Monolog

Gibt nach wie ein Mensch.Nicht wie ein Kiosk.

Echtzeit-Barge-in-Erkennung – Finn gibt das Wort ab, sobald der Anrufer spricht. Kein 'Drücken Sie 1, um zu unterbrechen' mehr.

Book a demo30-Min-Test · Keine Karte