コア機能
5つのプリミティブ。
すべての会話がその上に構築される。
モデルレイヤーはコモディティです。その周りのインフラはそうではありません — そしてそここそがFinnが通話を勝ち取る場所です。
1秒未満の音声ループ
ストリーミングASR+LLM+TTSを単一のホットパイプラインで。ターンごとの遅延はありません。顧客にはロボットではなく、人間のリズムが聞こえます。
通話中の関数呼び出し
あなたのCRMから取得し、Webhookを発火し、会話の途中でビジネスロジックを実行。エージェントが「少々お待ちください」と言うことはありません。
既定で多言語
通話中に言語を切り替え。ヒンディー語から英語、タミル語へ — 同じエージェント、同じ音声ペルソナ、同じ文脈。
ナレッジベース+RAG
PDF、サイトマップ、FAQをアップロード。Finnがすべての回答をあなたのデータに基づかせます。ハルシネーションによるSLAはありません。
音声ライブラリ
アクセントと言語にわたる100以上の音声。あなた自身のブランドボイスを1分未満でクローンできます。
リアルタイムの音声検知
割り込みの処理、沈黙の検知、ボイスメールの判別 — 後付けではなく、組み込みです。
音声ループ
ストリーミングASR、LLM、TTSを単一のホットパイプで。
ほとんどのスタックはプロバイダーを直列につなぎ、すべてのホップでレイテンシの税金を払います。Finnはストリーミングの音声認識、モデル推論、音声合成を1つの融合したパイプラインで実行 — エンドツーエンドで400ミリ秒未満です。顧客には停止して待つのではなく、本物のリズムが聞こえます。
- Deepgram、AssemblyAI、または自社製経由のストリーミングASR
- GPT-4o、Claude、Gemini、またはセルフホストのLlamaが内部で稼働
- ElevenLabs、PlayHT、Cartesia、および100以上の音声が利用可能
- 割り込みの処理+ボイスメール検知を標準搭載
通話中のナレッジ
根拠のある回答。ハルシネーションによるSLAはなし。
PDF、サイトマップ、FAQ、社内ドキュメントをアップロード。Finnが埋め込み、チャンク化し、毎ターン適切な一節を取得します。人間のレビューのために、すべての回答に出典の引用が付きます。
- PDF、URL、Notion、Confluence — 同じインポートフロー
- Finnごとのナレッジベース、ワークスペースごとに分離
- ドキュメントの変更時に自動再インデックス、手動の再構築なし
- 出典リンクのアトリビューションをPCAで表示
音声と言語
46の言語。100以上の音声。通話中に切り替え。
多言語は機能ではありません — 既定です。音声を選び、言語を選び、任意のリージョンへ配信。あなた自身のブランドボイスを1分未満でクローンできます。
- ヒンディー語、タミル語、スペイン語、ポルトガル語、アラビア語 — そしてさらに40以上
- 60秒のサンプルからブランドボイスをクローン
- 会話の途中で言語を切り替え、同じペルソナ
- 音声プレビューライブラリ、アクセントのタグ付き、性別バランス済み
内部の仕組み
実世界のために構築。
デモのためではなく。
上記のすべてのコンポーネントは本番トラフィックでベンチマークされています — 5,000万分以上を配信、ピーク時250以上の同時通話、5大陸にわたる顧客。
Audited + compliant