Skip to main content
音声インテリジェンス

考える音声。鼓動の速さで。

1秒未満のレイテンシ。46の言語。関数呼び出し、RAG、リアルタイムの音声検知 — すべてのFinnエージェントが動く基盤です。

Book a demo
<400msエンドツーエンドのレイテンシ
46本日稼働中の言語
99.99%推論の稼働率
同時通話

コア機能

5つのプリミティブ。すべての会話がその上に構築される。

モデルレイヤーはコモディティです。その周りのインフラはそうではありません — そしてそここそがFinnが通話を勝ち取る場所です。

01

1秒未満の音声ループ

ストリーミングASR+LLM+TTSを単一のホットパイプラインで。ターンごとの遅延はありません。顧客にはロボットではなく、人間のリズムが聞こえます。

02

通話中の関数呼び出し

あなたのCRMから取得し、Webhookを発火し、会話の途中でビジネスロジックを実行。エージェントが「少々お待ちください」と言うことはありません。

03

既定で多言語

通話中に言語を切り替え。ヒンディー語から英語、タミル語へ — 同じエージェント、同じ音声ペルソナ、同じ文脈。

04

ナレッジベース+RAG

PDF、サイトマップ、FAQをアップロード。Finnがすべての回答をあなたのデータに基づかせます。ハルシネーションによるSLAはありません。

05

音声ライブラリ

アクセントと言語にわたる100以上の音声。あなた自身のブランドボイスを1分未満でクローンできます。

06

リアルタイムの音声検知

割り込みの処理、沈黙の検知、ボイスメールの判別 — 後付けではなく、組み込みです。

音声ループ

ストリーミングASR、LLM、TTSを単一のホットパイプで。

ほとんどのスタックはプロバイダーを直列につなぎ、すべてのホップでレイテンシの税金を払います。Finnはストリーミングの音声認識、モデル推論、音声合成を1つの融合したパイプラインで実行 — エンドツーエンドで400ミリ秒未満です。顧客には停止して待つのではなく、本物のリズムが聞こえます。

  • Deepgram、AssemblyAI、または自社製経由のストリーミングASR
  • GPT-4o、Claude、Gemini、またはセルフホストのLlamaが内部で稼働
  • ElevenLabs、PlayHT、Cartesia、および100以上の音声が利用可能
  • 割り込みの処理+ボイスメール検知を標準搭載

通話中のナレッジ

根拠のある回答。ハルシネーションによるSLAはなし。

PDF、サイトマップ、FAQ、社内ドキュメントをアップロード。Finnが埋め込み、チャンク化し、毎ターン適切な一節を取得します。人間のレビューのために、すべての回答に出典の引用が付きます。

  • PDF、URL、Notion、Confluence — 同じインポートフロー
  • Finnごとのナレッジベース、ワークスペースごとに分離
  • ドキュメントの変更時に自動再インデックス、手動の再構築なし
  • 出典リンクのアトリビューションをPCAで表示

音声と言語

46の言語。100以上の音声。通話中に切り替え。

多言語は機能ではありません — 既定です。音声を選び、言語を選び、任意のリージョンへ配信。あなた自身のブランドボイスを1分未満でクローンできます。

  • ヒンディー語、タミル語、スペイン語、ポルトガル語、アラビア語 — そしてさらに40以上
  • 60秒のサンプルからブランドボイスをクローン
  • 会話の途中で言語を切り替え、同じペルソナ
  • 音声プレビューライブラリ、アクセントのタグ付き、性別バランス済み

内部の仕組み

実世界のために構築。デモのためではなく。

上記のすべてのコンポーネントは本番トラフィックでベンチマークされています — 5,000万分以上を配信、ピーク時250以上の同時通話、5大陸にわたる顧客。

Book a demo30-min trial · No card

Audited + compliant

SOC 2 Type IIHIPAA BAAGDPRISO 27001DPDPNIST CSF