Skip to main content

音声技術

自動音声認識ASR

別名: 音声認識(speech recognition)

自動音声認識(ASR)とは、話し言葉をテキストに変換する技術です。ASRと音声認識(STT)は同じ機能を指します——ASRは学術・工学用語、STTは製品用語です。

ASRの品質は単語誤り率(WER)で測定されます。音声エージェントでは、バッチ処理の精度よりも、ストリーミングASR(相手が話すそばから逐次書き起こす方式)が重要です。素早いターンの受け渡しを可能にするからです。

自動音声認識を実際の通話で見る。

30分のデモを予約して、Finnがインバウンドとアウトバウンドの通話を最初から最後まで処理する様子をご覧ください——組み立てるべきスタックは不要です。