AmiVoice APIで不要語（フィラー）を表示するか除去するか選ぶ方法

AmiVoiceAPIには不要語（フィラー）を自動的に除去する機能があります。しかし音声認識を使う場面によってはフィラーを除去せず表示した方がいいこともあります。今回はフィラーの除去を制御するやり方について解説します。

ステレオ音声ファイルをモノラル音声ファイル×2に変換するやり方

AmiVoice APIはステレオの音声ファイルを音声認識させると片方のチャネルしか認識されない仕様になっています。ステレオ音声ファイルの右チャンネルと左チャンネルに異なる音が入っている場合を想定して、今回はSoXというツールを使ったステレオ音声ファイル…

音声認識処理した音声をどのように管理しているか、個人情報などが入っている音声データの場合どのプランを選んだらいいのかなど、AmiVoice APIを検討されるお客様からよく頂くセキュリティに関する質問にお答えします。

2022年の9月にOpenAIからWhisperという音声認識エンジンが公開されました。このWhisperとAmiVoiceの音声認識精度を比較してみました。

どのように音声を文字にするのか音声認識の仕組みや種類、それぞれの特長や適切なエンジンの選び方を、音声認識の研究に携わっているエンジニアがざっくりと、かつ分かりやすく解説します。

誤認識を防ぎ、認識率を上げるためには、音声認識に適したマイクを選ぶことが大切です。マイクの選び方や利用方法、発話のポイントについてご紹介します。

コンタクトセンターで音声認識を活用し、通話を自動で文字化する仕組みをご紹介します。SIPプロトコルを利用して通話の音声を取得する方法です。