音声認識(STT)の統合

音声認識(STT)連携により、コンタクトセンターでは音声テキスト変換機能を使用して音声コールを文字起こしし、その文字起こし内容を対話レコードに保存することができます。全文のトランスクリプトは検索可能であり、(自然言語理解が有効になっている場合は)sentiment属性も含まれます。
Bright Patternは、IBM WatsonやGoogleなどのSTTプロバイダーと連携しています。
Googleの同期型プロパティ
GoogleのCloud Speech APIは、音声をテキストに変換します。同期型STTは1件の録音に限定されるため、 対話型IVR に最適です。コールの文字起こしを行うには、以下の「ストリーミングSTT」をご参照ください。「プロパティ」ダイアログで、Google同期STTインスタンスの認証情報を次のように入力してください。これにより、Bright PatternがSTTリソースにアクセスし、インタラクションで使用できるようになります。
| Google STT では、アカウントに支払い方法を添付する必要があります。これが設定されていない場合、STT サービスは動作しなくなりますが、Google API ダッシュボードにエラーが表示されることはありません。 | ||
- 名前
- この連携アカウントの一意の名前(任意)
- タイプ
- アカウント追加時にこのタイプを選択したため、既定では「Google 同期型 STT」となります。
- 拡張モードを使用
- 拡張モードを使用を有効にすると、電話通話向けの Cloud Speech API の 拡張モデル を使用できるようになります。この設定により、対話型IVRのシナリオにおける音声コールのトランスクリプトがより正確に作成されます。拡張モードは、Google Speech-to-Textの初期化時に有効になります。
- URL
- 既定では、https://speech.googleapis.com/v1/
- API キー
Google の Cloud Speech API の認証に使用されるサービス キー id です。これは、サービス アカウントの認証情報を受け取った際に生成されます。
- 接続テスト
- クリックして、Bright Pattern Contact Center が Google 同期型 STT アカウントに接続できることを確認してください。
Google ストリーミングのプロパティ
Google ストリーミング音声テキスト変換は、 対話型IVR とコールの文字起こしの両方に使用できます。 [プロパティ] ダイアログで、Google ストリーミング STT インスタンスの認証情報を次のように入力してください。これにより、Bright Pattern が STT リソースにアクセスし、対話でそれを使用できるようになります。
- 名前
- この連携アカウントの一意の名前(任意)
- タイプ
- アカウント追加時にこのタイプを選択したため、既定では「Google ストリーミング STT」となります。
- 認証情報
- アップロードリンクをクリックして、認証情報をアップロードしてください。
- 既定のアカウント
- チェックボックスを選択して、アカウントを既定のアカウントとして設定します。既定のアカウントとして設定できる Streaming STT は 1 つだけです。文字起こしオプションが有効になっているサービスは、この既定のアカウントによって文字起こしされます。
- 接続テスト
- クリックして、Bright Pattern Contact Center が Google Streaming STT アカウントに接続できることを確認してください。
Watsonのプロパティ
[プロパティ] ダイアログで、IBM Watson STT インスタンスの認証情報を次のように入力してください。これにより、Bright Pattern が STT リソースにアクセスし、インタラクションで使用できるようになります。
- 名前
- この統合アカウントの名前です。
- タイプ
- アカウント追加時にこのタイプを選択したため、既定では「Watson」となります。
- URL
- WebSocket プレフィックス + IBM Speech to Text の URL を、以下のフォーマットで指定してください:
- 例:
- wss://api.us-south.speech-to-text.watson.cloud.ibm.com/instances/1a23456f-121d-4c52-bc06-62168f5a18de
- この URL は、IBM Speech to Text サービスの認証情報に記載されています。STT 統合ではセキュアな WebSocket プロトコル(つまり「wss」)が使用されるため、wss:// というプレフィックスのみが許可されますのでご注意ください。
- 音声検出器の感度
- この設定の範囲は 0.0 から 1.0 です。0.0 に設定するとすべての音声が抑制され、1.0 に設定すると音声が抑制されません。咳や音楽などの音声以外のイベントはフィルタリングされます。
- 背景音声の抑制
- この設定の範囲は 0.0 から 1.0 です。0.0 の場合は背景音声の抑制が行われず、1.0 の場合はすべての背景音声が抑制されます。音量レベルは、背景ノイズと音声を区別するために使用されます。
- カスタム言語モデル
- この設定では、IBM Watson でモデルを作成・トレーニングした後、Speech to Text(STT)連携にカスタム言語モデルを設定できます。このフィールドにカスタマイズIDを入力して、カスタム言語モデルを設定してください。文字起こし担当者が別のカスタム言語モデルを使用する場合、システムもモデルを切り替えます。
- デフォルトアカウント
- 「デフォルトアカウント」チェックボックスを選択して、STT連携アカウントを有効にしてください。