音声認識のモデルの使用

音声認識要求の model パラメーターを使用して、その要求で使用されるモデルを示します。 パラメータで、大規模音声モデル、前世代モデル、次世代モデルを指定することができます。

音声認識に使用可能なモデルについて詳しくは、以下を参照してください。

前世代モデルの指定の例

以下の HTTP 要求の例では、音声認識に前世代モデル (en-US_NarrowbandModel) を使用しています。

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"

次世代モデルの指定の例

以下の HTTP 要求の例では、音声認識に次世代モデル (en-US_Telephony) を使用しています。

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"

大規模な音声モデルの例を指定します

次の例では、 HTTP リクエストは音声認識に大規模音声モデル en-US を使用しています

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"

デフォルト・モデルの使用

音声認識要求からmodelパラメーターを省略すると、サービスはデフォルトで米国英語en-US_BroadbandModelを使用します。 このデフォルトは、すべての音声認識要求に適用されます。

IBM Cloud Pak for DataIBM Software Hub en-US_BroadbandModel をインストールしないと、デフォルトモデルとして機能しません。 この場合、以下のいずれかを行う必要があります。

  • modelパラメーターを使用して、各要求で使用するモデルを渡します。
  • Speech サービス・カスタム・リソースのdefaultSTTModelプロパティーを使用して、Speech to Text for IBM Cloud Pak for Data のインストール済み環境に新しいデフォルト・モデルを指定します。 詳しくは、 Watson Speech to Textを参照してください。