音声認識のモデルの使用
音声認識要求の model パラメーターを使用して、その要求で使用されるモデルを示します。 パラメータで、大規模音声モデル、前世代モデル、次世代モデルを指定することができます。
音声認識に使用可能なモデルについて詳しくは、以下を参照してください。
前世代モデルの指定の例
以下の HTTP 要求の例では、音声認識に前世代モデル (en-US_NarrowbandModel) を使用しています。
IBM Cloud
curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"
IBM Cloud Pak for Data IBM Software Hub
curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"
次世代モデルの指定の例
以下の HTTP 要求の例では、音声認識に次世代モデル (en-US_Telephony) を使用しています。
IBM Cloud
curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"
IBM Cloud Pak for Data IBM Software Hub
curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"
大規模な音声モデルの例を指定します
次の例では、 HTTP リクエストは音声認識に大規模音声モデル en-US を使用しています
IBM Cloud
curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"
IBM Cloud Pak for Data IBM Software Hub
curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"
デフォルト・モデルの使用
音声認識要求からmodelパラメーターを省略すると、サービスはデフォルトで米国英語en-US_BroadbandModelを使用します。 このデフォルトは、すべての音声認識要求に適用されます。
IBM Cloud Pak for DataIBM Software Hub en-US_BroadbandModel をインストールしないと、デフォルトモデルとして機能しません。 この場合、以下のいずれかを行う必要があります。
modelパラメーターを使用して、各要求で使用するモデルを渡します。- Speech サービス・カスタム・リソースの
defaultSTTModelプロパティーを使用して、Speech to Text for IBM Cloud Pak for Data のインストール済み環境に新しいデフォルト・モデルを指定します。 詳しくは、 Watson Speech to Textを参照してください。