Utilisation d'un modèle pour la reconnaissance vocale

On utilise le paramètre model d'une demande de reconnaissance vocale pour indiquer le modèle à utiliser avec la demande. Vous pouvez spécifier un modèle de discours large, un modèle de génération précédente ou suivante avec le paramètre.

Pour plus d'informations sur les modèles disponibles pour la reconnaissance vocale, voir

Spécifier un exemple de modèle de génération antérieure

L'exemple suivant de requête HTTP utilise le modèle de génération antérieure en-US_NarrowbandModel pour la reconnaissance vocale :

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"

Spécifier un exemple de modèle de nouvelle génération

L'exemple suivant de requête HTTP utilise le modèle de nouvelle génération en-US_Telephony pour la reconnaissance vocale :

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"

Exemple de spécification d'un modèle vocal de grande taille

L'exemple de requête d' HTTP s suivant utilise le modèle de synthèse vocale large en-US pour la reconnaissance vocale :

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"

Utilisation du modèle par défaut

Si vous omettez le paramètre model dans une demande de reconnaissance vocale, le service utilise par défaut le modèle en-US_BroadbandModel anglais américain. Cette valeur par défaut s'applique à toutes les demandes de reconnaissance vocale.

IBM Cloud Pak for Data Software Hub IBM Si vous n'installez pas le en-US_BroadbandModel, il ne peut pas servir de modèle par défaut. Dans ce cas, vous devez

  • Utiliser le paramètre model pour transmettre le modèle à utiliser avec chaque demande.
  • Spécifier un nouveau modèle par défaut pour votre installation de Speech to Text for IBM Cloud Pak for Data en utilisant la propriété defaultSTTModel de la ressource personnalisée des services Speech. Pour plus d'informations, voir Installation de Watson Speech to Text.