음성 인식에 모델 사용

음성 인식 요청에 사용할 모델은 요청의 model 매개변수를 사용하여 표시합니다. 파라미터를 사용하여 대규모 음성 모델, 이전 또는 차세대 모델을 지정할 수 있습니다.

음성 인식에 사용할 수 있는 모델에 대한 자세한 정보는 다음 항목을 참조하십시오.

이전 세대 모델 지정 예

다음 HTTP 요청 예는 음성 인식에 이전 세대 모델 en-US_NarrowbandModel을(를) 사용합니다.

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"

차세대 모델 지정 예

다음 HTTP 요청 예는 음성 인식에 차세대 en-US_Telephony 모델을 사용합니다.

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"

대형 음성 모델 예제 지정

다음 예제 HTTP 요청은 음성 인식을 위해 큰 음성 모델 en-US 을 사용합니다:

IBM Cloud

curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"

IBM Cloud Pak for Data IBM Software Hub

curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"

기본 모델 사용

음성 인식 요청에서 model 매개변수를 생략하면 서비스는 기본적으로 미국 영어 en-US_BroadbandModel을(를) 사용합니다. 이 기본값은 모든 음성 인식 요청에 적용됩니다.

IBM Cloud Pak for Data 노즈비 IBM Software Hub en-US_BroadbandModel 를 설치하지 않으면 기본 모델로 사용할 수 없습니다. 이 경우 다음 중 하나를 수행해야 합니다.

  • model 매개변수를 사용하여 각 요청에 사용할 모델을 전달하십시오.
  • 음성 서비스 사용자 정의 리소스의 defaultSTTModel 특성을 사용하여 Speech to Text for IBM Cloud Pak for Data 설치의 새 기본 모델을 지정하십시오. 자세한 정보는 Watson Speech to Text를 참조하십시오.