음성 인식에 모델 사용
음성 인식 요청에 사용할 모델은 요청의 model 매개변수를 사용하여 표시합니다. 파라미터를 사용하여 대규모 음성 모델, 이전 또는 차세대 모델을 지정할 수 있습니다.
음성 인식에 사용할 수 있는 모델에 대한 자세한 정보는 다음 항목을 참조하십시오.
이전 세대 모델 지정 예
다음 HTTP 요청 예는 음성 인식에 이전 세대 모델 en-US_NarrowbandModel을(를) 사용합니다.
IBM Cloud
curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"
IBM Cloud Pak for Data IBM Software Hub
curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/flac" \
--data-binary @{path}audio-file.flac \
"{url}/v1/recognize?model=en-US_NarrowbandModel"
차세대 모델 지정 예
다음 HTTP 요청 예는 음성 인식에 차세대 en-US_Telephony 모델을 사용합니다.
IBM Cloud
curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"
IBM Cloud Pak for Data IBM Software Hub
curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US_Telephony"
대형 음성 모델 예제 지정
다음 예제 HTTP 요청은 음성 인식을 위해 큰 음성 모델 en-US 을 사용합니다:
IBM Cloud
curl -X POST -u "apikey:{apikey}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"
IBM Cloud Pak for Data IBM Software Hub
curl -X POST \
--header "Authorization: Bearer {token}" \
--header "Content-Type: audio/wav" \
--data-binary @{path}audio-file.wav \
"{url}/v1/recognize?model=en-US"
기본 모델 사용
음성 인식 요청에서 model 매개변수를 생략하면 서비스는 기본적으로 미국 영어 en-US_BroadbandModel을(를) 사용합니다. 이 기본값은 모든 음성 인식 요청에 적용됩니다.
IBM Cloud Pak for Data 노즈비 IBM Software Hub en-US_BroadbandModel 를 설치하지 않으면 기본 모델로 사용할 수 없습니다. 이 경우 다음 중 하나를 수행해야 합니다.
model매개변수를 사용하여 각 요청에 사용할 모델을 전달하십시오.- 음성 서비스 사용자 정의 리소스의
defaultSTTModel특성을 사용하여 Speech to Text for IBM Cloud Pak for Data 설치의 새 기본 모델을 지정하십시오. 자세한 정보는 Watson Speech to Text를 참조하십시오.