Riepilogo dei parametri
Le seguenti sezioni forniscono un riepilogo di tutti i parametri disponibili per il riconoscimento vocale. Le informazioni includono la disponibilità per i modelli vocali di grandi dimensioni, i modelli precedenti e di nuova generazione e il supporto e l'uso per le interfacce di riconoscimento vocale.
- Per ulteriori informazioni sulle lingue e i modelli di generazione precedente, vedi Lingue e modelli di generazione precedente.
- Per ulteriori informazioni sui modelli e le lingue di nuova generazione, vedi Modelli e lingue di nuova generazione.
- Per ulteriori informazioni sui modelli e sulle lingue parlate di grandi dimensioni, vedi Modelli e lingue parlate di grandi dimensioni;
access_token
Un token di accesso obbligatorio da utilizzare per stabilire una connessione autenticata con l'interfaccia WebSocket. Per ulteriori informazioni, vedi Apri una connessione.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametri di query della richiesta di connessione /v1/recognize |
| HTTP sincrono | Non supportato |
| HTTP asincrono | Non supportato |
acoustic_customization_id
Un ID di personalizzazione facoltativo per un modello acustico personalizzato che viene adattato per le caratteristiche acustiche del tuo ambiente e dei tuoi parlanti. Per impostazione predefinita, non viene utilizzato alcun modello personalizzato. Per ulteriori informazioni, consulta Utilizzo di un modello acustico personalizzato per il riconoscimento vocale.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile o beta per tutti i modelli che supportano la personalizzazione del modello acustico. Per ulteriori informazioni, vedi Customization support for previous-generation models. |
| Modelli di nuova generazione | Non disponibile. |
| WebSocket | Parametri di query della richiesta di connessione /v1/recognize |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
audio_metrics
Un valore booleano facoltativo che indica se il servizio restituisce metriche sulle caratteristiche di segnale dell'audio di input. Per impostazione predefinita (false), il servizio non restituisce alcuna metrica audio. Per ulteriori
informazioni, vedi Metriche audio.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
background_audio_suppression
Un valore mobile facoltativo compreso tra 0,0 e 1,0 che indica il livello a cui l'audio di sottofondo e le conversazioni marginali devono essere eliminati nell'audio di input. Il valore predefinito è 0,0, che non fornisce alcuna eliminazione dell'audio di sottofondo. Per ulteriori informazioni, vedi Soppressione audio in background.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Disponibile in generale per tutti i modelli linguistici, ad eccezione di ar-MS_BroadbandModel, pt-BR_BroadbandModel, zh-CN_BroadbandModel, zh-CN_NarrowbandModel e de-DE_BroadbandModel. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
base_model_version
Una versione facoltativa di un modello di base. Il parametro è concepito principalmente per essere utilizzato con i modelli personalizzati aggiornati per un nuovo modello di base ma può essere utilizzato senza un modello personalizzato. Il valore predefinito dipende dal fatto che il parametro sia utilizzato con o senza un modello personalizzato. Per ulteriori informazioni, vedi Effettuare richieste di riconoscimento vocale con i modelli personalizzati di cui è stato eseguito l'upgrade.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametri di query della richiesta di connessione /v1/recognize |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
carattere_inserimento_bias
Un float facoltativo tra -1.0 e 1.0 che indica se il servizio è distorto per riconoscere stringhe di caratteri più brevi (valori negativi) o più lunghe (valori positivi) quando si sviluppano le ipotesi di trascrizione. Per default, il servizio utilizza una distorsione predefinita di 0.0. Il valore specificato rappresenta una modifica rispetto al valore predefinito di un modello. Per ulteriori informazioni, vedi Bias di inserimento dei caratteri.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Non disponibile. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
Content-Type
Un formato audio facoltativo (tipo MIME) che specifica il formato dei dati audio che passi al servizio. Il servizio può rilevare automaticamente il formato della maggior parte degli elementi audio, quindi il parametro è facoltativo per la maggior
parte dei formati. È obbligatorio per i formati audio/alaw, audio/basic, audio/l16 e audio/mulaw. Per ulteriori informazioni, vedi Specifica di un formato audio.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro content-type del messaggio start JSON |
| HTTP sincrono | Intestazione della richiesta del metodo POST /v1/recognize |
| HTTP asincrono | Intestazione della richiesta del metodo POST /v1/recognitions |
customization_weight
Un valore double facoltativo compreso tra 0,0 e 1,0 che indica il peso relativo dato dal servizio alle parole da un modello di lingua personalizzato rispetto alle parole dal vocabolario di base. L'impostazione predefinita differisce per i diversi tipi di modelli. Puoi specificare un valore quando un modello personalizzato viene addestrato o quando viene utilizzato per il riconoscimento vocale. Per ulteriori informazioni, vedi Utilizzo del peso di personalizzazione.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. Il valore predefinito è 0.5. |
| Modelli di generazione precedente | Generalmente disponibile o beta per tutti i modelli che supportano la personalizzazione del modello di lingua. Il valore predefinito è 0.3. Per ulteriori informazioni, vedi Customization support for previous-generation models. |
| Modelli di nuova generazione | Generalmente disponibile o beta per tutti i modelli che supportano la personalizzazione del modello di lingua. Il valore predefinito è 0.2 per la maggior parte dei modelli di nuova generazione; è 0.1 per i modelli basati sulla nuova tecnologia di personalizzazione del modello di lingua. Per ulteriori informazioni, vedi Customization support for next-generation models. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
end_of_phrase_silence_time
Un valore double facoltativo compreso tra 0,0 e 120,0 che indica l'intervallo di pausa al quale il servizio suddivide una trascrizione in più risultati finali se riscontra il silenzio. Per impostazione predefinita, il servizio utilizza un intervallo di pausa di 0,8 secondi per tutte le lingue diverse dal cinese, per la quale utilizza un intervallo di 0,6 secondi. Per ulteriori informazioni, vedi Periodo di silenzio al termine della frase.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
grammar_name
Una stringa facoltativa che identifica una grammatica che deve essere utilizzata per il riconoscimento vocale. Il servizio riconosce solo le stringhe definite dalla grammatica. Devi specificare sia il nome della grammatica che l'ID di personalizzazione del modello di lingua personalizzato per il quale è definita la grammatica. Per ulteriori informazioni, vedi Utilizzo di una grammatica per il riconoscimento vocale.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile o beta per tutti i modelli che supportano la personalizzazione del modello di lingua. Per ulteriori informazioni, vedi Customization support for previous-generation models. |
| Modelli di nuova generazione | Generalmente disponibile o beta per tutti i modelli che supportano la personalizzazione del modello di lingua. Per ulteriori informazioni, vedi Customization support for next-generation models. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
inactivity_timeout
Un numero intero facoltativo che specifica il numero di secondi per il timeout di inattività del servizio. Inattività significa che il servizio non rileva alcun discorso nell'audio del flusso. Il valore predefinito è 30 secondi. Utilizza -1 per indicare un tempo indefinito. Per ulteriori informazioni, vedi Timeout di inattività.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
interim_results
Un valore booleano facoltativo che indica al servizio di restituire le ipotesi intermedie che probabilmente varieranno prima della trascrizione finale. Per impostazione predefinita (false), i risultati provvisori non vengono restituiti.
I risultati provvisori sono disponibili solo con l'interfaccia WebSocket. Per ulteriori informazioni, vedi Risultati provvisori.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per i modelli di nuova generazione che supportano la bassa latenza, ma solo se sia i parametri interim_results che low_latency sono impostati su true. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Non supportato |
| HTTP asincrono | Non supportato |
keywords
Un array facoltativo di stringhe di parole chiave che il servizio individua nell'audio di input. Per impostazione predefinita, l'individuazione di parole chiave non viene eseguita. Per ulteriori informazioni, vedi Individuazione di parole chiave.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Non disponibile. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
keywords_threshold
Un valore double facoltativo compreso tra 0,0 e 1,0 che indica la soglia minima per una corrispondenza di parola chiave positiva. Per impostazione predefinita, l'individuazione di parole chiave non viene eseguita. Per ulteriori informazioni, vedi Individuazione di parole chiave.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Non disponibile. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
language_customization_id
Un ID di personalizzazione facoltativo per un modello di lingua personalizzato che include la terminologia dal tuo dominio. Per impostazione predefinita, non viene utilizzato alcun modello personalizzato. Per ulteriori informazioni, vedi Utilizzo di un modello di lingua personalizzato per il riconoscimento vocale.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile o beta per tutti i modelli che supportano la personalizzazione del modello di lingua. Per ulteriori informazioni, vedi Customization support for previous-generation models. |
| Modelli di nuova generazione | Generalmente disponibile o beta per tutti i modelli che supportano la personalizzazione del modello di lingua. Per ulteriori informazioni, vedi Customization support for next-generation models. |
| WebSocket | Parametri di query della richiesta di connessione /v1/recognize |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
latenza bassa
Un valore booleano facoltativo che indica se il servizio deve produrre risultati più rapidamente, a discapito dell'accuratezza della trascrizione. Per impostazione predefinita (false), la bassa latenza non è abilitata. Per ulteriori
informazioni, vedi Bassa latenza.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Disponibile per tutti (solo per en-US ). |
| Modelli di generazione precedente | Non disponibile. |
| Modelli di nuova generazione | Generalmente disponibile o beta per modelli di nuova generazione che supportano la bassa latenza. Per ulteriori informazioni, vedi Supported next-generation language models. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
max_alternatives
Un numero intero facoltativo che specifica il numero massimo di ipotesi alternative restituito dal servizio. Per impostazione predefinita, il servizio restituisce una singola ipotesi finale. Per ulteriori informazioni, vedi Numero massimo di alternative.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
modello
Un modello opzionale che specifica la lingua in cui è registrato l'audio e la frequenza di campionamento: banda larga/multimedia o banda stretta/telefonia. Per impostazione predefinita, viene utilizzato en-US_BroadbandModel. Per
ulteriori informazioni, vedi Utilizzo di un modello per il riconoscimento vocale.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametri di query della richiesta di connessione /v1/recognize |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
processing_metrics
Un valore booleano facoltativo che indica se il servizio restituisce metriche sulla sua elaborazione dell'audio di input. Per impostazione predefinita (false), il servizio non restituisce alcuna metrica di elaborazione. Per ulteriori
informazioni, vedi Metriche di elaborazione.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Non disponibile. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Non supportato |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
processing_metrics_interval
Un valore a virgola mobile di almeno 0,1 che indica l'intervallo in cui il servizio deve restituire le metriche di elaborazione. Se il parametro processing_metrics è true, il servizio restituisce le metriche di elaborazione
ogni 1,0 secondi per impostazione predefinita. Per ulteriori informazioni, vedi Metriche di elaborazione.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Non disponibile. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Non supportato |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
profanity_filter
Un valore booleano facoltativo che indica se il servizio censura il contenuto volgare in una trascrizione. Per impostazione predefinita (true), il contenuto volgare viene filtrato dalla trascrizione. Per ulteriori informazioni,
vedi Filtro di contenuto volgare.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
redaction
Un valore booleano facoltativo che indica se il servizio oscura i dati numerici con tre o più cifre consecutive da una trascrizione. Per impostazione predefinita (false), i dati numerici non sono oscurati. Se imposti il parametro
redaction su true, il servizio forza automaticamente il parametro smart_formatting in modo che sia true e disabilita i parametri keywords, keywords_threshold, max_alternatives e (per l'interfaccia WebSocket ) interim_results. Per ulteriori informazioni, vedi Oscuramento numerico.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Beta per l'inglese e il giapponese. |
| Modelli di generazione precedente | Versione beta per l'inglese (Stati Uniti), il giapponese e il coreano. |
| Modelli di nuova generazione | Versione beta per l'inglese (Stati Uniti), il giapponese e il coreano. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
smart_formatting
Un valore booleano facoltativo che indica se il servizio converte le date, le ore, i numeri, la valuta e valori simili in rappresentazioni più convenzionali nella trascrizione finale. Per l'inglese (Stati Uniti), la funzione converte anche delle
specifiche frasi di parole chiave in simboli di punteggiatura. Per impostazione predefinita (false), la formattazione intelligente non viene eseguita. Per ulteriori informazioni, vedi Formattazione intelligente.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per l'inglese americano, il giapponese e lo spagnolo (tutti i dialetti). |
| Modelli di nuova generazione | Generalmente disponibile per l'inglese americano, il giapponese e lo spagnolo (tutti i dialetti). È disponibile anche per il modello en-WW_Medical_Telephony quando viene riconosciuto l'audio in inglese americano. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
versione_formattazione_intelligente
Un numero intero facoltativo che indica se il servizio converte date, orari, numeri, valute e valori simili in rappresentazioni più convenzionali nella trascrizione finale. Per ulteriori informazioni, consultare la versione "Formattazione intelligente ".
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue tranne il giapponese. |
| Modelli di generazione precedente | Non supportato. |
| Modelli di nuova generazione | Generalmente disponibile solo per l'inglese americano (incluso en-WW_Medical_Telephony), il portoghese brasiliano, il francese francese, il tedesco, il francese canadese e lo spagnolo. |
| WebSocket | Parametri del messaggio JSON start. Il servizio disabilita i risultati provvisori. |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
speaker_labels
Un valore booleano facoltativo che indica se il servizio identifica gli individui e le parole da essi espresse in uno scambio tra più partecipanti. Se imposti il parametro speaker_labels su true, il servizio forza automaticamente
il parametro timestamps su true. Per impostazione predefinita (false), le etichette del parlante non vengono restituite. Per ulteriori informazioni, vedi Etichette del parlante.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Beta per tutte le lingue. |
| Modelli di generazione precedente | Beta per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
speech_detector_sensitivity
Un valore mobile facoltativo compreso tra 0,0 e 1,0 che indica la sensibilità del riconoscimento vocale di eventi non vocali nell'audio di input. Il valore è 0,5, che fornisce un livello ragionevole di sensibilità per gli eventi non vocali. Per ulteriori informazioni, consultare Sensibilità del rilevatore vocale.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Disponibile in generale per tutti i modelli linguistici, ad eccezione di ar-MS_BroadbandModel, pt-BR_BroadbandModel, zh-CN_BroadbandModel, zh-CN_NarrowbandModel e de-DE_BroadbandModel. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
split_transcript_at_phrase_end
Un valore booleano facoltativo che indica se il servizio suddivide una trascrizione in più risultati finali in base alle funzioni semantiche dell'input come ad esempio le frasi. Il servizio basa la sua comprensione delle funzioni semantiche
sul modello di lingua di base, che può essere ulteriormente influenzato dai modelli di lingua personalizzati e dalle grammatiche. Per impostazione predefinita (false), il servizio non produce suddivisioni semantiche. Per ulteriori
informazioni, vedi Suddividi la trascrizione al termine della frase.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
timestamps
Un valore booleano facoltativo che indica se il servizio produce delle date/ore per le parole della trascrizione. Per impostazione predefinita (false), le date/ore non vengono restituite. Per ulteriori informazioni, vedi Date/ore delle parole.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
Transfer-Encoding
Un valore facoltativo di chunked che causa l'invio in streaming dell'audio al servizio. Per impostazione predefinita, l'audio viene inviato tutto insieme come una singola fornitura unica. Per ulteriori informazioni, vedi Trasmissione audio.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Non applicabile, sempre in streaming |
| HTTP sincrono | Intestazione della richiesta del metodo POST /v1/recognize |
| HTTP asincrono | Intestazione della richiesta del metodo POST /v1/recognitions |
word_alternatives_threshold
Un valore double facoltativo compreso tra 0,0 e 1,0 che specifica la soglia a cui il servizio notifica le alternative acusticamente simili per le parole dell'audio di input. Per impostazione predefinita, le alternative alle parole non vengono restituite. Per ulteriori informazioni, vedi Alternative alle parole.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Non disponibile. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Non disponibile. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
word_confidence
Un valore booleano facoltativo che indica se il servizio fornisce le misure dell'attendibilità per le parole della trascrizione. Per impostazione predefinita (false), le misure dell'attendibilità delle parole non vengono restituite.
Per ulteriori informazioni, vedi Attendibilità delle parole.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro del messaggio start JSON |
| HTTP sincrono | Parametro di query del metodo POST /v1/recognize |
| HTTP asincrono | Parametro di query del metodo POST /v1/recognitions |
X-Watson-Learning-Opt-Out
IBM Cloud
Un valore booleano facoltativo che indica se rifiuti esplicitamente la registrazione delle richieste predefinita eseguita da IBM per migliorare il servizio per gli utenti futuri. Per impedire che IBM acceda ai tuoi dati per miglioramenti del
servizio generali, specifica true per il parametro. Se esegui l'opt - out, il servizio registra no i dati utente dalle tue richieste, non salvando alcun audio o testo su disco. Puoi anche scegliere di non partecipare
a livello di account. Per ulteriori informazioni, vedi
Registrazione delle richieste.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro di query x-watson-learning-opt-out della richiesta di connessione /v1/recognize |
| HTTP sincrono | Intestazione della richiesta di ciascuna richiesta |
| HTTP asincrono | Intestazione della richiesta di ciascuna richiesta |
X-Watson-Metadata
Una stringa facoltativa che associa un ID cliente ai dati passati per le richieste di riconoscimento. Il parametro accetta l'argomento customer_id={id}. Per impostazione predefinita, nessun ID cliente è associato ai dati. Per ulteriori
informazioni, vedi
Sicurezza delle informazioni.
| Disponibilità e utilizzo | Descrizione |
|---|---|
| Modelli vocali di grandi dimensioni | Generalmente disponibile per tutte le lingue. |
| Modelli di generazione precedente | Generalmente disponibile per tutte le lingue. |
| Modelli di nuova generazione | Generalmente disponibile per tutte le lingue. |
| WebSocket | Parametro di query x-watson-metadata della richiesta di connessione /v1/recognize. (È necessario codificare l'argomento con l'opzione - URL. Ad esempio, customer_id%3dmy_customer_ID ) |
| HTTP sincrono | Intestazione della richiesta relativa alla richiesta POST /v1/recognize |
| HTTP asincrono | Intestazione della richiesta relativa alle richieste POST /v1/register_callback e |
`POST /v1/recognitions` |