Parameterübersicht

Die folgenden Abschnitte enthalten eine Übersicht über alle verfügbaren Parameter für die Spracherkennung. Die Informationen umfassen die Verfügbarkeit großer Sprachmodelle, Modelle der vorherigen und der nächsten Generation sowie die Unterstützung und Nutzung von Spracherkennungsschnittstellen.

access_token

Ein erforderliches Zugriffstoken, das Sie zum Herstellen einer authentifizierten Verbindung zur WebSocket-Schnittstelle verwenden. Weitere Informationen finden Sie im Abschnitt Verbindung öffnen.

Der Parameter „access_token“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize
Synchrones HTTP Nicht unterstützt
Asynchrones HTTP Nicht unterstützt

acoustic_customization_id

Eine optionale Anpassungs-ID für ein angepasstes Akustikmodell, das auf die Akustikmerkmale Ihrer Umgebung und der zugehörigen Sprecher abgestimmt ist. Standardmäßig wird kein angepasstes Modell verwendet. Weitere Informationen finden Sie unter Angepasstes Akustikmodell für die Spracherkennung verwenden.

Der Parameter „acoustic_customization_id“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Akustikmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle einer früheren Generation.
Modelle der nächsten Generation Nicht verfügbar.
WebSocket Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

audio_metrics

Ein optionaler boolescher Wert, der angibt, ob der Service Metriken zu den Signalmerkmalen der Audioeingabedaten zurückgibt. Die Standardeinstellung false gibt an, dass der Service keine Audiometriken zurückgibt. Weitere Informationen finden Sie unter Audiometriken.

Der Parameter „audio_metrics“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

background_audio_suppression

Ein optionaler Gleitkommawert zwischen 0,0 und 1,0, der die Stufe angibt, bis zu der Hintergrundgeräusche und Nebengespräche in der Audioeingabe unterdrückt werden sollen. Der Standardwert ist 0,0, bei dem keine Unterdrückung der Hintergrundaudiosignale erfolgt. Weitere Informationen finden Sie unter Nebengeräuschunterdrückung.

Der Parameter „background_audio_suppression“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachmodelle außer für ar-MS_BroadbandModel, pt-BR_BroadbandModel, zh-CN_BroadbandModel, zh-CN_NarrowbandModel und de-DE_BroadbandModel.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

base_model_version

(Optional) Eine Version eines Basismodells. Der Parameter ist in erster Linie für die Verwendung mit angepassten Modellen bestimmt, die für ein neues Basismodell aktualisiert werden, kann aber auch ohne ein angepasstes Modell verwendet werden. Der Standardwert ist davon abhängig, ob der Parameter mit oder ohne ein angepasstes Modell verwendet wird. Weitere Informationen finden Sie unter Spracherkennungsanforderung mit aktualisierten angepassten Modellen erstellen.

Der Parameter „base_model_version“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

character_insertion_bias

Eine optionale Gleitkommazahl zwischen -1,0 und 1,0, die angibt, ob der Service bei der Entwicklung von Transkriptionshypothesen verzerrt ist, um kürzere (negative Werte) oder längere (positive Werte) Zeichenfolgen zu erkennen. Standardmäßig verwendet der Service die Standardverzerrung 0.0. Der von Ihnen angegebene Wert stellt eine Abweichung vom Standardwert des Modells dar. Weitere Informationen finden Sie unter Zeicheneinfügeabweichung.

Der Parameter „character_insertion_bias“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Nicht verfügbar.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

Content-Type

(Optional) Ein Audioformat (MIME-Typ) zum Angeben des Formats der Audiodaten, die Sie an den Service übergeben. Der Service kann das Format der meisten Audiodaten automatisch erkennen; d. h. der Parameter ist für die meisten Formate optional. Er ist jedoch erforderlich für die Formate audio/alaw, audio/basic, audio/l16 und audio/mulaw. Weitere Informationen finden Sie unter Audioformat angeben.

Der Parameter „Content-Type“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter content-type der JSON-Nachricht start
Synchrones HTTP Anforderungsheader der Methode POST /v1/recognize
Asynchrones HTTP Anforderungsheader der Methode POST /v1/recognitions

customization_weight

Ein optionales Doppelzeichen zwischen 0,0 und 1,0, das die relative Gewichtung angibt, die der Service den Wörtern aus einem angepassten Sprachmodell im Verhältnis zu Wörtern aus dem Basisvokabular zuordnet. Der Standardwert ist für verschiedene Modelltypen unterschiedlich. Sie können einen Wert angeben, wenn ein angepasstes Modell trainiert oder für die Spracherkennung verwendet wird. Weitere Informationen finden Sie im Abschnitt Anpassungsgewichtung verwenden.

Der Parameter „customization_weight“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen. Der Standardwert lautet „ 0.5 “.
Modelle der vorherigen Generation Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Der Standardwert lautet „ 0.3 “. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle einer früheren Generation.
Modelle der nächsten Generation Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Der Standardwert ist 0.2 für die meisten Modelle der nächsten Generation; er ist 0.1 für Modelle, die auf der neuen Technologie zur Sprachmodellanpassung basieren. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle der nächsten Generation.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

end_of_phrase_silence_time

Ein optionales Doppelzeichen zwischen 0,0 und 120,0 gibt das Pausenintervall an, bei dem der Service eine Transkription in mehrere Endergebnisse als Reaktion auf die Sprechpause aufteilt. Der Service verwendet standardmäßig ein Pausenintervall von 0,8 Sekunden für alle Sprachen, außer für Chinesisch, hier wird ein Intervall von 0,6 Sekunden verwendet. Weitere Informationen finden Sie im Abschnitt Sprechpausenzeit nach Ausdrucksende.

Der Parameter „end_of_phrase_silence_time“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

grammar_name

Eine optionale Zeichenfolge, die eine Grammatik angibt, die für die Spracherkennung verwendet werden soll. Der Service erkennt nur Zeichenfolgen, die von der Grammatik definiert sind. Sie müssen sowohl den Namen der Grammatik angeben als auch die Anpassungs-ID des angepassten Sprachmodells, für das die Grammatik definiert ist. Weitere Informationen enthält der Abschnitt Grammatik bei der Spracherkennung verwenden.

Der Parameter „grammar_name“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle einer früheren Generation.
Modelle der nächsten Generation Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle der nächsten Generation.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

inactivity_timeout

Ein optionaler ganzzahliger Wert, der die Anzahl der Sekunden für das Inaktivitätszeitlimit des Service angibt. Inaktivität bedeutet, dass der Service keine Spracherkennung für die Streaming-Audiodaten durchführt. Der Standardwert ist 30 Sekunden. Der Wert -1 bedeutet 'Unendlich'. Weitere Informationen finden Sie im Abschnitt Inaktivitätszeitlimit.

Parameter 'inactivity_timeout'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

interim_results

Ein optionaler boolescher Wert, der den Service anweist, temporäre Hypothesen zurückzugeben, die bis zur endgültigen Transkription noch geändert werden können. Die Standardeinstellung false gibt an, dass keine Zwischenergebnisse zurückgegeben werden. Zwischenergebnisse sind nur bei Verwendung der WebSocket-Schnittstelle verfügbar. Weitere Informationen finden Sie unter Zwischenergebnisse.

Parameter 'interim_results'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für Modelle der nächsten Generation, die geringe Latenzzeit unterstützen, wenn die beiden Parameter interim_results und low_latency auf true gesetzt sind.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Nicht unterstützt
Asynchrones HTTP Nicht unterstützt

Schlüsselwörter

Ein optionales Array mit Schlüsselwortzeichenfolgen, die der Service in den Audioeingabedaten erkennt. Die Funktion für Schlüsselworterkennung ist standardmäßig inaktiviert. Weitere Informationen finden Sie im Abschnitt Schlüsselworterkennung.

Parameter 'keywords'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Nicht verfügbar.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

keywords_threshold

Ein optionales Doppelzeichen zwischen 0,0 und 1,0, das den Mindestschwellenwert für eine positive Schlüsselwortübereinstimmung angibt. Die Funktion für Schlüsselworterkennung ist standardmäßig inaktiviert. Weitere Informationen finden Sie im Abschnitt Schlüsselworterkennung.

Parameter 'keywords_threshold'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Nicht verfügbar.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

language_customization_id

Eine optionale Anpassungs-ID für ein angepasstes Sprachenmodell, das Terminologie aus Ihrem Fachgebiet enthält. Standardmäßig wird kein angepasstes Modell verwendet. Weitere Informationen finden Sie unter Angepasstes Sprachmodell für die Spracherkennung verwenden.

Parameter 'language_customization_id'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle einer früheren Generation.
Modelle der nächsten Generation Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle der nächsten Generation.
WebSocket Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

low_latency

Ein optionaler boolescher Wert, der angibt, ob der Service schneller Ergebnisse liefern soll (möglicherweise mit geringerer Transkriptionsgenauigkeit). In der Standardeinstellung (false) ist die geringe Latenzzeit nicht aktiviert. Weitere Informationen finden Sie unter Geringe Latenzzeit.

Der Parameter „low_latency“
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar (nur für „ en-US “).
Modelle der vorherigen Generation Nicht verfügbar.
Modelle der nächsten Generation Allgemein verfügbar oder als Betaversion verfügbar für Modelle der nächsten Generation, die geringe Latenzzeit unterstützen. Weitere Informationen finden Sie unter Unterstützte Sprachmodelle der nächsten Generation.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

max_alternatives

Ein optionaler ganzzahliger Wert, der die maximale Anzahl alternativer Hypothesen angibt, die vom Service zurückgegeben werden. Standardmäßig gibt der Service eine einzige endgültige Hypothese zurück. Weitere Informationen finden Sie im Abschnitt Maximale Anzahl Alternativen.

Parameter 'max_alternatives'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

Modell

Ein optionales Modell, das die Sprache und die Abtastrate für die Audiodaten angibt: Breitband/Multimedia oder Schmalband/Telefonie. Standardmäßig wird en-US_BroadbandModel verwendet. Weitere Informationen finden Sie unter Modell für Spracherkennung verwenden.

Parameter 'model'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

processing_metrics

Ein optionaler boolescher Wert, der angibt, ob der Service Metriken zur Verarbeitung der Audioeingabedaten zurückgibt. Die Standardeinstellung false gibt an, dass der Service keine Verarbeitungsmetriken zurückgibt. Weitere Informationen finden Sie unter Verarbeitungsmetriken.

Parameter 'processing_metrics'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Nicht verfügbar.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Nicht unterstützt
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

processing_metrics_interval

Ein optionaler Gleitkommawert von mindestens 0,1, der das Intervall angibt, in dem der Service Verarbeitungsmetriken zurückgeben soll. Lautet der Wert des Parameters processing_metrics true, gibt der Service Verarbeitungsmetriken standardmäßig alle 1,0 Sekunden zurück. Weitere Informationen finden Sie unter Verarbeitungsmetriken.

Parameter 'processing_metrics_interval'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Nicht verfügbar.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Nicht unterstützt
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

profanity_filter

Ein optionaler boolescher Wert, der angibt, ob der Service vulgäre Ausdrücke aus einer Transkription filtert (zensiert). Der Standardwert true bedeutet, dass vulgäre Ausdrücke aus derTranskription gefiltert werden. Weitere Informationen finden Sie im Abschnitt Vulgäre Ausdrücke filtern.

Parameter 'profanity_filter'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

redaction

Ein optionaler boolescher Wert, der angibt, ob der Service numerische Daten mit mindestens drei aufeinanderfolgenden Ziffern aus einer Transkription schwärzt (maskiert). Die Standardeinstellung false gibt an, dass numerische Daten nicht geschwärzt werden. Wenn Sie den Parameter redaction auf true setzen, erzwingt der Service automatisch den Wert true für den Parameter smart_formatting und inaktiviert die Parameter keywords, keywords_threshold, max_alternatives und (für die WebSocket-Schnittstelle) interim_results. Weitere Informationen finden Sie im Abschnitt Zahlenschwärzung.

Parameter 'redaction'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Beta für Englisch und Japanisch.
Modelle der vorherigen Generation Betaversion für amerikanisches Englisch, Japanisch und Koreanisch.
Modelle der nächsten Generation Betaversion für amerikanisches Englisch, Japanisch und Koreanisch.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

smart_formatting

Ein optionaler boolescher Wert, der angibt, ob der Service Datums- und Zeitangaben, Zahlen sowie Währungswerte und ähnliche Werte in der endgültigen Transkription in eine konventionelle Darstellung umwandelt. Für amerikanisches Englisch wandelt die Funktion außerdem bestimmte Schlüsselwortausdrücke in Interpunktionszeichen um. Die Standardeinstellung false gibt an, dass keine intelligente Formatierung vorgenommen wird. Weitere Informationen finden Sie im Abschnitt Intelligente Formatierung.

Parameter 'smart_formatting'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Im Allgemeinen verfügbar für US-Englisch, Japanisch und Spanisch (alle Varianten).
Modelle der nächsten Generation Im Allgemeinen verfügbar für US-Englisch, Japanisch und Spanisch (alle Varianten). Es ist auch für das Modell „ en-WW_Medical_Telephony “ verfügbar, wenn US-Englisch-Audio erkannt wird.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

smart_formatting_version (intelligente Formatversion)

Eine optionale Ganzzahl, die angibt, ob der Dienst Datumsangaben, Uhrzeiten, Zahlen, Währungsangaben und ähnliche Werte im endgültigen Transkript in gängigere Darstellungsformen umwandelt. Weitere Informationen finden Sie unter „ Intelligente Formatierung “.

Tabelle 23a. Parameter 'smart_formatting_version'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen außer Japanisch.
Modelle der vorherigen Generation Nicht unterstützt.
Modelle der nächsten Generation Allgemein verfügbar nur für amerikanisches Englisch (einschließlich en-WW_Medical_Telephony), brasilianisches Portugiesisch, Französisch (Frankreich), Deutsch, Französisch (Kanada) und Spanisch.
WebSocket Parameter der JSON- start-Nachricht. Der Service inaktiviert Zwischenergebnisse.
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

speaker_labels

Ein optionaler boolescher Wert, der angibt, ob der Service markiert, welche Personen in einer Konversation mit mehreren Beteiligten welche Worte gesprochen haben. Wenn Sie den Parameter speaker_labels auf true setzen, erzwingt der Service automatisch, dass der Parameter timestamps auf true gesetzt wird. Die Standardeinstellung false gibt an, dass keine Sprecherbezeichnungen zurückgegeben werden. Weitere Informationen finden Sie im Abschnitt Sprecherbezeichnungen.

Parameter 'speaker_labels'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Beta für alle Sprachen.
Modelle der vorherigen Generation Beta für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

speech_detector_sensitivity

Ein optionaler Gleitkommawert zwischen 0,0 und 1,0, der die Empfindlichkeit der Spracherkennung für Nicht-Sprechereignisse in der Audioeingabe angibt. Der Standardwert beträgt 0,5, was eine angemessene Stufe für die Empfindlichkeit für Nicht-Sprechereignisse darstellt. Weitere Informationen finden Sie unter Sensibilität des Sprachdetektors.

Parameter 'speech_detector_sensitivity'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachmodelle außer für ar-MS_BroadbandModel, pt-BR_BroadbandModel, zh-CN_BroadbandModel, zh-CN_NarrowbandModel und de-DE_BroadbandModel.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

split_transcript_at_phrase_end

Ein optionaler boolescher Wert, der angibt, ob der Service basierend auf semantischen Merkmalen der Eingabe, wie z. B. Sätzen, eine Transkription in mehrere Endergebnisse aufspaltet. Der Service basiert auf dem Verständnis von semantischen Merkmalen für das Basissprachmodell, das auch von angepassten Sprachmodellen und Grammatiken beeinflusst wird. Standardmäßig (false) generiert der Service keine semantischen Aufteilungen. Weitere Informationen finden Sie im Abschnitt Transkription nach Ausdrucksende aufteilen.

Parameter 'split_transcript_at_phrase_end'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

timestamps

Ein optionaler boolescher Wert, der angibt, ob der Service Zeitmarken für die Wörter der Transkription erstellt. Die Standardeinstellung false gibt an, dass keine Zeitmarken zurückgegeben werden. Weitere Informationen finden Sie im Abschnitt Wortzeitmarken.

Parameter 'timestamps'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

Transfer-Encoding

Ein optionaler Wert für chunked, der bewirkt, dass die Audiodaten per Streaming zum Service übertragen werden. Standardmäßig werden die Audiodaten alle auf einmal als Einzelübertragung gesendet. Weitere Informationen finden Sie im Abschnitt Übertragung von Audiodaten.

Parameter 'Transfer-Encoding'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Nicht zutreffend; immer per Streaming
Synchrones HTTP Anforderungsheader der Methode POST /v1/recognize
Asynchrones HTTP Anforderungsheader der Methode POST /v1/recognitions

word_alternatives_threshold

Ein optionales Doppelzeichen zwischen 0,0 und 1,0, das den Schwellenwert angibt, ab dem der Service automatisch ähnliche Alternativen für Wörter aus den Audioeingabedaten liefert. Standardmäßig werden keine Wortalternativen zurückgegeben. Weitere Informationen finden Sie im Abschnitt Wortalternativen.

Parameter 'word_alternatives_threshold'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Nicht verfügbar.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Nicht verfügbar.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

word_confidence

Ein optionaler boolescher Wert, der angibt, ob der Service Konfidenzwerte für die Wörter der Transkription bereitstellt. Die Standardeinstellung false gibt an, dass keine Konfidenzwerte für Wörter zurückgegeben werden. Weitere Informationen finden Sie im Abschnitt Wortkonfidenz.

Parameter 'word_confidence'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Parameter der JSON-Nachricht start
Synchrones HTTP Abfrageparameter der Methode POST /v1/recognize
Asynchrones HTTP Abfrageparameter der Methode POST /v1/recognitions

X-Watson-Learning-Opt-Out

IBM Cloud

Ein optionaler boolescher Wert, der angibt, ob die Anforderungsprotokollierung inaktiviert werden soll, die von IBM standardmäßig durchgeführt wird, um den Service für zukünftige Benutzer zu verbessern. Wenn Sie nicht zulassen möchten, dass Ihre Daten von IBM für die allgemeine Verbesserung des Service verwendet werden, geben Sie für diesen Parameter true an. Wenn Sie das Opt-out durchführen, protokolliert der Service keine Benutzerdaten aus Ihren Anforderungen, d. h. es werden keine Audio- oder Textdaten auf Platte gespeichert. Sie können die Ablehnung auch auf Kontoebene durchführen. Weitere Informationen finden Sie im Abschnitt Anforderungsprotokollierung.

Parameter 'X-Watson-Learning-Opt-Out'
Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Abfrageparameter x-watson-learning-opt-out der Verbindungsanforderung /v1/recognize
Synchrones HTTP Anforderungsheader für jede Anforderung
Asynchrones HTTP Anforderungsheader für jede Anforderung

X-Watson-Metadata

Eine optionale Zeichenfolge, die eine Kunden-ID den Daten zuordnet, die für Erkennungsanforderungen übergeben werden. Der Parameter akzeptiert das Argument customer_id={id}. Standardmäßig wird den Daten keine Kunden-ID zugeordnet. Weitere Informationen finden Sie im Abschnitt Informationssicherheit.

Verfügbarkeit und Verwendung Beschreibung
Große Sprachmodelle Allgemein verfügbar für alle Sprachen.
Modelle der vorherigen Generation Allgemein verfügbar für alle Sprachen.
Modelle der nächsten Generation Allgemein verfügbar für alle Sprachen.
WebSocket Abfrageparameter x-watson-metadata für Verbindungsanforderung mit der Methode /v1/recognize. (Sie müssen das Argument mit „ URL “ verschlüsseln. Zum Beispiel customer_id%3dmy_customer_ID
Synchrones HTTP Anforderungsheader der POST-Anforderung /v1/recognize
Asynchrones HTTP Anforderungsheader für POST /v1/register_callback-
  und `POST /v1/recognitions`-Anforderungen |