Parameterübersicht
Die folgenden Abschnitte enthalten eine Übersicht über alle verfügbaren Parameter für die Spracherkennung. Die Informationen umfassen die Verfügbarkeit großer Sprachmodelle, Modelle der vorherigen und der nächsten Generation sowie die Unterstützung und Nutzung von Spracherkennungsschnittstellen.
- Weitere Informationen zu Sprachen und Modellen der vorherigen Generation finden Sie unter Sprachen und Modelle der vorherigen Generation.
- Weitere Informationen zu Sprachen und Modellen der nächsten Generation finden Sie unter Sprachen und Modelle der nächsten Generation.
- Weitere Informationen zu großen Sprachsprachen und -modellen finden Sie unter Große Sprachsprachen und -modelle.
access_token
Ein erforderliches Zugriffstoken, das Sie zum Herstellen einer authentifizierten Verbindung zur WebSocket-Schnittstelle verwenden. Weitere Informationen finden Sie im Abschnitt Verbindung öffnen.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize |
| Synchrones HTTP | Nicht unterstützt |
| Asynchrones HTTP | Nicht unterstützt |
acoustic_customization_id
Eine optionale Anpassungs-ID für ein angepasstes Akustikmodell, das auf die Akustikmerkmale Ihrer Umgebung und der zugehörigen Sprecher abgestimmt ist. Standardmäßig wird kein angepasstes Modell verwendet. Weitere Informationen finden Sie unter Angepasstes Akustikmodell für die Spracherkennung verwenden.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Akustikmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle einer früheren Generation. |
| Modelle der nächsten Generation | Nicht verfügbar. |
| WebSocket | Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
audio_metrics
Ein optionaler boolescher Wert, der angibt, ob der Service Metriken zu den Signalmerkmalen der Audioeingabedaten zurückgibt. Die Standardeinstellung false gibt an, dass der Service keine Audiometriken zurückgibt. Weitere Informationen
finden Sie unter Audiometriken.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
background_audio_suppression
Ein optionaler Gleitkommawert zwischen 0,0 und 1,0, der die Stufe angibt, bis zu der Hintergrundgeräusche und Nebengespräche in der Audioeingabe unterdrückt werden sollen. Der Standardwert ist 0,0, bei dem keine Unterdrückung der Hintergrundaudiosignale erfolgt. Weitere Informationen finden Sie unter Nebengeräuschunterdrückung.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachmodelle außer für ar-MS_BroadbandModel, pt-BR_BroadbandModel, zh-CN_BroadbandModel, zh-CN_NarrowbandModel und de-DE_BroadbandModel. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
base_model_version
(Optional) Eine Version eines Basismodells. Der Parameter ist in erster Linie für die Verwendung mit angepassten Modellen bestimmt, die für ein neues Basismodell aktualisiert werden, kann aber auch ohne ein angepasstes Modell verwendet werden. Der Standardwert ist davon abhängig, ob der Parameter mit oder ohne ein angepasstes Modell verwendet wird. Weitere Informationen finden Sie unter Spracherkennungsanforderung mit aktualisierten angepassten Modellen erstellen.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
character_insertion_bias
Eine optionale Gleitkommazahl zwischen -1,0 und 1,0, die angibt, ob der Service bei der Entwicklung von Transkriptionshypothesen verzerrt ist, um kürzere (negative Werte) oder längere (positive Werte) Zeichenfolgen zu erkennen. Standardmäßig verwendet der Service die Standardverzerrung 0.0. Der von Ihnen angegebene Wert stellt eine Abweichung vom Standardwert des Modells dar. Weitere Informationen finden Sie unter Zeicheneinfügeabweichung.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Nicht verfügbar. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
Content-Type
(Optional) Ein Audioformat (MIME-Typ) zum Angeben des Formats der Audiodaten, die Sie an den Service übergeben. Der Service kann das Format der meisten Audiodaten automatisch erkennen; d. h. der Parameter ist für die meisten Formate optional.
Er ist jedoch erforderlich für die Formate audio/alaw, audio/basic, audio/l16 und audio/mulaw. Weitere Informationen finden Sie unter Audioformat angeben.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter content-type der JSON-Nachricht start |
| Synchrones HTTP | Anforderungsheader der Methode POST /v1/recognize |
| Asynchrones HTTP | Anforderungsheader der Methode POST /v1/recognitions |
customization_weight
Ein optionales Doppelzeichen zwischen 0,0 und 1,0, das die relative Gewichtung angibt, die der Service den Wörtern aus einem angepassten Sprachmodell im Verhältnis zu Wörtern aus dem Basisvokabular zuordnet. Der Standardwert ist für verschiedene Modelltypen unterschiedlich. Sie können einen Wert angeben, wenn ein angepasstes Modell trainiert oder für die Spracherkennung verwendet wird. Weitere Informationen finden Sie im Abschnitt Anpassungsgewichtung verwenden.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. Der Standardwert lautet „ 0.5 “. |
| Modelle der vorherigen Generation | Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Der Standardwert lautet „ 0.3 “. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle einer früheren Generation. |
| Modelle der nächsten Generation | Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Der Standardwert ist 0.2 für die meisten Modelle der nächsten Generation; er ist 0.1 für Modelle, die auf der neuen Technologie zur Sprachmodellanpassung basieren. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle der nächsten Generation. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
end_of_phrase_silence_time
Ein optionales Doppelzeichen zwischen 0,0 und 120,0 gibt das Pausenintervall an, bei dem der Service eine Transkription in mehrere Endergebnisse als Reaktion auf die Sprechpause aufteilt. Der Service verwendet standardmäßig ein Pausenintervall von 0,8 Sekunden für alle Sprachen, außer für Chinesisch, hier wird ein Intervall von 0,6 Sekunden verwendet. Weitere Informationen finden Sie im Abschnitt Sprechpausenzeit nach Ausdrucksende.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
grammar_name
Eine optionale Zeichenfolge, die eine Grammatik angibt, die für die Spracherkennung verwendet werden soll. Der Service erkennt nur Zeichenfolgen, die von der Grammatik definiert sind. Sie müssen sowohl den Namen der Grammatik angeben als auch die Anpassungs-ID des angepassten Sprachmodells, für das die Grammatik definiert ist. Weitere Informationen enthält der Abschnitt Grammatik bei der Spracherkennung verwenden.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle einer früheren Generation. |
| Modelle der nächsten Generation | Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle der nächsten Generation. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
inactivity_timeout
Ein optionaler ganzzahliger Wert, der die Anzahl der Sekunden für das Inaktivitätszeitlimit des Service angibt. Inaktivität bedeutet, dass der Service keine Spracherkennung für die Streaming-Audiodaten durchführt. Der Standardwert ist 30 Sekunden.
Der Wert -1 bedeutet 'Unendlich'. Weitere Informationen finden Sie im Abschnitt Inaktivitätszeitlimit.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
interim_results
Ein optionaler boolescher Wert, der den Service anweist, temporäre Hypothesen zurückzugeben, die bis zur endgültigen Transkription noch geändert werden können. Die Standardeinstellung false gibt an, dass keine Zwischenergebnisse
zurückgegeben werden. Zwischenergebnisse sind nur bei Verwendung der WebSocket-Schnittstelle verfügbar. Weitere Informationen finden Sie unter Zwischenergebnisse.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für Modelle der nächsten Generation, die geringe Latenzzeit unterstützen, wenn die beiden Parameter interim_results und low_latency auf true gesetzt sind. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Nicht unterstützt |
| Asynchrones HTTP | Nicht unterstützt |
Schlüsselwörter
Ein optionales Array mit Schlüsselwortzeichenfolgen, die der Service in den Audioeingabedaten erkennt. Die Funktion für Schlüsselworterkennung ist standardmäßig inaktiviert. Weitere Informationen finden Sie im Abschnitt Schlüsselworterkennung.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Nicht verfügbar. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
keywords_threshold
Ein optionales Doppelzeichen zwischen 0,0 und 1,0, das den Mindestschwellenwert für eine positive Schlüsselwortübereinstimmung angibt. Die Funktion für Schlüsselworterkennung ist standardmäßig inaktiviert. Weitere Informationen finden Sie im Abschnitt Schlüsselworterkennung.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Nicht verfügbar. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
language_customization_id
Eine optionale Anpassungs-ID für ein angepasstes Sprachenmodell, das Terminologie aus Ihrem Fachgebiet enthält. Standardmäßig wird kein angepasstes Modell verwendet. Weitere Informationen finden Sie unter Angepasstes Sprachmodell für die Spracherkennung verwenden.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle einer früheren Generation. |
| Modelle der nächsten Generation | Allgemein verfügbar oder Betaversion für alle Modelle, die die Anpassung von Sprachmodellen unterstützen. Weitere Informationen finden Sie unter Anpassungsunterstützung für Modelle der nächsten Generation. |
| WebSocket | Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
low_latency
Ein optionaler boolescher Wert, der angibt, ob der Service schneller Ergebnisse liefern soll (möglicherweise mit geringerer Transkriptionsgenauigkeit). In der Standardeinstellung (false) ist die geringe Latenzzeit nicht aktiviert.
Weitere Informationen finden Sie unter Geringe Latenzzeit.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar (nur für „ en-US “). |
| Modelle der vorherigen Generation | Nicht verfügbar. |
| Modelle der nächsten Generation | Allgemein verfügbar oder als Betaversion verfügbar für Modelle der nächsten Generation, die geringe Latenzzeit unterstützen. Weitere Informationen finden Sie unter Unterstützte Sprachmodelle der nächsten Generation. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
max_alternatives
Ein optionaler ganzzahliger Wert, der die maximale Anzahl alternativer Hypothesen angibt, die vom Service zurückgegeben werden. Standardmäßig gibt der Service eine einzige endgültige Hypothese zurück. Weitere Informationen finden Sie im Abschnitt Maximale Anzahl Alternativen.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
Modell
Ein optionales Modell, das die Sprache und die Abtastrate für die Audiodaten angibt: Breitband/Multimedia oder Schmalband/Telefonie. Standardmäßig wird en-US_BroadbandModel verwendet. Weitere Informationen finden Sie unter Modell für Spracherkennung verwenden.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Abfrageparameter für Verbindungsanforderung mit der Methode /v1/recognize |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
processing_metrics
Ein optionaler boolescher Wert, der angibt, ob der Service Metriken zur Verarbeitung der Audioeingabedaten zurückgibt. Die Standardeinstellung false gibt an, dass der Service keine Verarbeitungsmetriken zurückgibt. Weitere Informationen
finden Sie unter Verarbeitungsmetriken.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Nicht verfügbar. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Nicht unterstützt |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
processing_metrics_interval
Ein optionaler Gleitkommawert von mindestens 0,1, der das Intervall angibt, in dem der Service Verarbeitungsmetriken zurückgeben soll. Lautet der Wert des Parameters processing_metrics true, gibt der Service Verarbeitungsmetriken
standardmäßig alle 1,0 Sekunden zurück. Weitere Informationen finden Sie unter Verarbeitungsmetriken.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Nicht verfügbar. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Nicht unterstützt |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
profanity_filter
Ein optionaler boolescher Wert, der angibt, ob der Service vulgäre Ausdrücke aus einer Transkription filtert (zensiert). Der Standardwert true bedeutet, dass vulgäre Ausdrücke aus derTranskription gefiltert werden. Weitere Informationen
finden Sie im Abschnitt Vulgäre Ausdrücke filtern.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
redaction
Ein optionaler boolescher Wert, der angibt, ob der Service numerische Daten mit mindestens drei aufeinanderfolgenden Ziffern aus einer Transkription schwärzt (maskiert). Die Standardeinstellung false gibt an, dass numerische Daten
nicht geschwärzt werden. Wenn Sie den Parameter redaction auf true setzen, erzwingt der Service automatisch den Wert true für den Parameter smart_formatting und inaktiviert die Parameter
keywords, keywords_threshold, max_alternatives und (für die WebSocket-Schnittstelle) interim_results. Weitere Informationen finden Sie im Abschnitt Zahlenschwärzung.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Beta für Englisch und Japanisch. |
| Modelle der vorherigen Generation | Betaversion für amerikanisches Englisch, Japanisch und Koreanisch. |
| Modelle der nächsten Generation | Betaversion für amerikanisches Englisch, Japanisch und Koreanisch. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
smart_formatting
Ein optionaler boolescher Wert, der angibt, ob der Service Datums- und Zeitangaben, Zahlen sowie Währungswerte und ähnliche Werte in der endgültigen Transkription in eine konventionelle Darstellung umwandelt. Für amerikanisches Englisch wandelt
die Funktion außerdem bestimmte Schlüsselwortausdrücke in Interpunktionszeichen um. Die Standardeinstellung false gibt an, dass keine intelligente Formatierung vorgenommen wird. Weitere Informationen finden Sie im Abschnitt
Intelligente Formatierung.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Im Allgemeinen verfügbar für US-Englisch, Japanisch und Spanisch (alle Varianten). |
| Modelle der nächsten Generation | Im Allgemeinen verfügbar für US-Englisch, Japanisch und Spanisch (alle Varianten). Es ist auch für das Modell „ en-WW_Medical_Telephony “ verfügbar, wenn US-Englisch-Audio erkannt wird. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
smart_formatting_version (intelligente Formatversion)
Eine optionale Ganzzahl, die angibt, ob der Dienst Datumsangaben, Uhrzeiten, Zahlen, Währungsangaben und ähnliche Werte im endgültigen Transkript in gängigere Darstellungsformen umwandelt. Weitere Informationen finden Sie unter „ Intelligente Formatierung “.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen außer Japanisch. |
| Modelle der vorherigen Generation | Nicht unterstützt. |
| Modelle der nächsten Generation | Allgemein verfügbar nur für amerikanisches Englisch (einschließlich en-WW_Medical_Telephony), brasilianisches Portugiesisch, Französisch (Frankreich), Deutsch, Französisch (Kanada) und Spanisch. |
| WebSocket | Parameter der JSON- start-Nachricht. Der Service inaktiviert Zwischenergebnisse. |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
speaker_labels
Ein optionaler boolescher Wert, der angibt, ob der Service markiert, welche Personen in einer Konversation mit mehreren Beteiligten welche Worte gesprochen haben. Wenn Sie den Parameter speaker_labels auf true setzen,
erzwingt der Service automatisch, dass der Parameter timestamps auf true gesetzt wird. Die Standardeinstellung false gibt an, dass keine Sprecherbezeichnungen zurückgegeben werden. Weitere Informationen
finden Sie im Abschnitt Sprecherbezeichnungen.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Beta für alle Sprachen. |
| Modelle der vorherigen Generation | Beta für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
speech_detector_sensitivity
Ein optionaler Gleitkommawert zwischen 0,0 und 1,0, der die Empfindlichkeit der Spracherkennung für Nicht-Sprechereignisse in der Audioeingabe angibt. Der Standardwert beträgt 0,5, was eine angemessene Stufe für die Empfindlichkeit für Nicht-Sprechereignisse darstellt. Weitere Informationen finden Sie unter Sensibilität des Sprachdetektors.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachmodelle außer für ar-MS_BroadbandModel, pt-BR_BroadbandModel, zh-CN_BroadbandModel, zh-CN_NarrowbandModel und de-DE_BroadbandModel. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
split_transcript_at_phrase_end
Ein optionaler boolescher Wert, der angibt, ob der Service basierend auf semantischen Merkmalen der Eingabe, wie z. B. Sätzen, eine Transkription in mehrere Endergebnisse aufspaltet. Der Service basiert auf dem Verständnis von semantischen Merkmalen
für das Basissprachmodell, das auch von angepassten Sprachmodellen und Grammatiken beeinflusst wird. Standardmäßig (false) generiert der Service keine semantischen Aufteilungen. Weitere Informationen finden Sie im Abschnitt
Transkription nach Ausdrucksende aufteilen.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
timestamps
Ein optionaler boolescher Wert, der angibt, ob der Service Zeitmarken für die Wörter der Transkription erstellt. Die Standardeinstellung false gibt an, dass keine Zeitmarken zurückgegeben werden. Weitere Informationen finden Sie
im Abschnitt Wortzeitmarken.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
Transfer-Encoding
Ein optionaler Wert für chunked, der bewirkt, dass die Audiodaten per Streaming zum Service übertragen werden. Standardmäßig werden die Audiodaten alle auf einmal als Einzelübertragung gesendet. Weitere Informationen finden Sie
im Abschnitt Übertragung von Audiodaten.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Nicht zutreffend; immer per Streaming |
| Synchrones HTTP | Anforderungsheader der Methode POST /v1/recognize |
| Asynchrones HTTP | Anforderungsheader der Methode POST /v1/recognitions |
word_alternatives_threshold
Ein optionales Doppelzeichen zwischen 0,0 und 1,0, das den Schwellenwert angibt, ab dem der Service automatisch ähnliche Alternativen für Wörter aus den Audioeingabedaten liefert. Standardmäßig werden keine Wortalternativen zurückgegeben. Weitere Informationen finden Sie im Abschnitt Wortalternativen.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Nicht verfügbar. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Nicht verfügbar. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
word_confidence
Ein optionaler boolescher Wert, der angibt, ob der Service Konfidenzwerte für die Wörter der Transkription bereitstellt. Die Standardeinstellung false gibt an, dass keine Konfidenzwerte für Wörter zurückgegeben werden. Weitere Informationen
finden Sie im Abschnitt Wortkonfidenz.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Parameter der JSON-Nachricht start |
| Synchrones HTTP | Abfrageparameter der Methode POST /v1/recognize |
| Asynchrones HTTP | Abfrageparameter der Methode POST /v1/recognitions |
X-Watson-Learning-Opt-Out
IBM Cloud
Ein optionaler boolescher Wert, der angibt, ob die Anforderungsprotokollierung inaktiviert werden soll, die von IBM standardmäßig durchgeführt wird, um den Service für zukünftige Benutzer zu verbessern. Wenn Sie nicht zulassen möchten, dass
Ihre Daten von IBM für die allgemeine Verbesserung des Service verwendet werden, geben Sie für diesen Parameter true an. Wenn Sie das Opt-out durchführen, protokolliert der Service keine Benutzerdaten aus Ihren Anforderungen,
d. h. es werden keine Audio- oder Textdaten auf Platte gespeichert. Sie können die Ablehnung auch auf Kontoebene durchführen. Weitere Informationen finden Sie im Abschnitt Anforderungsprotokollierung.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Abfrageparameter x-watson-learning-opt-out der Verbindungsanforderung /v1/recognize |
| Synchrones HTTP | Anforderungsheader für jede Anforderung |
| Asynchrones HTTP | Anforderungsheader für jede Anforderung |
X-Watson-Metadata
Eine optionale Zeichenfolge, die eine Kunden-ID den Daten zuordnet, die für Erkennungsanforderungen übergeben werden. Der Parameter akzeptiert das Argument customer_id={id}. Standardmäßig wird den Daten keine Kunden-ID zugeordnet.
Weitere Informationen finden Sie im Abschnitt Informationssicherheit.
| Verfügbarkeit und Verwendung | Beschreibung |
|---|---|
| Große Sprachmodelle | Allgemein verfügbar für alle Sprachen. |
| Modelle der vorherigen Generation | Allgemein verfügbar für alle Sprachen. |
| Modelle der nächsten Generation | Allgemein verfügbar für alle Sprachen. |
| WebSocket | Abfrageparameter x-watson-metadata für Verbindungsanforderung mit der Methode /v1/recognize. (Sie müssen das Argument mit „ URL “ verschlüsseln. Zum Beispiel customer_id%3dmy_customer_ID |
| Synchrones HTTP | Anforderungsheader der POST-Anforderung /v1/recognize |
| Asynchrones HTTP | Anforderungsheader für POST /v1/register_callback- |
und `POST /v1/recognitions`-Anforderungen |