KI-Modell für den Abrufdienst konfigurieren
Der Abrufdienst in watsonx.data ermöglicht es Administratoren zu konfigurieren, welches Basismodell abrufbasierte Aufgaben wie Text-zu-SQL, Beantwortung von Fragen und RAG unterstützt. Auf Instanzebene können Sie je nach Lizenz- und Workload-Anforderungen zwischen Granite- (Standard), Llama- und GPT-Modellen wählen.
Vorgehensweise
-
Melden Sie sich an der watsonx.data-Konsole an.
-
Wählen Sie im Navigationsmenü „Konfigurationen“ aus und klicken Sie auf die Kachel „ Abrufdienstmodell “.
-
Wählen Sie im Abschnitt „ Retrival-Dienst “ eines der folgenden verfügbaren KI-Modelle aus:
- granite-3-8b-instruct
- llama-3-3-70b-instruct
- gpt-oss-120b
Um den Abrufdienst nutzen gpt-oss-120b zu können, müssen Sie das Modell zunächst in der Region Toronto bereitstellen. Ausführliche Anweisungen finden Sie unter Bereitstellen von Basismodellen nach Bedarf(Schnellpfad). -
Ein Bestätigungsdialogfeld wird angezeigt. Klicken Sie auf „ Auswählen “.
-
Wählen Sie unter „ Text zu SQL “ eines der folgenden verfügbaren KI-Modelle aus:
- granite-3-8b-instruct
- llama-3-3-70b-instruct
-
Ein Bestätigungsdialogfeld wird angezeigt. Klicken Sie auf „ Auswählen “.