Configurer le modèle d'IA pour le service de récupération

Le service de récupération dans watsonx.data permet aux administrateurs de configurer le modèle de base qui alimente les tâches basées sur la récupération, telles que la conversion de texte en SQL, la réponse à des questions et le RAG. Au niveau de l'instance, vous pouvez choisir entre les modèles granite (par défaut), llama et gpt, en fonction des exigences en matière de licence et de charge de travail.

Procédure

  1. Connectez-vous à la console watsonx.data.

  2. Dans le menu de navigation, sélectionnez Configurations, puis cliquez sur la vignette Modèle de service de récupération.

  3. Dans la section Service de récupération, choisissez l'un des modèles d'IA disponibles suivants :

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
    • gpt-oss-120b


    Pour utiliser gpt-oss-120b avec le service de récupération, vous devez d'abord déployer le modèle dans la région de Toronto. Pour obtenir des instructions détaillées, consultez Déploiement de modèles de base à la demande(chemin rapide).

  4. Une boîte de dialogue de confirmation apparaît, cliquez sur Sélectionner.

  5. Sous Texte vers SQL, choisissez l'un des modèles d'IA disponibles suivants :

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
  6. Une boîte de dialogue de confirmation apparaît, cliquez sur Sélectionner.