Configurare il modello AI per il servizio di recupero

Il servizio di recupero in watsonx.data consente agli amministratori di configurare quale modello di base alimenta le attività basate sul recupero, come text-to-SQL, risposta alle domande e RAG. A livello di istanza, è possibile scegliere tra i modelli granite (predefinito), llama e gpt, in base ai requisiti di licenza e carico di lavoro.

Procedura

  1. Accedi alla watsonx.data console.

  2. Dal menu di navigazione, seleziona Configurazioni e fai clic sul riquadro Modello di servizio di recupero.

  3. Nella sezione Servizio di recupero, scegli uno dei seguenti modelli di IA disponibili:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
    • gpt-oss-120b


    Per utilizzare gpt-oss-120b il servizio di recupero, è necessario prima distribuire il modello nella regione di Toronto. Per istruzioni dettagliate, consulta Distribuzione di modelli di base su richiesta(percorso rapido).

  4. Viene visualizzata una finestra di dialogo di conferma, fare clic su Seleziona.

  5. In Testo in SQL, scegli uno dei seguenti modelli AI disponibili:

    • granite-3-8b-instruct
    • llama-3-3-70b-instruct
  6. Viene visualizzata una finestra di dialogo di conferma, fare clic su Seleziona.